Impossible-Videos 是评测安全领域的开源项目,由 showlab 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 467 个项目,GitHub 星标数为 81。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-06-30。提供在线演示页面,完全免费。从国内网络环境看,可直接访问。
它主要面向的使用场景是:多模态大模型视频理解能力评测与对比。同类可对比的替代方案包括 VideoGLUE、EvalCrafter、VBench。

用不可能视频,测出多模态模型的物理常识短板
Impossible-Videos 是 ICML 2025 论文的官方基准与代码库,专注于视频生成与理解中的‘不可能视频’挑战。这类视频包含物理上不可能或高度反直觉的事件,例如物体违反重力、时空扭曲或因果倒置,旨在测试和提升多模态大模型对视频内容真实性与逻辑性的感知能力。项目提供标准化的数据集、评估指标和基线模型,帮助研究者量化模型在识别异常、推理物理规律、检测编辑痕迹等方面的表现。核心能力包括:构建高难度视频样本库,覆盖多种不可能类型;提供自动化评估工具,支持生成与理解双任务;集成多模态模型接口,便于快速验证。该基准填补了现有视频理解评测在物理常识与反事实推理上的空白,推动模型从表面感知走向深层认知。
VideoGLUE、EvalCrafter、VBench
Impossible-Videos 是评测安全领域的开源项目,由 showlab 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 467 个项目,GitHub 星标数为 81。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-06-30。提供在线演示页面,完全免费。从国内网络环境看,可直接访问。
它主要面向的使用场景是:多模态大模型视频理解能力评测与对比。同类可对比的替代方案包括 VideoGLUE、EvalCrafter、VBench。
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.