外观
EVOKE / Alaya-EVOKE(含 Evoke-Turbo)
14B 自回归交互 WM,外置几何记忆 + 6DoF + 中途 evocation。小时级叙事最激进的开源之一。
结构化 stub:仓库内 data/models/evoke.yml。
核验字段
| 字段 | 值 |
|---|---|
| 名称 | EVOKE / Alaya-EVOKE(含 Evoke-Turbo) |
| 机构 | Alaya Lab + USTC / Shanghai Innovation Institute 等 |
| 公开时间 | arXiv 2026-08;WBench 入榜约 2026-08-14;Turbo 2026-09-11 |
| arXiv | 2608.13546 |
| 参数量 | 14B(3-step CFG-free 学生;教师亦 14B Wan2.2 A14B 系) |
| 基座 | Wan2.2 A14B 系 |
| 分辨率 | 384×640 @ 24 fps 内容时钟 |
| 帧率 | 内容 24 fps。单卡 H200:1.5 s chunk / 2.11 s(≈0.71×实时);五卡 H200 UI 平均 1.34 s/1.5 s chunk(2026-09-12) |
| 延迟 | 以 chunk 延迟计:单卡约 2.11 s / 1.5 s;非「首帧 1.2 s」同口径 |
| 控制 | 相机 6DoF + 中途 per-chunk prompt(evocation);t2v/i2v/v2v |
| 模态 | 视频 + 外部 world state bank(几何) |
| 时长口径 | hours / endless / open-ended;演示含两小时不中断;记忆库保留窗口有界(如 hour-scale 配置约 90 s 几何) |
| 开源 | 是 |
| 许可 | 代码 Apache-2.0;深度后端 ViGeo/DA3 为 CC-BY-NC-4.0(更严) |
| GPU hours | 未公开 |
| 训练硬件 | 推理数字公开到 H200 chunk 延迟;训练 GPU hours 未公开 |
| WBench | 团队自述:WBench 三步 SOTA;Evoke Avg 80.82,Evoke-Turbo Avg 82.0;另报 VBench-2.0/Long(协议有偏差声明) |
| 其他评测 | 论文已声明部分评测协议偏差 |
| 核验日 | 2026-09-16 |
训练阶段
3-step CFG-free 学生;教师 14B。完整 GPU hours 未公开。
选型要点
要超长程/小时级与外置几何 bank 时看。分辨率 384×640,不要和 720p 单卡实时阵营直接比画质吞吐。
诚实边界
内容时钟 24fps ≠ 生成跑赢实时。单卡 H200 约 0.71×实时。深度后端 NC 许可可能卡商用。WBench 为团队自述且论文声明协议偏差。
来源
另见 Wan5B 后训对照、WM 全景、控制接口差异。