AI视频竟然可以实时互动了,Vivix有点厉害
- URL: https://mp.weixin.qq.com/s/DRanmX9SW6yzdxVIPvInWg
- Date Saved: 2026-08-02
- Source: WeChat 微信公众号
- Tags: creative-ai, ai-tools
Summary
介绍 Vivix(vivix.ai)— 一家做实时交互多模态视频模型的公司。核心差异化:AI生成的视频不只是「生成完观看」,而是可以边生成、边互动、边改变。
两个模型
A1 — 交互式 AI 角色
- 给一张人物图 → 生成全身可驱动角色,活在完整空间中
- 不只是「会说话的头」,支持全身动作(拿东西、跳舞、转身)
- 实时对话时可做出对应动作,可随时打断
- 应用场景:AI陪伴、直播带货(虚拟主播能被观众随时打断提问)
W1 — 交互式故事/世界
- 故事自动播放,用户可随时介入:
- 语音/文字改变剧情方向
- 选项分支(但非预制,是实时生成)
- 直接操作(如开炮)
- 拖入图片让新角色出现
- 与传统互动短剧不同:没有预制分支,每个观众看到的故事都不同
- 游戏应用:NPC能理解玩家意图,实时改变行为
关键技术指标
- 用户指令到视频可见反应延迟 < 0.6 秒
- 全链路(含网络/推流)首次反应延迟 < 1.7 秒
- 过去一年推理成本降低约两个数量级,进入云游戏/流媒体成本区间
当前局限
- W1 实时版在画质、复杂运动、高密度场景上仍有提升空间
- 离线视频模型单次生成质量仍有优势(不同优化目标)
- 目前需要排队才能体验
核心观点
视频从「最终载体」变成「人和AI交流的界面」。与 Seedance/可灵等模型的区别:后者追求单次成片质量,Vivix 追求持续流式生成+实时交互。