WeChat 微信公众号
creative-aiai-tools
Original source

AI视频竟然可以实时互动了,Vivix有点厉害

Summary

介绍 Vivix(vivix.ai)— 一家做实时交互多模态视频模型的公司。核心差异化:AI生成的视频不只是「生成完观看」,而是可以边生成、边互动、边改变。

两个模型

A1 — 交互式 AI 角色

  • 给一张人物图 → 生成全身可驱动角色,活在完整空间中
  • 不只是「会说话的头」,支持全身动作(拿东西、跳舞、转身)
  • 实时对话时可做出对应动作,可随时打断
  • 应用场景:AI陪伴、直播带货(虚拟主播能被观众随时打断提问)

W1 — 交互式故事/世界

  • 故事自动播放,用户可随时介入:
    • 语音/文字改变剧情方向
    • 选项分支(但非预制,是实时生成)
    • 直接操作(如开炮)
    • 拖入图片让新角色出现
  • 与传统互动短剧不同:没有预制分支,每个观众看到的故事都不同
  • 游戏应用:NPC能理解玩家意图,实时改变行为

关键技术指标

  • 用户指令到视频可见反应延迟 < 0.6 秒
  • 全链路(含网络/推流)首次反应延迟 < 1.7 秒
  • 过去一年推理成本降低约两个数量级,进入云游戏/流媒体成本区间

当前局限

  • W1 实时版在画质、复杂运动、高密度场景上仍有提升空间
  • 离线视频模型单次生成质量仍有优势(不同优化目标)
  • 目前需要排队才能体验

核心观点

视频从「最终载体」变成「人和AI交流的界面」。与 Seedance/可灵等模型的区别:后者追求单次成片质量,Vivix 追求持续流式生成+实时交互。