9 月 8 日,智象未来(HiDream.ai)旗下内容创作智能体 vivago R1 面向全球用户开放,国内版「够搭」同步升级。R1 单次可生成最长 5 分钟视频,支持多轮延长,靠主 Agent 拆解创意、子 Agent 分管脚本、分镜、角色、场景、音效,把跨镜头一致性交给调度系统。自研 HD-AgentOS 将有效可用成功率提至 85%(厂商自测,暂无第三方对照)。

一、时长不是目的,叙事才是

当前 AI 视频主流仍停留在 Sora 式 15–30 秒片段。vivago R1 的跨越在于一次性稳定输出最长 5 分钟视频,并支持无限次多轮延长,把创作单元从「镜头」抬到「段落」乃至「全片」。但真正的难点不是把时间拉长,而是数分钟、多角色、多场景里如何保持逻辑自洽、角色统一、风格连贯。R1 选择用 Agent 系统做全局规划与动态调度来破解。

二、主 Agent 当总编,五个子 Agent 当剧组

R1 采用多智能体协作:主 Agent 理解并拆解用户模糊的创意意图,子 Agent 分别承担脚本撰写、分镜设计、角色塑造、场景构建与音效匹配,彼此实时校准人物表情一致性、光影连续性与叙事节奏。底层由自研 HD-AgentOS 全流程调度,官方称内容有效可用成功率达 85%(内部测试,尚无第三方评测对照)。这正是 Agent「拆解复杂目标—分工—对齐—交付」范式在内容生产的落地。

三、视频 Agent 进入「项目制」时代

R1 走 Chat-First 路线,用户用自然语言描述目标,系统自动匹配工具推进;配套资产库可沉淀已认可的角色与场景,用于后续项目复用,创作从「单次生成」走向「持续迭代的项目」。智象同步提出面向视频 Agent 的 CHATS 评估框架(一致性、意图理解、视听完整度、时间线与叙事、稳定交付)。在 Sora 停更、长视频成为新赛道的当下,中国厂商正用「多 Agent 编排 + 世界模型底座」接棒——但可用率等核心指标仍需独立验证。