AI视频生成工具终于不再只能做15秒短视频了。7月20日,在2026世界人工智能大会(WAIC)上,智象未来(HiDream.ai)正式发布了vivago R1——一款支持无限时长视频连续生成的多模态创作智能体。
这款产品的核心卖点用三个字概括:”长、长、稳”。
第一个”长”:打破15-30秒限制,支持任意时长连续生成。目前市面上的AI视频工具普遍只能生成十几秒到半分钟的短镜头,做不了短剧、专题片、品牌宣传片这类需要持续叙事的长视频。vivago R1可以生成任意时长的连贯视频,直接对标商业制作场景。
第二个”长”:具备长任务思考能力。不是简单地把多个短镜头拼接在一起,而是能够自主完成叙事构思、镜头排布与风格校准。从理解任务、构思故事线、创作分镜、生成素材到输出完整视频,全链路原子化封装。这解决了AI视频生成领域一个长期痛点——画面跳变、人设崩塌、叙事断层。

第三个”稳”:内容可用成功率达85%。这个数字意味着什么?过去用AI视频工具,生成10条素材可能只有2-3条能直接用,其余需要反复调试或人工修正。vivago R1依托自研的HD-AgentOS智能体操作系统进行全流程调度,大幅降低了调试成本,生成的内容可以直接用于商业制作和市场交付。
底层架构:HD-AgentOS智能体操作系统
vivago R1并非独立产品,而是智象自研HD-AgentOS操作系统的关键输出。这套系统分为三层架构:资源层提供模型、工具、数据等底层调用能力;系统层负责智能体调度、多单元协同、全流程安全治理;能力层将模型能力封装为面向影视、营销等领域的标准化技能。

智象未来创始人兼CEO梅涛在大会演讲中提出一个观点:一个看似简单的”分镜生成”任务,需要理解镜头语言、叙事节奏和体裁差异,这绝非直接调用大模型API就能实现。只有多智能体集群协作,模拟专业团队分工,才能胜任复杂创作任务。
生态布局:不只做工具,还要建生态
除了vivago R1的产品发布,智象未来在本届大会同步推进了两项产业协同布局。一是联合飞捷科思等机构发起”物理智能创新联合体”倡议,整合产学研资源推进原生全模态世界模型技术的协同研发。二是与中科类脑等签约组建”一带一路”Token出海联盟,推动中国原生全模态AI能力走向全球市场。

公司提出的”1+1+3″商业模式也值得关注:一个自有底座模型加一个智能体平台,覆盖影视、营销、社媒三大垂直场景。这种模式的核心思路是,不追求做”通用万能”的AI平台,而是在垂直赛道上建立足够深的壁垒。
对于短剧制作方、品牌营销团队和社媒运营人员来说,vivago R1解决的是一个很实际的问题:过去用AI做视频,只能做碎片化素材;现在可以做完整的、有叙事逻辑的、直接能用的长视频内容。85%的可用成功率也意味着,创作团队不用再把大量时间花在反复调试AI输出上,可以把精力放回创意本身。
AI视频赛道正在从”能生成”走向”能交付”,vivago R1是这一转变的标志性产品之一。接下来能不能在实际商业场景中兑现85%可用率的承诺,还需要市场验证,但至少方向已经打开了。






