智能体从“助理”变“搭子”:智象未来vivago R1开启内容创作新范式
7月18日,在2026世界人工智能大会(WAIC)现场,智象未来(HiDream.ai)的一场发布会引发行业关注,全球首个无限时长内容创作多模态智能体vivago R1正式亮相。在AI视频生成赛道普遍停留在15至30秒短镜头生成的当下,这一产品的发布意味着内容创作领域的一次重要转折:AI正从辅助生成单点素材的工具,进化为能够自主规划、调度并完成长链路创作任务的智能搭子。
三个痛点与三把钥匙
智象未来创始人兼CEO梅涛在大会期间指出,当前AI视频行业长期受困于三大痛点:时长受限、逻辑混乱、效果不稳。vivago R1的“长、长、稳”三大特质,正是对这三大痛点的精准回应。

行业主流产品仅支持15至30秒的短镜头生成,这一限制使得AI视频长期被排除在短剧、专题片、品牌宣传片等长周期商业创作之外。vivago R1支持任意时长视频的连续、连贯生成,全面适配从短视频vlog到影视成片的全品类创作场景。
长视频创作远非短镜头的机械拼接,一段15秒的短视频可以靠单点创意支撑,但一部10分钟、30分钟甚至更长的作品,需要完整的叙事逻辑、统一的画面风格和稳定的人物设定。vivago R1具备长任务思考能力,可自主完成精细化逻辑构思、镜头排布与风格校准,有效解决AI生成视频常见的画面跳变、人设崩塌、叙事断层、风格割裂等行业难题。
传统大模型存在概率性输出偏差,成片可用率低,企业需要投入大量人力进行反复调试和修改。依托HD-AgentOS智能体操作系统的全流程调度与治理能力,vivago R1将内容有效可用成功率提升至85%,远高于行业平均水平。这意味着生成内容可直接应用于商业制作、品牌传播与市场化交付,极大降低了反复修改调试的时间与人力成本。
HD-AgentOS:藏在产品背后的“隐形操盘手”
vivago R1的能力并非凭空而来,支撑其稳定运行的是智象未来自研的HD-AgentOS智能体操作系统。
这套系统搭建了资源层、系统层、能力层三层耦合架构,资源层提供智能体可调用的模型、工具、数据等底层能力;系统层负责智能体调度、多单元协同与全流程安全治理;能力层则将模型能力封装为面向影视、营销等领域的标准化技能。

这三层的价值在于形成了一个从“能力供给”到“任务调度”再到“技能输出”的完整闭环。在多智能体协作场景中,这一架构确保了不同智能体之间的有序分工与高效协同,有的负责理解任务与构思故事线,有的负责创作分镜脚本,有的负责生成核心素材,有的负责将片段串联成超长视频。这种类似专业团队的分工模式,正是vivago R1能够完成长链路创作任务的技术保障。
从数字世界走向物理世界
在WAIC中国信通院论坛的主旨演讲中,梅涛系统阐述了大模型与智能体双向并进、走向世界模型的发展态势。在他看来,人工智能的终极演进方向是通过智能体落地产业,从数字世界走向物理世界的深度融合。
这一判断与智象未来的技术路线一脉相承。智象未来长期押注原生全模态架构,其HiDream系列大模型是全球首批原生全模态架构大模型。梅涛曾指出,一个真正的世界模型需要同时满足多个条件:理解世界、推理世界,重构世界。从这一标准来看,vivago R1在“长时间跨度的因果推理”和“全模态交互”两个维度上已迈出了关键一步,它不仅能生成长视频,还能理解叙事逻辑、保持风格统一、维持角色一致性。
产业协同:从单点突破到系统作战
在WAIC 2026期间,智象未来同步推进了两项生态布局。一是联合飞捷科思等机构发起“物理智能创新联合体”倡议,聚合产学研力量推进原生全模态世界模型的技术协同研发。二是与中科类脑等机构签约组建“一带一路”Token出海联盟,推动中国AI能力走向全球。
这两项布局与vivago R1的产品发布形成了技术+生态的双轮驱动,产品解决的是“能做什么”的问题,生态解决的是“能做多大”的问题。
有行业人士指出,AI视频生成正处在一个关键的转折点。过往的模型参数竞赛逐步让位于“基础模型+智能体系统”的生态竞争。智象未来提出的“1+1+3”商业模式,即一个HiDream系列大模型底座、一个Token Hub平台、商业营销、影视创作、内容创作三大垂直场景智能体,正是对这一趋势的回应。
vivago R1的发布,至少在三个维度上为行业树立了新的参照系,时长的天花板被打破、叙事逻辑的连贯性得到系统性解决、商业可用率提升到了可规模化交付的水平。这三个维度合在一起,或许意味着AI视频创作正在从玩具走向工具,从实验品走向生产力。
(审核:欧云海)






