品玩

科技创新者的每日必读

打开APP
关闭
业界动态

从 WAIC 到全球用户,智象未来 vivago R1 正式上线:视频创作的终点,终于回归表达本身

shuohang

发布于 1小时前

9月8日,AI视频创作领域迎来一次重要的里程碑。智象未来(HiDream.ai)正式宣布旗下内容创作智能体 vivago R1 面向全球用户开放,与此同时,国内版本「够搭」也完成了全新升级发布,此举标志着AI辅助内容创作正式迈入一个强调完整交付与专业品质的新周期。

回顾今年7月,vivago R1 在世界人工智能大会WAIC 2026上的首次亮相,便凭借全球首个无限时长内容创作智能体的定位引发行业热议。如今,这款凝聚了智象未来技术积淀的产品,终于从舞台走向市场,接受全球创作者的检验。

跨越时长的鸿沟:从片段叙事到完整表达

长久以来,AI视频生成虽屡有惊艳之作,但始终受限于时长的桎梏。从Sora展示的15秒高质量片段,到如今行业普遍的30秒上限,创作者们渴望的更长的叙事空间始终未能被充分满足。vivago R1 的核心突破,在于其一次性稳定输出5分钟高质量视频的能力,并支持无限次的多轮时长延长,真正打破了AI视频“只能拍短片”的魔咒。

Vivago R1 的强大之处,并不仅限于时间的拉长,更在于对长视频叙事逻辑的掌控。在多镜头、多角色、多场景的复杂转换中,vivago R1 通过其内置的 Agent 系统进行宏观规划与微观调度。主 Agent 精准拆解用户的创意需求,多个子 Agent 则各司其职,协同完成脚本撰写、分镜设计、角色塑造、场景构建与音效匹配,确保整部作品的叙事节奏、视觉风格与角色形象在多段落中高度统一与连贯。

这背后离不开智象自研的 HD-AgentOS 全流程调度系统,该系统将vivago R1 的内容有效可用成功率提升至85%,大幅降低了传统AI视频创作中常见的“抽卡”不确定性。同时,R1 针对跨镜头角色一致性及场景过渡的自然度进行了深度优化,有效减弱了AI视频中常见的“塑料感”与“瞬移感”,使最终成品的运镜衔接与音画同步更接近实拍质感,让长视频拥有了真正的电影感。

对话即创作:将复杂性隐藏在极简交互背后

在当前AI视频工具百花齐放的市场中,产品路径逐渐分化。一类是面向专业玩家的“画布式”或“节点式”工作流,虽然提供了极高的自由度,但也预设了较高的操作门槛,而 vivago R1 则选择了另一条路——Chat-First(对话优先)。

智象认为,人类最本能的表达方式是对话,这也应是AI创作最友好的入口。用户无需面对复杂的参数和节点,只需用自然语言描述心中所想,vivago R1 便能自动进入创作流程,并在持续的对话中根据用户反馈进行调整与迭代。这种“所想即所得”的体验,源自智象“做后”与“做厚”的双重原则:将专业创作者的审美与经验编码进 Agent 的编排逻辑,打造强大的中后台,同时构建 SkillHub,将抽象的AI能力转译为产品广告、角色视频、故事短片等具体创作场景,让用户能清晰感知工具的边界与起点。

这种设计哲学,并非简单地将复杂功能藏匿,而是通过智能的编排系统,将用户从“学习工具”的负担中解放出来,让“灵感闪现”到“开始执行”的过程,缩短至仅仅一句话的距离。

原生全模态筑基:AI创作进入“项目制”时代

视频创作的另一大痛点在于“一致性”的维持。在同一部作品中,如何确保角色形象、声音特征在数十个镜头中保持一致,是衡量AI工具是否专业的关键。

智象的解法是基础模型与智能体系统双轮驱动,一方面,其自研的原生全模态世界模型,为vivago R1 提供了坚实的多模态理解与生成底座。它能将文本、图片、视频、参考资产乃至历史创作成果无缝融入同一任务语境,使 Agent 能够理解“项目全貌”,而非仅仅执行孤立指令。用户可以“说不清的直接给”素材,vivago R1 会在统一的上下文中进行理解和创作。

另一方面,强大的智能体系统将这些能力组织成可持续推进的创作流程。配合新推出的“资产库”功能,用户在创作过程中生成并认可的内容可以被系统性地沉淀和复用。这意味着,每一次创作都不是终结,而是下一次创意的基石,AI创作真正从单次生成走向了持续迭代的项目制管理。

全球创作者实证:表达即是生产力

在 vivago R1「够搭」沉浸式工作坊活动现场,来自全球的创作者们通过线上线下的方式,展示了他们利用 vivago R1产出的优秀作品。

从引发热议的AI版《西游记》再创作,到细腻还原体育老师心路历程的励志短片,再到质感堪比商业大片的红色折叠手机广告,vivago R1展示了其在东方奇幻、真人情感、商业视觉等多元题材上的强大适配能力。创作者无需复杂的操作,仅通过提交提示词并与 R1 对话补充想法,即可完成对人物关系、情绪转折与镜头语言的精准把控。正如一位海外创作者所言:“视频创作的终点,就是一次表达。”vivago R1 正是将这一理念贯彻到底的产品。

树立行业新标尺:CHATS评估框架正式发布

随着 R1 的正式上线,智象未来提炼并发布了一套面向视频 Agent 的评估框架CHATS™,其不仅是vivago R1自身能力的总结,更为行业提供了一套可衡量、可依赖的交付标准。其中,C代表一致性(Consistency):确保角色、场景与风格在多镜头中稳定呈现。H表示意图理解(Human Intent):精准洞悉用户创意,并在多轮对话中持续推进创作。A代表视听完整度(Audio & Visual):追求画面与声音、节奏的和谐统一,构建完整视听体验。T代表时间线与叙事(Timeline & Tale):保障故事在长篇幅、多段落中逻辑自洽、引人入胜。S意味着稳定交付(Stability):提升内容可用率,降低反复返工的成本。

从2024年5月 vivago.ai 作为全球首批公开可用的AI视频产品上线,到如今全球用户突破7000万,智象未来用两年时间完成了从“首次可用”到“单反级交付”的跨越。vivago R1 中的“R”,既代表了 Reasoning(推理),用深度推理将灵感固化为作品,也象征着 Rock(摇滚),致敬“The Show Must Go On”的创作精神。

面向AI视频新时代,智象未来vivago R1正致力于让创作从一次性生成,进化为一场可持续的对话创作,让所有的灵感与故事以高品质视频完整呈现。

下载品玩App,比99.9%的人更先知道关于「业界动态」的新故事

下载品玩App

比99.9%的人更先知道关于「业界动态」的新故事

iOS版本 Android版本
立即下载
shuohang

这家伙很懒,什么也没留下,却只想留下你!

取消 发布
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测