首页 / 资讯详情

智象未来 vivago R1 全球上线,国内版本「够搭」全新升级发布:从 15 秒到5 分钟,AI 视频创作进入单反级交付时代

雷锋网 2026-09-10 10:43 中文

摘要

2026年9月8日,智象未来(HiDream.ai)旗下内容创作智能体 vivago R1 全球上线,国内版本 「够搭」 全新升级发布。(雷峰网)今年7月,vivago R1 于 WAIC 2026 首次亮相。作为全球首个无限时长内容创作智能体,R1 引起 AI 视频领域广泛关注。今天,R1正式面向全球用户开放。vivago R1 的核心突破,在于实现了从一句成片时代的 “生成片段” 到 “完全交付作品” 的范式跃迁。它依托智象“基础模型 + 智能体”双轮驱动技术战略,让创作者以自然语言对话的方式,即可完成从创意表达到高质量成片交付的完整创作流程。 R1的上线,标志着AI视频创作进入“单反级交付时代”。每一位普通创作者,都能独立完成专业团队级的品质大片。 01 从Sora的15秒,到R1的五分钟Sora 用15秒视频惊艳世界,成为 AI 视频生成的重要转折点。但时至今日,15-30秒的片段式生成依然是行业主流。R1 的突破在于,能够一次性稳定输出5分钟高质量视频,并支持无限次多轮延长。 长视频的难点,不只是把时长拉长,而是让故事在多镜头、多角色、多场景之间持续成立。R1 通过 Agent 系统对长任务进行规划与调度:主 Agent 拆解创意,子 Agent 协同完成脚本、分镜、角色、场景与音效,确保角色形象、场景风格和叙事节奏在多段落中保持一致。 同时,依托智象自研 HD-AgentOS 的全流程调度与治理能力,R1 内容有效可用成功率提升至85%,显著降低“抽卡”概率,让视频创作更具确定性。R1 还优化了跨镜头角色一致性和场景过渡自然度,弱化 AI 视频常见的“塑料感”和“瞬移感”,实现更自然的运镜衔接与音画对齐,让长视频更接近实拍质感。02 Chat-First (对话优先):让创作回到表达本身好的创作工具,应当顺应人的表达本能。对于视频创作而言,起点不应是节点、画布和参数,而应是创作者想要表达的内容。 R1因此选择 Chat-First (对话优先)路线。因为对话是人类最自然的表达方式,也是 AI 最友好的创作入口。当前 AI 视频工具大致有两条路线:一类是画布式、节点式工作流,将模型、工具和参数交给用户自行连接和调试,自由度高,但门槛也高;另一类是 R1 的对话式路线,用户只需用自然语言描述需求,R1 即可自动生成视频,并支持在对话中持续调整和迭代。这种体验背后,是“做后”与“做厚”两条原则。“做后”,是把专业创作者的判断、审美和经验编码进 Agent 编排能力,形成强大的中后台;“做厚”,是构建 SkillHub,将抽象 AI 能力转译为产品广告、角色视频、故事短片、品牌内容等真实创作场景,让用户更容易理解能做什么、如何开始。 在完整流程中,用户只需表达目标,Agent 负责拆解和执行,SkillHub 则作为翻译层,自动匹配并编排所需 Skill 组合,将用户意图转化为可执行任务序列。 R1 的对话式创作,不是把复杂消灭,而是把复杂藏在简单背后。它让创作从“灵感闪现”到“进入执行”,缩短到只剩一句话。03 原生全模态基础架构,让 AI创作走向项目制视频生成的另一大挑战,是一致性:同一个角色、同一种声音,如何在数十个镜头、多次生成转换中始终如一。智象未来的解法,是以基础模型与智能体系统双轮驱动,共同支撑复杂视频创作。 一方面,智象自研的原生全模态世界模型技术理念,为 R1 提供多模态理解与生成基础能力。它能将文本、图片、视频、参考资产、文档说明和历史创作结果纳入同一任务语境,让 Agent 理解“任务全貌”,而非单点指令。 另一方面,智

阅读原文(雷锋网)→

本站为资讯聚合平台,仅展示标题与摘要,原文版权归原发布方所有;如有侵权请联系我们删除。