在近日举办的服贸会专题活动“2026中国AIGC创新应用交流会”上,智象未来(HiDream.ai)联合创始人兼COO王科针对AIGC行业快速发展时谈到,国内多模态AIGC行业正告别单纯比拼画质、时长的阶段,技术竞争转向全链路系统能力,AI视频正在从生成素材向完整作品交付演进。
当前全球大模型技术分化为两大路径。一条是大语言模型,依靠上下文实现逻辑思考。另一条是多模态、全模态路线,逐步向世界模型演进,被视作通向通用人工智能的重要方向。王科介绍,智象未来选择从多模态走向原生全模态,再迈向世界模型的技术路线。团队打造原生全模态UiT底层架构,打通图像、视频、3D、动作等不同信号,实现不同模态之间端到端对齐,支持任意形式输入输出。基于这套底座,企业搭建HiDream‑O1原生全模态世界模型矩阵,覆盖图像、视频、交互式世界模型、具身世界模型,完成从理解、推演到执行的技术闭环。多项第三方评测数据显示,其图像、交互式世界模型、具身世界模型,分别在对应国际权威榜单拿到靠前位次。其最新发布的视频模型HiDream-O1-Video-1.0(简称HiDream V1),在全球领先的独立 AI 基准测试与分析平台Artificial Analysis Image to Video Leaderboard(With Audio)排行榜上,取得全球排名第四的佳绩。在全球最具影响力的AI 模型盲测评测平台 Arena.ai Image-to-Video 中,HiDream V1也取得了第8的优异成绩。“大模型负责回答世界是什么,世界模型要进一步回答世界会如何变化,行动之后会产生什么结果。”王科解释,世界模型的核心是感知现实状态,推演物理与因果规律,预测事物发展。基础模型提供认知能力,智能体承担决策执行,依靠闭环反馈实现持续迭代,两者结合,才能推动AI从理解世界走向改造现实。技术之外,商业化落地是行业绕不开的命题。智象未来采用“1+1+3”商业体系布局。底层是原生全模态世界模型底座;中间搭建企业级模型服务中台,输出API、SDK等可调用能力;上层落地三大场景产品,分别面向影视创作、商业营销、全球创作者。影视赛道,专业级AI影视创作智能体“帧赞”服务一千多家(截止到今年6月)专业团队。这套平台覆盖创意、分镜、成片、制片管理全流程,支持资产沉淀与IP运营。已有团队依托该工具,30天完成60集AI短剧制作,相关作品登陆主流视频平台播出。商业营销领域,HiBurst营销智能体切入跨境电商、媒体运营,实现脚本、剪辑、平台发布一体化。王科判断,电商广告属于付费确定性较强的赛道,商家可以核算投入产出,付费意愿稳定。短剧市场正在经历优胜劣汰,只有具备精品生产、IP沉淀能力的团队,才能形成长期商业模式。本次交流会现场,智象未来正式对外宣布,无限时长内容创作智能体vivago R1全球上线,国内版本“够搭”同步升级发布。产品可以依靠自然语言对话完成创作,一次性稳定生成5分钟高质量视频。行业把这种可稳定输出专业品质内容的模式,称作“单反级交付”。区别于传统AI视频工具,智能体不等同简单生成工具。传统工具依靠用户输入提示词,产出单一片段,分镜、拼接、后期全部依赖人工。而vivago R1采用对话优先模式,依靠多智能体协同,主智能体拆解用户创意,子智能体分别完成脚本、分镜、角色、音效等工作,全部任务共享统一上下文语境,保障多镜头之下角色、风格、叙事连贯。依托HD‑AgentOS调度系统,内容商业可用成功率提升至85%以上,降低反复生成试错的成本。王科表示,产品把复杂的技术流程收纳在后台,用户只需要描述创作意图即可。针对行业竞争,王科坦言,视觉多模态赛道已经出现标准化产品价格战。企业不能单纯比拼价格,要走价值竞争路线。创业企业相比大厂,核心优势在于认知迭代快、落地速度快、组织决策灵活。不需要做全面竞争,要抓住关键技术节点形成差异化。他同时提出CHATS™评估标准,从内容一致性、用户意图理解、视听完整度、叙事能力、交付稳定性五个维度,衡量视频智能体的综合水平。谈及对影视、广告、短视频行业带来的改变,王科认为,AI降低的是执行层面门槛,剧本、审美、情绪把控等创作判断依旧依靠人。广告行业会走向千人千面的批量定制,短视频内容供给会进一步扩大,行业竞争会向精品、垂直方向转移。产业生态方面,智象未来已经和多家云厂商、海内外互联网平台、影视机构、机器人企业建立合作,覆盖算力、营销场景、影视文旅、具身智能数据集建设等环节。王科表示,AIGC技术落地离不开产业链协同,希望联合更多大中小企业,推动全模态技术赋能千行百业。