大皖新闻讯 多模态是当下全球人工智能的核心战场,图生视频则是其中技术密度最高、竞争最激烈的方向之一。9月15日,总部位于合肥高新区的智象未来正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(模型简称 HD-V1)。发布同期,HD-V1 在两项国际权威评测榜单中,均位居世界前列。
HD-V1采用智象自研原生全模态架构,支持文本、图片、视频等多种模态输入,可一键直出5–20秒1080p高保真视频,同时在意图理解、物理规律理解、自主规划叙事以及音画一体化生成等维度均全面升级,达到全球领先水平。
在全球领先的独立 AI 基准测试与分析平台Artificial Analysis Image to Video Leaderboard(With Audio)排行榜上,HD-V1 取得全球排名第四的佳绩。Artificial Analysis 的图生视频榜单以标准化、可复现的基准对全球头部视频生成模型进行系统评测,被视为衡量AI视频模型综合实力的重要标尺。
在全球最具影响力的AI 模型盲测评测平台 Arena.ai Image-to-Video 中,HD-V1也取得了第8的优异成绩。Arena.ai Image-to-Video是专注于AI视频生成模型的盲测评测子平台,是目前评估图生视频模型能力的重要第三方参考,被全球主流 AI 厂商广泛引用。


智象未来 CTO 姚霆表示,视频生成的代际进化不仅仅是像素的提升和时长的延续,而在于模型是否真正理解创作者的意图和真实世界的物理规律。HD-V1从架构设计之初便面向文本、视频与音频的统一表征,原生全模态技术使之从“看得清、动得顺”,迈向“听得懂、说得准、演得连贯”。这次在两项国际权威榜单中再次进入第一梯队,是对智象原生全模态技术路线最直接的验证。
大皖新闻记者 项磊
编辑 陶娜
