智象未来发布原生全模态视频模型
IT时代网9月16日消息,智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0。该模型采用自研原生全模态架构,支持文本、图片、视频等多种模态输入,可一键直出 5 至 20 秒 1080p 高保真视频,并在意图理解、物理规律理解、自主规划叙事、音画一体化生成等维度全面升级。
在两项国际权威评测中,该模型均位居世界前列。在全球独立 AI 基准测试与分析平台 Artificial Analysis 的图生视频榜单(含音频)上取得全球第四;在全球 AI 模型盲测评测平台 Arena.ai 的图生视频评测中取得第 8。在多模态这一核心战场,图生视频是技术密度最高、竞争最激烈的方向之一。
该模型前置多模态意图理解模块,对视频内容做结构化规划,保证充分理解用户自然语言输入的意图。另一重要突破是更懂物理:物体在重力作用下的落下、碰撞反馈、惯性延续、光影衰减、空间连续等物理规律既被理解,也被写进视频模型的叙事之中。模型还把时长决策交还给内容本身,根据事件展开逻辑、动作完成周期、叙事推进节奏自行规划生成时长。

注:本文中包含AI辅助创作的内容。
编辑:林一舟
THE END