智象未来HiDream世界模型登顶榜首

IT时代网8月17日消息,智象未来(HiDream.ai)近日正式推出最新力作 HiDream-O1-World。作为一款原生全模态世界模型,它集漫游、编辑、交互三大核心能力于一体,支持文本、图像、交互操控等多种输入,用户可一键生成时空连续、符合物理规律、支持长时推演的完整虚拟世界。

技术底座上,HiDream-O1-World 搭载智象自研的原生全模态架构 UiT,针对交互式世界模型的两大核心挑战——时空一致性与物理一致性取得关键突破。实际体验中,用户推拉摇移镜头时,场景几何结构始终保持稳定,物体不会无故消失或畸变;碰撞、遮挡、重力响应等行为也高度契合真实世界的因果逻辑,而非统计平均“猜”出的随机拼接。

发布前不久,HiDream-O1-World 已在第三方评测中交出亮眼成绩。由美团 LongCat 团队与复旦大学联合推出的交互式视频世界模型评测基准 WBench 公布最新榜单,涵盖 289 个多轮交互案例、共 1058 个交互轮次,基于五大维度 22 项指标构建量化框架。该模型在 Navi 分榜以平均分 80.9 登顶,物理维度 73.3 分、一致性维度 88.0 分均居前列,首次参评即刷新性能上限。

功能上,它支持文本、图像与交互式操控等多模态输入,用户用一段文字、一张图片或简单拖拽即可生成结构完整、质感细腻的交互世界;同时提供第一人称与第三人称两种漫游模式,并赋予实时编辑能力——驱动角色抓取、奔跑、下蹲、跳跃,或触发降雨、物体坠落等动态事件,且每次交互都基于几何、光照、材质到物理逻辑的全局统一响应。

注:本文中包含AI辅助创作的内容。

THE END