智象未来发布交互式世界模型 HiDream-O1-World

智象未来发布交互式世界模型 HiDream-O1-World,延续其原生全模态技术路线。此前公开资料显示,HiDream-O1 系列已围绕将图像像素、文本及任务条件映射至统一表征空间展开探索。

智象未来发布交互式世界模型HiDream-O1-World。这是该公司在原生全模态路线上的又一次推进,也将其 HiDream-O1 产品序列从图像生成进一步延伸至世界模型方向。

智象未来发布交互式世界模型 HiDream-O1-World主题相关图片
来自网络

公开技术资料显示,智象未来此前发布的 HiDream-O1-Image 采用像素级统一 Transformer 架构,将原始图像像素、文本标记和任务条件映射到同一共享 Token 空间中处理,尝试以端到端方式统一视觉生成与编辑等任务。相关论文将这一设计概括为原生统一的多模态生成架构。

从已披露信息看,HiDream-O1-World 被定位为交互式世界模型。世界模型的核心目标通常不只是生成单帧或单段内容,还涉及对场景状态、时空变化与交互过程的建模。智象未来此前亦曾公开表示,将从多模态生成继续走向全模态世界模型,并关注 3D 交互、具身智能等方向。

目前,关于 HiDream-O1-World 的模型规模、技术报告、开放方式及具体评测结果,公开可检索资料仍较有限。后续其是否披露更完整的架构细节、交互能力边界及实际应用进展,将成为观察该产品的重要依据。