智象未来发布交互式世界模型HiDream-O1-World。这是该公司在原生全模态路线上的又一次推进,也将其 HiDream-O1 产品序列从图像生成进一步延伸至世界模型方向。

公开技术资料显示,智象未来此前发布的 HiDream-O1-Image 采用像素级统一 Transformer 架构,将原始图像像素、文本标记和任务条件映射到同一共享 Token 空间中处理,尝试以端到端方式统一视觉生成与编辑等任务。相关论文将这一设计概括为原生统一的多模态生成架构。
从已披露信息看,HiDream-O1-World 被定位为交互式世界模型。世界模型的核心目标通常不只是生成单帧或单段内容,还涉及对场景状态、时空变化与交互过程的建模。智象未来此前亦曾公开表示,将从多模态生成继续走向全模态世界模型,并关注 3D 交互、具身智能等方向。
目前,关于 HiDream-O1-World 的模型规模、技术报告、开放方式及具体评测结果,公开可检索资料仍较有限。后续其是否披露更完整的架构细节、交互能力边界及实际应用进展,将成为观察该产品的重要依据。