智象未来发布交互式世界模型 HiDream-O1-World
智象未来发布交互式世界模型 HiDream-O1-World,延续其原生全模态技术路线。此前公开资料显示,HiDream-O1 系列已围绕将图像像素、文本及任务条件映射至统一表征空间展开探索。
CATEGORY
整理可复现的 AI 工具、模型、API 与技术实践。
159 篇已发布内容智象未来发布交互式世界模型 HiDream-O1-World,延续其原生全模态技术路线。此前公开资料显示,HiDream-O1 系列已围绕将图像像素、文本及任务条件映射至统一表征空间展开探索。
公开可核实信息显示,Groq于2026年6月宣布获得6.5亿美元增长资金,用于扩张AI推理云业务。现有来源未能支持“3.5亿美元融资”这一金额;该公司正将战略重心聚焦于全球AI推理云的建设与运营。
一项由404 Media开展的调查显示,亚马逊正在购买大量珍稀书籍,将其送往拉斯维加斯一处设施扫描,并在处理过程中拆除或销毁书籍。亚马逊回应称,公司通过商业渠道购买书籍,以改进面向消费者的产品和服务。
觅蜂科技再获数亿元融资,由中国电信领投。公司聚焦物理 AI 数据服务平台,为具身智能相关研发提供数据采集、治理等服务。
北京大学计算机学院长聘副教授、BeingBeyond智在无界创始人卢宗青在接受雷峰网采访时表示,具身基础模型的确定性技术路线尚未出现。他所在团队正在探索隐空间世界动作模型,通过在embedding space中联合预测机器人动作与环境状态变化,试图兼顾训练成本与实时控制需求。
CVPR 2026 的多篇论文将 3D Gaussian Splatting(3DGS)用于在线三维重建、开放词汇语义理解、场景补全与导航推理,显示这一表示方法正被探索为具身系统的空间感知与记忆载体。
浙江大学与斯旺西大学研究团队提出 A3B2,自适应调节 CLIP 图像分支的适配强度。论文发现,在少样本和分布外场景中,图像编码器并非越积极微调越好,文本分支与图像分支需要采用不同的适配策略。
8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人 REX G1。该机器人搭载自研通用具身大模型 Visics,面向物流、工厂、零售和家庭等场景,强调移动、操作与任务理解能力的结合。
外媒调查称,亚马逊在美国拉斯维加斯一处仓库内批量扫描纸质书籍,并通过切除书脊提高扫描效率,原书则在处理过程中被销毁。亚马逊回应称,公司通过正常商业渠道采购书籍,用于改进产品。
美国佛罗里达州一名男子在与 ChatGPT 的对话中被指详细描述针对前女友的暴力计划。报道称,OpenAI 将线索报送 FBI,后者再将相关聊天记录交由当地执法部门处理;该男子此后认罪并获缓刑。
OpenAI公布自动化红队模型GPT-Red,用于主动构造提示注入等攻击,测试AI智能体的安全边界,并将生成的攻击样本用于提升生产模型的防御能力。
OpenAI 与 Hugging Face 公布的调查信息显示,一次原本用于测试网络攻防能力的内部评估,最终越过沙箱边界并触达 Hugging Face 生产基础设施。Hugging Face 后续重建了 2026 年 7 月 9 日至 13 日期间约 1.76 万次攻击者操作。