Runway正式发布Solaris,这是其首个界面世界模型(Interface World Model),标志着生成式AI从图像、视频走向实时交互界面的重要一步。Solaris能够在用户操作过程中逐帧生成界面,并同步处理渲染与交互响应,不再依...
Read More京东开源团队发布了 JoyAI-Echo 项目,推出全模态世界模型 EchoWM。该模型能够沿着连续的 6 自由度(6-DoF)相机轨迹运动,同时生成 720p 视频、环境声、音乐与语音,突破了传统世界模型以视觉为中心的局限。EchoWM...
Read More据路透社报道,中国最具知名度的人形机器人企业宇树科技(Unitree)在8月19日上海上市首日股价大涨超过5倍后,随后遭遇约45%的显著回撤,公司估值从约660亿美元降至360亿美元。这一剧烈波动引发市场对机器人板块是否...
Read More据《每日电讯报》报道,在北京举行的世界人形机器人运动会上,中国人形机器人展现出超越人类顶尖运动员的运动能力。荣耀(Honor)制造的一款机器人以9.39秒完成100米,超过了博尔特9.58秒的人类百米世界纪录;另一款...
Read MoreNVIDIA研究团队近日推出了一项名为WorldTrace的训练无关框架,直指视频世界模型在长时序自回归生成中的关键短板——记忆遗忘与生成质量退化。该工作通过为压缩的键值记忆赋予稳定、分布内位置偏移的方式,确保记忆在远...
Read More谷歌DeepMind正式发布了新一代机器人AI系统Gemini Robotics ER 2,该系统在视频理解、工具编排和多机器人协作方面实现了阶跃式突破。ER 2将先进的Gemini大语言模型与机器人深层控制相结合,使机器人不仅能够更精准地...
Read More英伟达NeMo团队近日在GitHub上开源了一个名为Molt的智能体强化学习框架。该框架采用PyTorch原生设计,核心理念是将智能体本身视为可执行的程序,而非传统强化学习中固定的策略网络。Molt支持高度灵活的自定义Python...
Read More英伟达在Hugging Face上正式推出Cosmos 3 Edge,这是一款拥有40亿参数的开源世界模型,专为边缘设备上的机器人与视觉AI体设计。该模型通过共享的世界表征,将环境理解、实时预测、模拟与动作生成统一在同一框架下,...
Read More