漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-01 talkingdev

Runway发布首个界面世界模型Solaris:实时逐帧生成交互式界面,无需代码

Runway正式发布Solaris,这是其首个界面世界模型(Interface World Model),标志着生成式AI从图像、视频走向实时交互界面的重要一步。Solaris能够在用户操作过程中逐帧生成界面,并同步处理渲染与交互响应,不再依...

Read More
2026-08-26 talkingdev

开源|京东开源JoyAI-Echo:全模态世界模型EchoWM实现720p同步音视频生成

京东开源团队发布了 JoyAI-Echo 项目,推出全模态世界模型 EchoWM。该模型能够沿着连续的 6 自由度(6-DoF)相机轨迹运动,同时生成 720p 视频、环境声、音乐与语音,突破了传统世界模型以视觉为中心的局限。EchoWM...

Read More
2026-08-25 talkingdev

宇树科技上市首日飙涨逾5倍后暴跌45%,估值从660亿美元缩水至360亿美元,人形机器人泡沫担忧升温

据路透社报道,中国最具知名度的人形机器人企业宇树科技(Unitree)在8月19日上海上市首日股价大涨超过5倍后,随后遭遇约45%的显著回撤,公司估值从约660亿美元降至360亿美元。这一剧烈波动引发市场对机器人板块是否...

Read More
2026-08-24 talkingdev

北京世界人形机器人运动会:荣耀机器人百米9.39秒、天工Ultra 400米38.16秒双双打破人类纪录

据《每日电讯报》报道,在北京举行的世界人形机器人运动会上,中国人形机器人展现出超越人类顶尖运动员的运动能力。荣耀(Honor)制造的一款机器人以9.39秒完成100米,超过了博尔特9.58秒的人类百米世界纪录;另一款...

Read More
2026-08-12 talkingdev

NVIDIA提出WorldTrace:让视频世界模型拥有可寻址记忆,突破长时序生成瓶颈

NVIDIA研究团队近日推出了一项名为WorldTrace的训练无关框架,直指视频世界模型在长时序自回归生成中的关键短板——记忆遗忘与生成质量退化。该工作通过为压缩的键值记忆赋予稳定、分布内位置偏移的方式,确保记忆在远...

Read More
2026-07-31 talkingdev

谷歌DeepMind推出Gemini Robotics ER 2,重新定义机器人视频理解与多机协作

谷歌DeepMind正式发布了新一代机器人AI系统Gemini Robotics ER 2,该系统在视频理解、工具编排和多机器人协作方面实现了阶跃式突破。ER 2将先进的Gemini大语言模型与机器人深层控制相结合,使机器人不仅能够更精准地...

Read More
2026-07-28 talkingdev

开源|Molt:英伟达发布原生PyTorch智能体强化学习框架,可扩展至万亿参数MoE模型训练

英伟达NeMo团队近日在GitHub上开源了一个名为Molt的智能体强化学习框架。该框架采用PyTorch原生设计,核心理念是将智能体本身视为可执行的程序,而非传统强化学习中固定的策略网络。Molt支持高度灵活的自定义Python...

Read More
2026-07-21 talkingdev

英伟达发布Cosmos 3 Edge:40亿参数世界模型赋能边缘设备实时推理与机器人动作生成

英伟达在Hugging Face上正式推出Cosmos 3 Edge,这是一款拥有40亿参数的开源世界模型,专为边缘设备上的机器人与视觉AI体设计。该模型通过共享的世界表征,将环境理解、实时预测、模拟与动作生成统一在同一框架下,...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page