漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

OpenAI GPT-6 Astra 在 ARC-AGI-3 登顶:标准测试 62.7%,适配器模式 99.9% 创 SOTA

OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 基准上取得了最新领先成绩。在标准测试条件下,该模型在半私有评估集上获得 62.7% 的得分,已达到当前最优水平;而在使用 provider adapter 适配器的测试框架中,成绩进一步提升...

Read More
2026-09-01 talkingdev

Runway发布首个界面世界模型Solaris:实时逐帧生成交互式界面,无需代码

Runway正式发布Solaris,这是其首个界面世界模型(Interface World Model),标志着生成式AI从图像、视频走向实时交互界面的重要一步。Solaris能够在用户操作过程中逐帧生成界面,并同步处理渲染与交互响应,不再依...

Read More
2026-08-26 talkingdev

开源|京东开源JoyAI-Echo:全模态世界模型EchoWM实现720p同步音视频生成

京东开源团队发布了 JoyAI-Echo 项目,推出全模态世界模型 EchoWM。该模型能够沿着连续的 6 自由度(6-DoF)相机轨迹运动,同时生成 720p 视频、环境声、音乐与语音,突破了传统世界模型以视觉为中心的局限。EchoWM...

Read More
2026-08-12 talkingdev

NVIDIA提出WorldTrace:让视频世界模型拥有可寻址记忆,突破长时序生成瓶颈

NVIDIA研究团队近日推出了一项名为WorldTrace的训练无关框架,直指视频世界模型在长时序自回归生成中的关键短板——记忆遗忘与生成质量退化。该工作通过为压缩的键值记忆赋予稳定、分布内位置偏移的方式,确保记忆在远...

Read More
2026-08-10 talkingdev

中国AI视频模型横扫全球榜单:前十独占九席,或将在构建世界模型上建立优势

根据人工智能分析机构Artificial Analysis的最新排名,全球排名前十的文生视频模型中,中国AI实验室占据了其中九席,展现出在视频生成领域压倒性的技术集群优势。彭博社评论指出,过去一段时间,外界对中国人工智能...

Read More
2026-07-21 talkingdev

英伟达发布Cosmos 3 Edge:40亿参数世界模型赋能边缘设备实时推理与机器人动作生成

英伟达在Hugging Face上正式推出Cosmos 3 Edge,这是一款拥有40亿参数的开源世界模型,专为边缘设备上的机器人与视觉AI体设计。该模型通过共享的世界表征,将环境理解、实时预测、模拟与动作生成统一在同一框架下,...

Read More
2026-06-02 talkingdev

视频智能体模型是下一波浪潮 — xAI Grok Imagine 负责人 Ethan He 深度解读

在生成式AI的激烈竞争中,视频生成与世界模型正成为下一个前沿战场。Ethan He,这位曾领导NVIDIA Cosmos世界模型项目的核心人物,在加入xAI后仅用三个月便主导构建了Grok Imagine图像生成系统。在一篇长达98分钟的深...

Read More
2026-05-28 talkingdev

Biohub发布蛋白质生物学世界模型:开源AI加速治疗分子设计

Biohub近日向全球研究人员开放了其蛋白质结构预测、设计与生物发现的开源引擎,标志着蛋白质生物学领域迈入AI驱动的新阶段。该发布包含三个核心模型:ESMC,一种最先进的语言模型,内化了支配蛋白质生物学的基本属性...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page