漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-01 talkingdev

Runway发布首个界面世界模型Solaris:实时逐帧生成交互式界面,无需代码

Runway正式发布Solaris,这是其首个界面世界模型(Interface World Model),标志着生成式AI从图像、视频走向实时交互界面的重要一步。Solaris能够在用户操作过程中逐帧生成界面,并同步处理渲染与交互响应,不再依...

Read More
2026-08-28 talkingdev

fal 推出 H3 Max:MiniMax H3 后训练版最快 3 秒生成 5 秒视频,综合质量登顶

fal Research 宣布推出 H3 Max,这是 MiniMax H3 的后训练版本,由 fal 推理团队专门针对生成速度进行优化。官方表示,该模型可在不到 3 秒内生成一段 5 秒长的视频,显著降低视频生成等待时间。在人类偏好评估中,H...

Read More
2026-08-17 talkingdev

Anthropic文本水印被指改变词概率嵌入指纹,或损害Claude写作质量

近日,约翰·格鲁伯(John Gruber)在 Daring Fireball 撰文指出,Anthropic 宣布将在全球所有 Claude 模型中默认加入文本水印,其技术路径是通过调整词元(token)的概率分布,在不显著改变语义的情况下嵌入可检测指...

Read More
2026-08-13 talkingdev

Grok 4.6 发布:强化长时智能体与自校验能力,编码知识基准再提升

xAI 推出的 Grok 4.6 在 Grok 4.5 基础上进一步聚焦长时间运行智能体以及更具挑战性的交互式与视觉任务。官方介绍,该版本在多项编码和知识型工作基准上显示出性能提升,并着重强化安全性与可用性,能够将产品构想转...

Read More
2026-08-10 talkingdev

中国AI视频模型横扫全球榜单:前十独占九席,或将在构建世界模型上建立优势

根据人工智能分析机构Artificial Analysis的最新排名,全球排名前十的文生视频模型中,中国AI实验室占据了其中九席,展现出在视频生成领域压倒性的技术集群优势。彭博社评论指出,过去一段时间,外界对中国人工智能...

Read More
2026-08-07 talkingdev

字节跳动被曝预训练10万亿参数超大模型,规模达Kimi K3的三倍,刷新行业纪录

据《金融时报》援引知情人士消息,TikTok母公司字节跳动正在预训练一个参数量高达10万亿的超大规模人工智能模型。这一数字大约是月之暗面Kimi K3模型参数量的三倍,也超过了Anthropic传闻中Mythos 5约8万亿参数的预...

Read More
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-07-30 talkingdev

NVIDIA提出并行解码蒸馏技术:仅用4步评估实现视频生成新标杆

NVIDIA研究团队最新发布了并行解码蒸馏(Parallel Decoding Distillation)技术,该方法通过在一次模型评估中同时预测多个去噪步骤,显著减少了扩散模型在图像和视频生成时所需的迭代次数。不同于传统需要数十甚至上...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page