漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-16 talkingdev

菲尔兹奖得主Timothy Gowers:LLM解决著名数学问题几乎全靠反例而非证明

近日,菲尔兹奖得主、知名数学家Timothy Gowers在其博客发文探讨大语言模型(LLM)在数学研究中真正擅长的任务类型。他指出,目前LLM参与解决的许多著名数学问题,几乎都是通过构造反例来完成的,而不是给出完整严格...

Read More
2026-08-14 talkingdev

消息称苹果联手阿里训练中国版大模型,或成首家在华提供自研AI模型的外国公司

据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...

Read More
2026-08-13 talkingdev

Qwen3.8-2.4T-A95B发布:强化编码与长程智能体能力,推理深度可调

Qwen团队在Hugging Face发布Qwen3.8-2.4T-A95B模型。该模型基于Qwen3.5架构演进而来,重点提升编码与长时程任务处理能力,并通过改进的智能体执行机制提高任务完成可靠性。它支持SGLang、vLLM等主流部署框架,可较顺...

Read More
2026-08-07 talkingdev

AMD宣布收购AI芯片初创公司Taalas,定制化硅片将AI模型直接“烧录”进硬件

美国芯片巨头AMD已同意收购多伦多AI芯片创业公司Taalas。这家由前AMD员工及Tenstorrent核心成员创立的公司,专注于将AI模型“硬连线”进定制硅片,从而在前沿推理场景中大幅打破计算与内存瓶颈。与传统依赖通用GPU或庞...

Read More
2026-08-04 talkingdev

LLMs奖励专业知识:领域专家比“万金油”更能释放大模型潜能

大型语言模型(LLMs)的普及正在重塑技术工作的完成方式。它们大幅降低了编程、内容生成等任务的入门门槛,让原本技能有限的用户也能产出看似不错的成果,将许多人瞬间转变为“通才”式的多面手。然而,一项最新分析指...

Read More
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-07-31 talkingdev

开源权重LLM在生命科学监管任务中准确率比肩闭源模型,成本仅三分之一

一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...

Read More
2026-07-31 talkingdev

谷歌DeepMind推出Gemini Robotics ER 2,重新定义机器人视频理解与多机协作

谷歌DeepMind正式发布了新一代机器人AI系统Gemini Robotics ER 2,该系统在视频理解、工具编排和多机器人协作方面实现了阶跃式突破。ER 2将先进的Gemini大语言模型与机器人深层控制相结合,使机器人不仅能够更精准地...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page