近日,菲尔兹奖得主、知名数学家Timothy Gowers在其博客发文探讨大语言模型(LLM)在数学研究中真正擅长的任务类型。他指出,目前LLM参与解决的许多著名数学问题,几乎都是通过构造反例来完成的,而不是给出完整严格...
Read More据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...
Read MoreQwen团队在Hugging Face发布Qwen3.8-2.4T-A95B模型。该模型基于Qwen3.5架构演进而来,重点提升编码与长时程任务处理能力,并通过改进的智能体执行机制提高任务完成可靠性。它支持SGLang、vLLM等主流部署框架,可较顺...
Read More美国芯片巨头AMD已同意收购多伦多AI芯片创业公司Taalas。这家由前AMD员工及Tenstorrent核心成员创立的公司,专注于将AI模型“硬连线”进定制硅片,从而在前沿推理场景中大幅打破计算与内存瓶颈。与传统依赖通用GPU或庞...
Read More大型语言模型(LLMs)的普及正在重塑技术工作的完成方式。它们大幅降低了编程、内容生成等任务的入门门槛,让原本技能有限的用户也能产出看似不错的成果,将许多人瞬间转变为“通才”式的多面手。然而,一项最新分析指...
Read More大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...
Read More一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...
Read More谷歌DeepMind正式发布了新一代机器人AI系统Gemini Robotics ER 2,该系统在视频理解、工具编排和多机器人协作方面实现了阶跃式突破。ER 2将先进的Gemini大语言模型与机器人深层控制相结合,使机器人不仅能够更精准地...
Read More