大型语言模型(LLMs)的普及正在重塑技术工作的完成方式。它们大幅降低了编程、内容生成等任务的入门门槛,让原本技能有限的用户也能产出看似不错的成果,将许多人瞬间转变为“通才”式的多面手。然而,一项最新分析指...
Read More大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...
Read MoreOpenAI日前披露的未公开模型Astra一口气解决了数学界十个长期悬而未决的开放问题,再次刷新了人们对AI在高级推理领域潜力的认知。长期以来,数学一直是大型语言模型的软肋,人们习惯嘲笑AI连基础运算都频繁出错。然...
Read More在大语言模型竞争日益激烈的当下,如何科学、标准化地衡量不同规模模型的能力上限正成为一个核心议题。Prime Radiant公司近日开源的smevals评估框架正是瞄准了这一痛点,它提供了一套轻量且专为小模型和大模型运行基...
Read More通义千问团队正式发布了其新一代旗舰模型Qwen3.8-Max,该模型以惊人的2.4万亿参数量,在编码、办公协同、深度研究及长周期任务处理等多个维度实现了代际跨越。不同于仅能提供简单问答的常规模型,Qwen3.8-Max展现出...
Read More据《金融时报》报道,苹果公司近日针对其安全漏洞悬赏计划(Apple Security Bounty)引入了一项重大调整:对bug报告的提交数量设置上限,并强制执行30天的提交冷却期。这一前所未有的举措直接指向由生成式人工智能引...
Read More上周刚获得数学界最高荣誉菲尔兹奖的加拿大数学家Jacob Tsimerman,已从多伦多大学申请长期休假,转而加入OpenAI,专注于人工智能安全研究。这一动向不仅展现了基础科学前沿与AI产业的深度交融,也再次印证了AI安全...
Read More企业网络安全厂商 ThreatLocker 宣布完成由 Elephant 领投的 1.9 亿美元 F 轮融资,投后估值与增长计划备受行业关注。该公司以零信任安全架构闻名,通过在端点实施默认拒绝策略和应用程序环状隔离,帮助企业严控可执...
Read More