OpenAI 近日正式推出全新的 GPT-5.6 模型家族,旗舰版本代号“Sol”,在智能水平、运行效率与成本控制上实现三重跃升。该系列模型在数学推理、代码生成、长文本理解等多个权威基准测试中,不仅全面超越前代 GPT-5,也...
Read More谷歌DeepMind团队推出新系统AlphaProof Nexus,在未依赖公开发表或训练集中可见的标准解法的情况下,自主解决了353个公开埃尔德什(Erdős)问题中的9道,其中有两道难题甚至困扰了数学界56年之久。值得一提的是,每...
Read MoreOpenAI的一个推理模型成功推翻了离散几何学中的核心猜想——“平面单位距离问题”(Planar Unit Distance Problem)。该猜想最早由20世纪著名数学家保罗·埃尔德什于1946年提出,在长达80年的时间里一直未被攻克,是离散...
Read More人工智能研究机构Epoch近日发布报告,确认其最新模型GPT-5.4 Pro成功解决了一个长期悬而未决的前沿数学开放问题——超图上的拉姆齐风格问题。该问题属于组合数学的核心领域,要求构造尽可能大的超图,使其不具备某个易...
Read MoreOpenAI近日详细公布了其AI模型在全部十道“First Proof”数学研究问题上的端到端证明尝试。First Proof是一项特定领域挑战,旨在测试AI系统能否生成完全可验证的数学论证。OpenAI的博客文章概述了该领域专家对模型提交...
Read More近日,一个名为TTT-Discover的开源项目在GitHub上发布,其核心创新在于将强化学习(Reinforcement Learning)技术应用于大型语言模型(LLMs)的推理(Inference)阶段,而非传统的训练阶段。这一“测试时训练”(Test-...
Read More近日,数学界迎来一项里程碑式进展:著名数学家陶哲轩在其社交账户上宣布,埃尔德什问题#728在人工智能工具的辅助下首次被基本自主地解决。这一突破性成果并非简单复现已有文献,而是在埃尔德什问题网站社区重构问题...
Read More人工智能公司Prime Intellect正式推出INTELLECT-3模型,这是一个基于强化学习训练、具备1060亿参数的混合专家开源模型。该模型采用创新的MoE架构,通过动态激活专家网络显著提升计算效率,在数学推理、代码生成、科...
Read More