OpenAI 最新披露,尽管其前沿模型 GPT-5.6 在数学领域解决了多个长期悬而未决的问题,并成功打通《宝可梦 火红》等复杂游戏,但在 ARC-AGI-3 基准测试中原始得分仅有 7.8%。这一巨大反差揭示了一个关键问题:基准测...
Read More英伟达NeMo团队近日在GitHub上开源了一个名为Molt的智能体强化学习框架。该框架采用PyTorch原生设计,核心理念是将智能体本身视为可执行的程序,而非传统强化学习中固定的策略网络。Molt支持高度灵活的自定义Python...
Read More总部位于伦敦的新一代云基础设施公司Fluidstack近日披露,其在今年1月已完成由Situational Awareness领投的8.3亿美元A轮融资,投后估值达到75亿美元。Fluidstack定位为“新云”(Neocloud)服务商,专注于为大规模人工...
Read More英国《金融时报》发文指出,围绕月之暗面(Moonshot AI)创始人杨植麟离开美国返回中国创业的争论,其实忽略了一个更大的结构性转变:中国已经建成了独立自循环的AI人才输送管道。杨植麟的选择并非孤立现象,越来越...
Read More研究人员首次在实验中观察到递归自我改进(RSI)现象。他们让一个“自我研究”智能体在自主研究程序上连续运行了八天,最终该系统在预留的基准测试上击败了团队花费两年时间手工调优的测试框架。这套完全自主的系统包...
Read More本文收录了Google DeepMind的AGI经济学主任Alex Imas与斯坦福大学数字经济实验室的经济学博士后Philip Trammell的一次深度访谈转录。两位专家从经济学独有的视角,探讨了人工智能尤其是通用人工智能(AGI)实现后,...
Read More阿里巴巴通义千问团队近日发布了其最新的多模态智能体模型Qwen3.7-Plus,标志着通用人工智能在感知与行动融合层面迈出了重要一步。该模型将视觉识别与语言理解能力深度融合,构建了一个单一、通用的多模态智能体基础...
Read More智谱AI团队发布的最新研究成果GLM-5V-Turbo,在人工智能领域迈出了关键一步。该模型的核心创新在于将多模态感知能力直接内嵌到模型的推理过程和工具使用中,而非作为独立的预处理步骤。这意味着模型能够同时处理并理...
Read More