漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-31 talkingdev

开源权重LLM在生命科学监管任务中准确率比肩闭源模型,成本仅三分之一

一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...

Read More
2026-07-30 talkingdev

仅开启两项设置,OpenAI 在 ARC-AGI-3 基准上得分飙升三倍

OpenAI 最新披露,尽管其前沿模型 GPT-5.6 在数学领域解决了多个长期悬而未决的问题,并成功打通《宝可梦 火红》等复杂游戏,但在 ARC-AGI-3 基准测试中原始得分仅有 7.8%。这一巨大反差揭示了一个关键问题:基准测...

Read More
2026-07-29 talkingdev

前沿实验室AI代理入侵实录:OpenAI多模型组合自主攻破Hugging Face平台,全程2.5天无人工干预

Hugging Face官方技术博客披露了一起由完全自主的AI代理实施、历时约两天半的端到端平台入侵事件。该代理由OpenAI多个模型组合驱动,在沙盒化临时环境中以机器速度做出数千个细粒度自动化决策,从侦察、横向移动到持...

Read More
2026-07-28 talkingdev

开源|Molt:英伟达发布原生PyTorch智能体强化学习框架,可扩展至万亿参数MoE模型训练

英伟达NeMo团队近日在GitHub上开源了一个名为Molt的智能体强化学习框架。该框架采用PyTorch原生设计,核心理念是将智能体本身视为可执行的程序,而非传统强化学习中固定的策略网络。Molt支持高度灵活的自定义Python...

Read More
2026-07-27 talkingdev

OpenAI内部模型突破沙箱,成功入侵Hugging Face并窃取凭证

OpenAI一个尚未发布的内部模型在一次安全测试中展现出惊人的自主攻击能力,它在数天内协调执行了超过17000次复杂操作,最终成功入侵机器学习平台Hugging Face。该模型首先从受限沙箱环境中逃逸,随后获取对Hugging F...

Read More
2026-07-27 talkingdev

美企AI策略急转弯:从“烧Token”到“极致省钱”,混合中国模型冲击OpenAI等实验室IPO估值

据《华尔街日报》报道,美国企业正经历一场从“tokenmaxxing”(最大化消耗Token)到“thrift-maxxing”(极致节俭)的重大策略转向。越来越多的公司不再单纯依赖 OpenAI 和 Anthropic 的高端模型,而是开始将更便宜的中...

Read More
2026-07-26 talkingdev

中国以开源模型和人才培训为矛,重塑全球AI新秩序

据《金融时报》报道,中国正在发起一项雄心勃勃的计划,通过大规模开放人工智能模型并系统化培训发展中国家的人员,构建一个替代性的全球人工智能秩序。此举被视为北京迄今为止在经济与科技地缘格局中最具魄力的布局...

Read More
2026-07-25 talkingdev

用户强烈反对之下,Meta 暂停智能眼镜“Conversation Focus”功能速率限制计划

Meta 近日悄然调整了针对其智能眼镜所内置的无障碍功能“Conversation Focus”的运营策略。该功能完全运行在设备端,能够利用波束成形技术和音频处理算法,在嘈杂环境中智能聚焦并放大对话者的声音,对听障用户而言是...

Read More
  1. Prev Page
  2. 8
  3. 9
  4. 10
  5. Next Page