大模型事实性错误常被简单归因为训练知识不足,但谷歌研究团队通过知识画像框架对Gemini 3、GPT-5等先进模型进行分析后发现,模型对事实知识的编码已接近饱和,真正的瓶颈出现在参数化回忆阶段。也就是说,模型并非...
Read More在大型语言模型驱动的智能体系统中,子代理(Subagent)递归调用已成为提升任务分解与执行能力的重要方式,但“多少层嵌套才算合理”正成为新的工程难题。相关观点指出,递归代理系统不应被简单视为层级堆叠,而应按照...
Read More据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...
Read More据英国《金融时报》报道,网络安全研究人员披露一起新型网络攻击事件:疑似来自中国的黑客组织利用开源AI智能体,成功搭建出一套能够完全自主执行侦察与入侵的自动化攻击工具。该工具在今年七月被用于入侵多个台湾政...
Read More随着大语言模型越来越多地参与代码生成,软件开发生命周期正面临前所未有的挑战:代码上线速度快了,但失控风险也随之增加。LaunchDarkly 推出的 CodeControl 平台正是为了解决这一矛盾,帮助团队对AI生成代码的执行...
Read More在开源大语言模型百花齐放的今天,一个模型究竟是真正从零开始预训练,还是基于现有开源权重衍生微调,常让外界难以分辨。Hugging Face社区发布的“Model Genome”项目,首次提出用类似生物基因指纹的方式为模型“验明...
Read More根据人工智能分析机构Artificial Analysis的最新排名,全球排名前十的文生视频模型中,中国AI实验室占据了其中九席,展现出在视频生成领域压倒性的技术集群优势。彭博社评论指出,过去一段时间,外界对中国人工智能...
Read MoreOpenAI近日宣布对ChatGPT进行重要更新,核心围绕GPT-5.6 Sol与GPT-5.6 Luna两大模型展开。此次升级显著提升了GPT-5.6 Sol的响应准确性和一致性,使其在事实核查、逻辑推理和专业内容生成等任务上表现更为可靠,背后...
Read More