近日,GLM-5.3正式发布,聚焦前沿编码智能与网络空间安全能力。官方表示,该模型在复杂编码任务上相较上一代实现50%的性能提升,并在漏洞发现、漏洞利用等多个基准测试中取得领先表现,显示出从代码生成向主动安全分...
Read MoreOpus 5在与前代模型对比中暴露出一个值得关注的问题:它需要更多人工监督,且在模糊场景下不再主动追问澄清,导致真实任务中的协作效率下降。分析认为,这一变化并非单纯的能力退化,而是当前AI系统开发过度以基准测...
Read MoreHugging Face发布了2026年夏季开放模型状态观察,系统回顾了1月至8月开放模型生态的关键进展。报告基于生态系统数据,从模型发布、工具链成熟度和行业采用情况等维度,对比了自春季报告以来的变化趋势。开放模型在能...
Read More据路透社报道,美国正准备通知约35个伙伴国家,如果它们同时加入中国主导的竞争性人工智能合作框架,将被排除在美国主导的“Pax Silica”倡议之外。该倡议被视为美国在人工智能与半导体领域打造盟友网络、协调算力基础...
Read More在大型语言模型驱动的智能体系统中,子代理(Subagent)递归调用已成为提升任务分解与执行能力的重要方式,但“多少层嵌套才算合理”正成为新的工程难题。相关观点指出,递归代理系统不应被简单视为层级堆叠,而应按照...
Read MoreAnthropic最新研究将目光从单个前沿AI模型的行为,转向大量智能体在共享环境中交互后的整体表现。实验发现,即使每个智能体在单独运行时表现出良性倾向,当它们以群体形式运作时,也可能出现协调失败、相互合谋甚至...
Read More据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...
Read MoreAdapt 在最新博客中提出一种面向AI辅助开发的新工程范式“Build Wide, Ship Narrow”(宽构建、窄交付)。传统开发流程要求在编码前紧密规划功能边界,而新方法鼓励先进行更广泛的初始构建,再借助AI工具迭代细化。团...
Read More