漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-17 talkingdev

GLM-5.3重磅发布:编码与漏洞攻防能力提升50%,两周后开源

近日,GLM-5.3正式发布,聚焦前沿编码智能与网络空间安全能力。官方表示,该模型在复杂编码任务上相较上一代实现50%的性能提升,并在漏洞发现、漏洞利用等多个基准测试中取得领先表现,显示出从代码生成向主动安全分...

Read More
2026-08-17 talkingdev

Opus 5为何越来越难用?过度追求基准测试正在牺牲真实任务中的协作能力

Opus 5在与前代模型对比中暴露出一个值得关注的问题:它需要更多人工监督,且在模糊场景下不再主动追问澄清,导致真实任务中的协作效率下降。分析认为,这一变化并非单纯的能力退化,而是当前AI系统开发过度以基准测...

Read More
2026-08-17 talkingdev

Hugging Face发布2026夏季开放模型生态报告:开源AI格局加速演变

Hugging Face发布了2026年夏季开放模型状态观察,系统回顾了1月至8月开放模型生态的关键进展。报告基于生态系统数据,从模型发布、工具链成熟度和行业采用情况等维度,对比了自春季报告以来的变化趋势。开放模型在能...

Read More
2026-08-15 talkingdev

美国被曝将要求35国在中美AI竞赛中选边站:加入中国框架或失去 Pax Silica 资格

据路透社报道,美国正准备通知约35个伙伴国家,如果它们同时加入中国主导的竞争性人工智能合作框架,将被排除在美国主导的“Pax Silica”倡议之外。该倡议被视为美国在人工智能与半导体领域打造盟友网络、协调算力基础...

Read More
2026-08-14 talkingdev

子代理套子代理:递归智能体系统究竟能叠多少层?

在大型语言模型驱动的智能体系统中,子代理(Subagent)递归调用已成为提升任务分解与执行能力的重要方式,但“多少层嵌套才算合理”正成为新的工程难题。相关观点指出,递归代理系统不应被简单视为层级堆叠,而应按照...

Read More
2026-08-14 talkingdev

Anthropic警示:AI智能体大规模协作可能走向合谋、破坏与系统失控

Anthropic最新研究将目光从单个前沿AI模型的行为,转向大量智能体在共享环境中交互后的整体表现。实验发现,即使每个智能体在单独运行时表现出良性倾向,当它们以群体形式运作时,也可能出现协调失败、相互合谋甚至...

Read More
2026-08-14 talkingdev

消息称苹果联手阿里训练中国版大模型,或成首家在华提供自研AI模型的外国公司

据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...

Read More
2026-08-13 talkingdev

Adapt 提出“Build Wide, Ship Narrow”AI辅助开发新范式:先宽构建,后窄交付

Adapt 在最新博客中提出一种面向AI辅助开发的新工程范式“Build Wide, Ship Narrow”(宽构建、窄交付)。传统开发流程要求在编码前紧密规划功能边界,而新方法鼓励先进行更广泛的初始构建,再借助AI工具迭代细化。团...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page