漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

Funes 为编程智能体装上持久记忆:跨机器、跨代理无缝续接开发上下文

Funes 项目为编程智能体引入了一个可持久化的记忆层,旨在解决当前 AI 编程代理在会话切换后上下文丢失、记忆无法跨工具复用的问题。该方案利用本地索引与嵌入技术,在不依赖外部服务的情况下实现上下文记忆的存储与...

Read More
2026-09-04 talkingdev

Vals分析:开源模型执行多阶段任务的环境影响可达简单查询1万倍

AI基准测试机构Vals AI的最新分析显示,开源权重模型在执行多阶段任务时,其环境代价可能远超简单查询。以构建一个Web应用为例,这类复杂任务涉及多轮推理、代码生成、工具调用与验证等步骤,模型需要消耗的能源或水...

Read More
2026-09-03 talkingdev

WorkOS 提出 AI Agent 委托访问新思路:别给智能体访问令牌,给它一个任务

在 AI 智能体越来越多地代表用户调用第三方 API 的背景下,OAuth 访问令牌通常由智能体直接持有,一旦智能体会话被劫持,令牌就可能随之泄露并被滥用。WorkOS 公布了一种委托访问方案 Relay,其核心是让凭证始终保存...

Read More
2026-09-03 talkingdev

Cline 最大规模重构揭秘:7.6 万行核心换成共享 SDK,1100 万开发者平滑迁移,智能体失败率降 10 倍

Cline 团队近日公布了其 VS Code 扩展迄今最大规模重构的实践细节。该扩展将约 7.6 万行的单体代理核心替换为共享 SDK,并在不影响 1100 多万开发者既有工作流的前提下完成切换。由于 VS Code Marketplace 缺乏渐进...

Read More
2026-09-03 talkingdev

GitHub Copilot 成本优化揭秘:为何更短的输出反而更贵,如何不牺牲任务质量

GitHub 近期分享了一个反直觉的发现:在 AI 编码代理中,单纯缩短单个工具输出未必能降低成本,反而可能推高总开销。原因在于,当输出缺乏必要上下文时,模型会被迫重新打开文件、重新运行命令或增加额外对话轮次,...

Read More
2026-09-03 talkingdev

谷歌发布 Gemini 3.8 Flash 与 Flash Cyber:智能体推理和网络安全能力再升级

谷歌近日正式推出 Gemini 3.8 Flash,这一新模型在编程、智能体工作流和多步推理方面均有显著提升,同时延续了与 3.7 Flash 相同的入门定价,意味着开发者可以在不增加成本的情况下获得更强的任务执行能力。值得关注...

Read More
2026-09-03 talkingdev

Anthropic 深陷对齐危机:引入 METR 独立审查 AI 智能体事故,暂缓最高风险强化学习研究

Anthropic 正计划将外部安全评估机构 METR 引入内部,对其近期涉及 AI 智能体的安全事件进行独立审查。与此同时,该公司已暂停最高风险级别的强化学习研究,但仍公开分享了一项刻意训练出奖励追求型 Claude 版本的研...

Read More
2026-09-03 talkingdev

Meta发布Muse Spark 1.3:编码与智能体性能升级,生产环境更易用

Meta正式发布Muse Spark 1.3,重点提升编码与智能体任务的推理表现,并针对生产环境优化易用性。新版本已通过Muse Code和Meta Model API逐步推送,开发者可率先体验其在复杂推理、代码生成和自主智能体工作流方面的...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page