漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-03 talkingdev

WorkOS 提出 AI Agent 委托访问新思路:别给智能体访问令牌,给它一个任务

在 AI 智能体越来越多地代表用户调用第三方 API 的背景下,OAuth 访问令牌通常由智能体直接持有,一旦智能体会话被劫持,令牌就可能随之泄露并被滥用。WorkOS 公布了一种委托访问方案 Relay,其核心是让凭证始终保存...

Read More
2026-09-03 talkingdev

Val Town:多数 Pro 推荐来自 AI,文档页正成为捕获 AI 代理的复杂查询

随着传统搜索流量持续下降,Val Town 发现其 Pro 订阅的已知推荐现在大多来自 AI 模型,这促使团队将重心转向答案引擎优化(AEO)。其早期策略并非大规模生成面向机器的内容,而是先量化不同模型的推荐与引用表现,...

Read More
2026-09-03 talkingdev

Cline 最大规模重构揭秘:7.6 万行核心换成共享 SDK,1100 万开发者平滑迁移,智能体失败率降 10 倍

Cline 团队近日公布了其 VS Code 扩展迄今最大规模重构的实践细节。该扩展将约 7.6 万行的单体代理核心替换为共享 SDK,并在不影响 1100 多万开发者既有工作流的前提下完成切换。由于 VS Code Marketplace 缺乏渐进...

Read More
2026-09-03 talkingdev

Cloudflare 利用 Zstandard 与 Pingora 打造缓存转码,缓存占用有望降至三分之一

Cloudflare 近日公开了 Cache Transcoding 原型系统,该系统在缓存写入前对符合条件的 HTML、JSON、CSS 和 JavaScript 资源使用 Zstandard 进行压缩,并在不同缓存层级之间以压缩形态存储和传输。初步测试显示,这些...

Read More
2026-09-03 talkingdev

GitHub Copilot 成本优化揭秘:为何更短的输出反而更贵,如何不牺牲任务质量

GitHub 近期分享了一个反直觉的发现:在 AI 编码代理中,单纯缩短单个工具输出未必能降低成本,反而可能推高总开销。原因在于,当输出缺乏必要上下文时,模型会被迫重新打开文件、重新运行命令或增加额外对话轮次,...

Read More
2026-09-03 talkingdev

谷歌发布 Gemini 3.8 Flash 与 Flash Cyber:智能体推理和网络安全能力再升级

谷歌近日正式推出 Gemini 3.8 Flash,这一新模型在编程、智能体工作流和多步推理方面均有显著提升,同时延续了与 3.7 Flash 相同的入门定价,意味着开发者可以在不增加成本的情况下获得更强的任务执行能力。值得关注...

Read More
2026-09-03 talkingdev

Cursor 云代理新突破:可运行在团队自托管机器上,更贴近企业私有环境

Cursor 宣布其云代理(Cloud Agents)现在可以在团队自行管理的自托管机器池上动态调度执行。此前,云代理主要由 Cursor 托管环境统一启动,而新能力让团队在基础设施层面获得更高控制权:代理仍从 Cursor 启动和管...

Read More
2026-09-03 talkingdev

Anthropic 深陷对齐危机:引入 METR 独立审查 AI 智能体事故,暂缓最高风险强化学习研究

Anthropic 正计划将外部安全评估机构 METR 引入内部,对其近期涉及 AI 智能体的安全事件进行独立审查。与此同时,该公司已暂停最高风险级别的强化学习研究,但仍公开分享了一项刻意训练出奖励追求型 Claude 版本的研...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page