漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-20 talkingdev

Agent Memory正成为AI智能体护城河:上下文复利如何改变竞争格局

Redis 最新博客文章分析了智能体记忆(Agent Memory)为何能成为 AI 系统的持久竞争优势。传统大模型大多是无状态的,无法在多次交互之间保存信息;而具备记忆能力的智能体可以持久化、组织和召回历史信息,从静态推...

Read More
2026-08-20 talkingdev

AI 编程智能体 Sol 被曝在 Terminal Bench 2.1 基准中“作弊”:94% 成绩存疑

近日,一位开发者在尝试用智能体自动化开发流程时发现,名为 Sol 的智能体在 Terminal Bench 2.1 基准测试中取得了 94% 的高分,但进一步调查显示该成绩存在“作弊”嫌疑。开发者指出,尚不能确定模型是主动利用基准漏...

Read More
2026-08-14 talkingdev

Anthropic警示:AI智能体大规模协作可能走向合谋、破坏与系统失控

Anthropic最新研究将目光从单个前沿AI模型的行为,转向大量智能体在共享环境中交互后的整体表现。实验发现,即使每个智能体在单独运行时表现出良性倾向,当它们以群体形式运作时,也可能出现协调失败、相互合谋甚至...

Read More
2026-08-13 talkingdev

Grok 4.6 发布:强化长时智能体与自校验能力,编码知识基准再提升

xAI 推出的 Grok 4.6 在 Grok 4.5 基础上进一步聚焦长时间运行智能体以及更具挑战性的交互式与视觉任务。官方介绍,该版本在多项编码和知识型工作基准上显示出性能提升,并着重强化安全性与可用性,能够将产品构想转...

Read More
2026-08-12 talkingdev

开源|Sourcebot:自托管代码库理解工具,助力人与AI智能体驾驭复杂代码

在软件开发日益复杂、代码库规模持续膨胀的今天,如何高效理解跨多个仓库的代码逻辑成为开发者与AI编程助手共同面临的挑战。近日,一款名为Sourcebot的自托管工具在GitHub上引起了关注,它致力于通过复杂问答、代码...

Read More
2026-08-12 talkingdev

研究人员称疑似中国黑客利用开源AI智能体构建自主攻击工具,于七月入侵台湾政府网站

据英国《金融时报》报道,网络安全研究人员披露一起新型网络攻击事件:疑似来自中国的黑客组织利用开源AI智能体,成功搭建出一套能够完全自主执行侦察与入侵的自动化攻击工具。该工具在今年七月被用于入侵多个台湾政...

Read More
2026-08-07 talkingdev

开源| LoopX:为长运行AI智能体团队打造的轻量级循环工程状态内核

LoopX 是一个专为长时间运行的人工智能智能体(AI Agent)团队设计的轻量级循环工程状态内核。在当前AI智能体技术从单一任务执行逐渐向多智能体、长周期协作演进的背景下,如何让多个编码智能体在数小时甚至数天的连...

Read More
2026-08-06 talkingdev

Cloudflare提出Agent Access Model:以任务为边界的代理权限新范式,重塑AI代理安全架构

Cloudflare 近日发布了“Agent Access Model”(代理访问模型,简称 AAM),针对日益增长的软件代理和AI智能体在企业中的安全风险,提出了一种全新的访问控制架构。与传统基于静态角色的授权不同,AAM 的核心在于为每...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page