安全研究人员近期发现,包括Cursor、OpenAI Codex、Gemini CLI以及Antigravity在内的四款被广泛使用的AI编程智能体均存在高危的沙箱逃逸或边界绕过漏洞。攻击者可以利用“写入后即时被信任”的机制,通过植入恶意文件...
Read More月之暗面(Moonshot AI)在GitHub正式开源了一款名为Kimi Code CLI的终端AI编程工具,它被定位为“下一代智能体的起点”。该工具本质上是一个运行在命令行终端中的AI编程智能体,能够自主阅读和编辑代码、执行Shell命...
Read More在人工智能辅助开发的场景中,编码智能体(Coding Agents)常常面临一个关键瓶颈:会话记忆的断裂。每一次新的代码探索或提问,智能体都像是被重置了大脑,无法记住之前的上下文和发现,导致频繁的重复劳动和效率低...
Read MorexAI 在 GitHub 上正式公开了 Grok Build 项目,这是一款面向开发者的终端界面(TUI)编程智能体。与传统的命令行工具不同,Grok Build 提供了一个全屏、支持鼠标交互的富终端环境,开发者可以直接在其中让 AI 审查代...
Read MoreEngram是一款专为AI编程代理设计的持久记忆系统,旨在解决智能体在跨会话协作中上下文丢失的痛点。作为一个语言无关的独立Go二进制文件,它底层采用SQLite进行数据存储,并集成了FTS5全文搜索引擎,实现了高效的知识...
Read More伴随AI编程代理(如Devin、OpenHands等)在软件开发流程中的渗透,如何安全地运行这些具备执行代码能力的智能体成为开发者面临的关键挑战。GitHub新开源项目Clawk给出了一种硬核解决方案:它为AI代理创建可即时销毁...
Read MoreOpenAI最新推出的GPT-5.6-Sol模型被视为一款成本效益极高且运行高效的AI系统,尤其适合日常编程与工程任务,堪称继前代版本之后更为稳定可靠的“主力军”。与此前动辄耗费大量算力的旗舰模型不同,Sol在保持强大代码理...
Read More近期发布的Basecamp Bench基准测试,对GPT-5.6 Sol、Fable 5和Grok 4.5三款前沿大模型在复杂软件工程任务中的表现进行了横向比较。测试聚焦于全栈开发场景,从代理能力、生成成本与输出质量三个维度进行评测。结果显...
Read More