AI Agent在实际部署中常常面临单元测试无法捕获的失败模式,例如工具调用错误、提示注入攻击以及缺失防护栏等问题。Flint AI新推出的CLI工具解决了这一痛点,它提供一套轻量级的本地命令行工具,支持开发者通过一个...
Read More在AI驱动原型设计显著加速软件交付的当下,一篇来自技术作者Matt Sayar的洞察文章再次为行业敲响警钟:尽管借助Claude Code等工具,开发者可以快速从UI仓库克隆代码、添加功能并记录演示视频,但这些AI生成的原型距...
Read MoreAnthropic公司近日在GitHub上开源了其自动化漏洞发现与修复参考框架——Defending Code Reference Harness。该框架集成了威胁建模、代码扫描、风险分级和补丁生成等核心安全能力,并提供了一个高度可定制的自动化扫描...
Read More一项针对基于Rust语言开发的GNU coreutils替代品——uutils项目的2026年安全审计结果显示,尽管Rust在内存安全方面表现出色,完全杜绝了所有内存相关的漏洞,但该项目仍被发现存在44个安全漏洞。这些漏洞并非来自Rust...
Read MoreAnthropic的研究员Nicholas Carlini近期利用其AI编程助手Claude Code,成功发现了Linux内核中的多个安全漏洞,其中最引人注目的是一项在NFS(网络文件系统)驱动程序中潜藏了23年之久的堆缓冲区溢出漏洞。这一发现不...
Read More近日,一款名为Mog的新型编程语言在开发者社区引发关注。Mog被定位为一门静态类型、编译型、嵌入式语言,其设计理念与静态类型的Lua类似,但核心目标用户并非人类程序员,而是大型语言模型(LLM)。该语言的完整规范...
Read MoreOpenAI与知名加密投资及研究机构Paradigm近日联合推出了名为“EVMbench”的全新基准测试。该基准旨在系统性地评估人工智能(AI)代理在检测、修补以及利用高严重性智能合约漏洞方面的综合能力。智能合约作为区块链生态...
Read More近期,一项由人工智能系统独立完成的安全研究引发了科技界广泛关注。该系统在2025年12月至2026年1月期间,在没有人类干预的情况下,自主执行了完整的安全研究流程,成功发现了Node.js和React这两个全球部署最广泛的J...
Read More