漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-17 talkingdev

微软计划本月推出多模型AI安全工具,代号“Project Perception”,打造高性价比Mythos替代方案

据The Information报道,微软正酝酿在本月发布一款全新的AI安全产品,内部代号为“Project Perception”。该产品被定位为网络安全公司Mythos的更具成本效益的替代方案,旨在抢占企业日益增长的网络防御支出市场。值得...

Read More
2026-07-12 talkingdev

Anthropic提出GRAM方法:为AI模型内的双用途知识装上可关闭的“开关”

AI模型在学习过程中不可避免地会掌握大量“双用途知识”——既能用于网络防御、漏洞检测等正面场景,也可能被用于网络攻击和信息窃取等恶意目的。如何在不削弱模型整体能力的前提下,精准管控这类敏感知识,一直是AI安全...

Read More
2026-06-05 talkingdev

开源|Anthropic发布自动化漏洞挖掘与修复框架:Defending Code Reference Harness

Anthropic公司近日在GitHub上开源了其自动化漏洞发现与修复参考框架——Defending Code Reference Harness。该框架集成了威胁建模、代码扫描、风险分级和补丁生成等核心安全能力,并提供了一个高度可定制的自动化扫描...

Read More
2026-02-19 talkingdev

AI安全攻防新标杆:OpenAI与Paradigm联合发布智能合约漏洞评估基准EVMbench

OpenAI与知名加密投资及研究机构Paradigm近日联合推出了名为“EVMbench”的全新基准测试。该基准旨在系统性地评估人工智能(AI)代理在检测、修补以及利用高严重性智能合约漏洞方面的综合能力。智能合约作为区块链生态...

Read More
2025-10-28 talkingdev

开源|MCP-Scanner:思科AI安全团队推出MCP服务器漏洞扫描工具

思科AI防御实验室近日在GitHub开源了MCP-Scanner工具,专门用于检测MCP(Model Context Protocol)服务器的安全漏洞。该项目上线后迅速获得技术社区关注,在Hacker News平台收获127点讨论热度并引发36条专业评论,反...

Read More
2025-10-24 talkingdev

开源|谷歌Angular团队推出Web Codegen Scorer:大模型网页代码质量评估工具

谷歌Angular团队正式开源Web Codegen Scorer工具,专门用于评估大语言模型生成的网页代码质量。该工具通过构建成功率、安全漏洞检测、编码规范遵循等核心维度,对LLM生成的HTML/CSS/JavaScript代码进行量化评分。开...

Read More
2025-08-20 talkingdev

深度解析主流大语言模型的编程特性:GPT-4o、Claude和Llama的代码生成能力对比

最新发布的深度研究报告系统性地揭示了GPT-4o、Claude、Llama等五大主流大语言模型在代码生成领域的独特“人格特征”。该研究不仅量化分析了各模型在代码生成任务中的优势领域和错误倾向,更首次提出了LLM编程原型分类...

Read More
2025-04-03 talkingdev

DeepMind推出Snowplow内核模糊测试工具,显著提升Linux内核漏洞检测效率

DeepMind最新研究推出的Snowplow是一种创新的内核模糊测试工具,其核心在于采用了基于学习的白盒变异器(learned white-box mutator),能够显著提升测试变异的效率。该工具在Linux内核模糊测试中表现出色,不仅大幅...

Read More
  1. Next Page