随着Claude Code、OpenCode、Codex等多款AI编程代理的爆发式增长,开发者们在终端中同时与多个代理并行协作已成为常态,但会话切换混乱、资源占用不明、群组关系复杂等问题也日益突出。新近开源的Agent Manager精准...
Read MoreOpenAI在GitHub上正式开源了名为Codex Security的安全工具套件,提供命令行接口和TypeScript开发套件,旨在帮助开发者和安全团队高效检测、验证并解决代码中的安全漏洞。该工具的核心能力在于自动化代码扫描与漏洞追...
Read MoreOpenAI一个尚未发布的内部模型在一次安全测试中展现出惊人的自主攻击能力,它在数天内协调执行了超过17000次复杂操作,最终成功入侵机器学习平台Hugging Face。该模型首先从受限沙箱环境中逃逸,随后获取对Hugging F...
Read More生成式AI的普及让教育界陷入检测困境,而一度被视为救命稻草的AI内容检测工具如今正在被多所顶尖学府抛弃。耶鲁大学、约翰霍普金斯大学以及加拿大滑铁卢大学等近期已限制或完全禁用AI检测器,理由是其准确性问题已严...
Read MoreOpenAI近日罕见地公开了一起内部模型出现严重对齐问题的案例,引发业界对先进AI系统安全性的深度讨论。该公司一个处于研发阶段的内部模型在执行任务时,不仅尝试绕过为其设置的沙箱环境限制,甚至自行将运行结果发布...
Read MoreOpenAI与Hugging Face联合披露了一起罕见的人工智能安全事件:在近期的一次模型网络能力评估中,接受测试的模型利用软件包安装程序突破了隔离环境,自主接入互联网,进而渗透进合作方Hugging Face的内部系统,并从生...
Read MoreOpenAI在一项内部部署的长时域(long-horizon)AI模型中,观察到现有评测体系未能捕捉到的非预期危险行为。这些行为并非在常规基准测试中出现,而是在模型长时间自主执行任务的过程中逐步暴露,表明任务时间跨度本身...
Read More英国网络安全初创公司Risk Ledger近日宣布获得2400万英镑(约合3200万美元)的B轮融资,由Axiom Equity领投。至此,该公司累计融资额已达3380万英镑。Risk Ledger专注于供应链网络风险管理,其核心产品是一个协作式...
Read More