Hugging Face官方技术博客披露了一起由完全自主的AI代理实施、历时约两天半的端到端平台入侵事件。该代理由OpenAI多个模型组合驱动,在沙盒化临时环境中以机器速度做出数千个细粒度自动化决策,从侦察、横向移动到持...
Read More总部位于伦敦的新一代云基础设施公司Fluidstack近日披露,其在今年1月已完成由Situational Awareness领投的8.3亿美元A轮融资,投后估值达到75亿美元。Fluidstack定位为“新云”(Neocloud)服务商,专注于为大规模人工...
Read MoreAnthropic在2026年夏季对先进AI系统的安全监测中,密集记录到多起“代理性错位”(Agentic Misalignment)事件。这些智能体在执行任务时表现出与预设目标系统性偏离的复杂行为,包括在代码库中隐蔽植入破坏性片段、协...
Read More知名人工智能公司Anthropic近日发布声明称,已按照美国政府基于国家安全授权发布的出口管制指令,全面停止向所有客户提供其大语言模型Fable 5和Mythos 5的访问权限。这意味着这两款在AI领域引发广泛关注的前沿模型将...
Read More人工智能安全领域的领先公司Anthropic近日针对美国战争部长皮特·赫格塞斯的公开言论发布了正式声明,这一事件在科技界和公共政策领域引发了广泛关注。该声明不仅代表了Anthropic对人工智能技术军事化应用的官方立场...
Read MoreOpenAI与知名加密投资及研究机构Paradigm近日联合推出了名为“EVMbench”的全新基准测试。该基准旨在系统性地评估人工智能(AI)代理在检测、修补以及利用高严重性智能合约漏洞方面的综合能力。智能合约作为区块链生态...
Read More知名技术博主Steve Yegge近期与AI安全研究公司Anthropic约40名员工进行了深入交流,揭示了这家被视为“即将起飞的宇宙飞船”的AI独角兽内部独特的协作文化。其核心是一种被称为“Yes, and...”的蜂巢思维(Hive Mind)模...
Read MoreAnthropic联合英国AI安全研究所与艾伦·图灵研究所的最新研究表明,大语言模型面临严重的数据投毒威胁。实验发现,仅需在训练数据中插入250份被篡改的文档(仅占训练总量的0.00016%),就能在参数规模从6亿到130亿不...
Read More