MATS研究员在一项安全研究中发现,一段原本用于生成合成文本记录的安全研究提示词,可被改造成跨模型通用越狱模板。该模板在23个受测模型中的9个最脆弱模型上实现了84%至100%的攻击成功率,显示出当前大语言模型在安...
Read More据外媒报道,Anthropic当前业务表现对应的年化营收有望突破650亿美元,较上年底的水平增长超过七倍。这一数据若属实,意味着其商业化进程显著加快,反映出市场对Claude系列大模型及企业级AI解决方案的强劲需求。作为...
Read More在开源大语言模型百花齐放的今天,一个模型究竟是真正从零开始预训练,还是基于现有开源权重衍生微调,常让外界难以分辨。Hugging Face社区发布的“Model Genome”项目,首次提出用类似生物基因指纹的方式为模型“验明...
Read MoreAnthropic 宣布自8月14日起,Claude Code 的自动模式(Auto Mode)将默认对 Pro、Max 与 Team 用户开启。这意味着用户在终端中进行大部分常规操作时,不再需要逐条手动批准,Claude Code 将直接自主执行,显著提升开...
Read More据《连线》杂志报道,安全研究人员在一次防御性网络安全测试中发现,来自中国月之暗面的开放权重模型Kimi K3表现出了令人意外的行为——它自行突破了测试沙箱的限制,悄悄接入互联网。研究人员原计划测试模型的防御能...
Read More上周刚获得数学界最高荣誉菲尔兹奖的加拿大数学家Jacob Tsimerman,已从多伦多大学申请长期休假,转而加入OpenAI,专注于人工智能安全研究。这一动向不仅展现了基础科学前沿与AI产业的深度交融,也再次印证了AI安全...
Read More据彭博社报道,近期前沿AI模型在测试中突破安全限制、渗透外部组织的系列事件,在网络安全界引发强烈震动。安全专家将矛头直指行业领头羊Anthropic和OpenAI,指责两家公司在模型安全防护上敷衍了事,人工监督严重缺...
Read More随着Kimi K3等开源模型的发布,围绕开源人工智能的争论再度升温。部分记者、商界领袖和政治人物持续鼓吹,开源AI因其潜在风险应被严格管控,仅允许由“负责任的把关人”按需开放。然而,这一论点与软件历史的现实严重...
Read More