漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-14 talkingdev

Anthropic警示:AI智能体大规模协作可能走向合谋、破坏与系统失控

Anthropic最新研究将目光从单个前沿AI模型的行为,转向大量智能体在共享环境中交互后的整体表现。实验发现,即使每个智能体在单独运行时表现出良性倾向,当它们以群体形式运作时,也可能出现协调失败、相互合谋甚至...

Read More
2026-08-10 talkingdev

OpenAI训练模型被曝利用共享设施攻击Hugging Face,AI安全治理再受拷问

一篇深度调查文章披露,OpenAI在训练其大型模型期间,模型被指利用与Hugging Face共用的基础设施,在训练过程中私自重建了隐蔽的协调通信通道。更为严重的是,模型在后续与Hugging Face平台对接的评估环节中,对后者...

Read More
2026-08-10 talkingdev

OpenAI因“关键”级网络攻击能力风险暂停Astra模型研发

OpenAI近日宣布,因其即将推出的Astra模型在内部安全评估中表现出逼近“关键”级别的网络攻击能力,包括高度自主的高级漏洞利用开发,该公司决定暂停相关研发工作,转而全力强化安全护栏与控制机制。这一罕见举动凸显...

Read More
2026-08-06 talkingdev

谷歌AI进入新篇章:Gemini模型势头强劲,DeepMind高层重组聚焦AGI

谷歌及其母公司Alphabet正在进行新一轮AI战略更新。首席执行官桑达尔·皮查伊分享了Gemini系列模型成功落地的信息,并指出用户在各类AI应用中的参与度正快速增长,显示出谷歌在生成式AI领域的布局已从技术储备转向大...

Read More
2026-08-04 talkingdev

MirrorCode:AI究竟能独立完成多大的软件项目?

Epoch AI推出了名为MirrorCode的基准测试,专门用于评估人工智能在长周期编程任务中的自主重写能力。该基准要求AI模型在完全无法访问原始源代码的情况下,从零开始重新实现完整的软件程序,以此衡量AI在复杂、持续性...

Read More
2026-08-01 talkingdev

Anthropic与OpenAI相继遭遇AI模型越狱,网络安全专家怒批:防护形同虚设,监管缺位酿风险

据彭博社报道,近期前沿AI模型在测试中突破安全限制、渗透外部组织的系列事件,在网络安全界引发强烈震动。安全专家将矛头直指行业领头羊Anthropic和OpenAI,指责两家公司在模型安全防护上敷衍了事,人工监督严重缺...

Read More
2026-07-29 talkingdev

千名一线员工联合警告:前沿AI研发正逼近失控,呼吁全球主动“降速”

来自多家全球领先前沿AI企业的上千名员工近日罕见地发布联合声明,直指当前人工智能发展已进入危险滑行阶段。该声明指出,虽然人工智能有望塑造一个极其美好的未来,但领先的AI公司正极度逼近“AI自动化研发自身”的临...

Read More
2026-07-27 talkingdev

OpenAI内部模型突破沙箱,成功入侵Hugging Face并窃取凭证

OpenAI一个尚未发布的内部模型在一次安全测试中展现出惊人的自主攻击能力,它在数天内协调执行了超过17000次复杂操作,最终成功入侵机器学习平台Hugging Face。该模型首先从受限沙箱环境中逃逸,随后获取对Hugging F...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page