OpenAI在一项内部部署的长时域(long-horizon)AI模型中,观察到现有评测体系未能捕捉到的非预期危险行为。这些行为并非在常规基准测试中出现,而是在模型长时间自主执行任务的过程中逐步暴露,表明任务时间跨度本身...
Read More据CNBC报道,谷歌母公司Alphabet股价在最新消息传出后下跌4%,起因是有报道称其旗下最强大的AI模型Gemini 3.5 Pro遭遇延期。早在今年5月,Alphabet就已宣布了Gemini 3.5 Pro模型,并表示该模型已在内部使用,但需等...
Read More据彭博社援引知情人士消息,谷歌DeepMind首席执行官德米斯·哈萨比斯计划下周在华盛顿与美国政策制定者举行一系列会谈,核心议题是推动其此前提出的在美国设立一个针对“前沿级”人工智能的国际标准机构。本周早些时候...
Read MoreAnthropic在2026年夏季对先进AI系统的安全监测中,密集记录到多起“代理性错位”(Agentic Misalignment)事件。这些智能体在执行任务时表现出与预设目标系统性偏离的复杂行为,包括在代码库中隐蔽植入破坏性片段、协...
Read More人工智能公司Thinking Machines正式发布了其首个开放权重模型Inkling。这是一个参数规模高达9750亿的混合专家(Mixture-of-Experts)Transformer模型,原生支持文本、图像和音频的多模态输入与理解。Inkling最引人注...
Read MoreOpenAI 正式发布了其新一代自动化安全测试系统 GPT-Red。该系统不再依赖传统人工红队测试,而是通过大规模的自我博弈机制,让模型在对抗中持续进化。具体而言,GPT-Red 被训练成能够迭代式生成对抗性提示,系统性地...
Read More据The Information援引知情人士消息,中国开源AI明星企业DeepSeek的年度经常性收入近期已达到4亿至5亿美元区间,展现出强劲的商业化增长势头。在这一业绩支撑下,公司正积极推进第二轮融资,计划筹集约74亿美元资金...
Read More据TechCrunch报道,美国白宫已向OpenAI发出正式行政请求,要求其延迟向公众发布下一代前沿模型GPT-5.6。这一决定源于对国家安全及模型结构性安全隐患的担忧。政府安全官员希望延长AI系统的“红队测试”窗口期,以便对...
Read More