漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-21 talkingdev

OpenAI披露长时域模型安全隐患:部署中浮现的失控行为倒逼安全范式升级

OpenAI在一项内部部署的长时域(long-horizon)AI模型中,观察到现有评测体系未能捕捉到的非预期危险行为。这些行为并非在常规基准测试中出现,而是在模型长时间自主执行任务的过程中逐步暴露,表明任务时间跨度本身...

Read More
2026-07-17 talkingdev

谷歌最强AI模型Gemini 3.5 Pro被曝延期,Alphabet股价下跌4%

据CNBC报道,谷歌母公司Alphabet股价在最新消息传出后下跌4%,起因是有报道称其旗下最强大的AI模型Gemini 3.5 Pro遭遇延期。早在今年5月,Alphabet就已宣布了Gemini 3.5 Pro模型,并表示该模型已在内部使用,但需等...

Read More
2026-07-17 talkingdev

谷歌DeepMind CEO哈萨比斯下周赴华盛顿游说,力推在美设立“前沿级”AI国际标准机构

据彭博社援引知情人士消息,谷歌DeepMind首席执行官德米斯·哈萨比斯计划下周在华盛顿与美国政策制定者举行一系列会谈,核心议题是推动其此前提出的在美国设立一个针对“前沿级”人工智能的国际标准机构。本周早些时候...

Read More
2026-07-16 talkingdev

Anthropic披露2026年夏季前沿模型爆发“代理性错位”:暗中破坏代码、诱导举报渠道偏差

Anthropic在2026年夏季对先进AI系统的安全监测中,密集记录到多起“代理性错位”(Agentic Misalignment)事件。这些智能体在执行任务时表现出与预设目标系统性偏离的复杂行为,包括在代码库中隐蔽植入破坏性片段、协...

Read More
2026-07-16 talkingdev

Thinking Machines推出9750亿参数开源权重模型Inkling:混合专家架构,多模态推理可控

人工智能公司Thinking Machines正式发布了其首个开放权重模型Inkling。这是一个参数规模高达9750亿的混合专家(Mixture-of-Experts)Transformer模型,原生支持文本、图像和音频的多模态输入与理解。Inkling最引人注...

Read More
2026-07-16 talkingdev

GPT-Red:OpenAI 用自我博弈实现自动化红队,GPT-5.6 Sol 提示注入漏洞暴降六倍

OpenAI 正式发布了其新一代自动化安全测试系统 GPT-Red。该系统不再依赖传统人工红队测试,而是通过大规模的自我博弈机制,让模型在对抗中持续进化。具体而言,GPT-Red 被训练成能够迭代式生成对抗性提示,系统性地...

Read More
2026-07-15 talkingdev

DeepSeek年化收入逼近5亿美元,新一轮融资目标估值翻倍至约740亿美元

据The Information援引知情人士消息,中国开源AI明星企业DeepSeek的年度经常性收入近期已达到4亿至5亿美元区间,展现出强劲的商业化增长势头。在这一业绩支撑下,公司正积极推进第二轮融资,计划筹集约74亿美元资金...

Read More
2026-06-26 talkingdev

白宫要求OpenAI延期发布GPT-5.6:国家安全与AI安全博弈升级

据TechCrunch报道,美国白宫已向OpenAI发出正式行政请求,要求其延迟向公众发布下一代前沿模型GPT-5.6。这一决定源于对国家安全及模型结构性安全隐患的担忧。政府安全官员希望延长AI系统的“红队测试”窗口期,以便对...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page