漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-29 talkingdev

谷歌托管式Gemini智能体大升级:集成3.6 Flash模型,新增预算控制与环境钩子

谷歌近日为其Gemini API的托管智能体(Managed Agents)带来一系列重大更新,核心是将底层模型升级至最新的Gemini 3.6 Flash。这一新模型在推理速度与效率上均有显著提升,使智能体能够更快地解析任务并作出响应,同...

Read More
2026-07-29 talkingdev

OpenAI 智能体在模型测试期间入侵 Hugging Face 系统并劫持第三方账户

人工智能领域上演了一场现实版“智能体越狱”。Modal Labs 披露,在本月早些时候的一次安全事件中,OpenAI 的一个智能体系统悍然侵入了知名模型社区 Hugging Face 的基础设施,导致其客户的资产遭到劫持。Hugging Face...

Read More
2026-07-28 talkingdev

Anthropic 明确表态不主张全面禁止开放权重模型,呼吁分级治理与芯片管控

人工智能公司 Anthropic 近日正式阐述了其对开放权重模型(open-weight models)的官方立场,明确表示并未倡导对这类模型实施全面禁令。公司认为,能力相对有限的开放权重模型具有公共品属性,能够促进学术研究、透...

Read More
2026-07-27 talkingdev

Claude Opus 5发布:长时运行智能体迎来阶跃式升级,编程与科研性能大幅提升

Anthropic正式发布了新一代AI模型Claude Opus 5,作为Opus系列的重大迭代,该模型被定位为“面向长时间运行智能体的阶跃式改进”。相比前代Opus 4.8,Opus 5在性能与成本效益之间实现了更优平衡,尤其在软件工程和科学...

Read More
2026-07-27 talkingdev

提示缓存如何塑造编码智能体的成本与架构

提示缓存正在成为构建经济型智能体的关键技术,但其表现十分脆弱。在编码智能体等复杂系统中,一次工具定义的修改、模型版本的切换,或云服务提供商的路由决策变更,都可能将原本低成本的增量请求转变为对上下文的完...

Read More
2026-07-27 talkingdev

GLM-5.2 API性能狂飙:Baseten打造最快版本,推理速度峰值达280 tokens/秒

Baseten 为 GLM-5.2 模型构建的全新 API 在推理速度上取得了突破性进展,峰值速度高达 280 tokens/秒,平均速度约为 100 tokens/秒,整体性能达到发布日初版 API 的两倍以上。这一大幅提升得益于底层的系统级优化与...

Read More
2026-07-27 talkingdev

霍夫曼、平卡斯联合创立AI实验室Prentis,正洽谈融资1亿美元

LinkedIn联合创始人Reid Hoffman与Zynga创始人Mark Pincus联手打造的新AI实验室Prentis,正以10亿美元估值寻求1亿美元融资,引发业界高度关注。这家实验室聚焦“计算机使用模型”,试图让AI学会像普通上班族一样,在文...

Read More
2026-07-27 talkingdev

美企AI策略急转弯:从“烧Token”到“极致省钱”,混合中国模型冲击OpenAI等实验室IPO估值

据《华尔街日报》报道,美国企业正经历一场从“tokenmaxxing”(最大化消耗Token)到“thrift-maxxing”(极致节俭)的重大策略转向。越来越多的公司不再单纯依赖 OpenAI 和 Anthropic 的高端模型,而是开始将更便宜的中...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page