漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-28 talkingdev

谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力

谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...

Read More
2026-07-28 talkingdev

OpenAI 报告揭示:AI 正在重新划定职业边界,ChatGPT 促使用户跨岗位承担新任务

OpenAI 最新研究显示,人工智能正在深刻重塑人们的工作方式,而不仅仅是提升效率。该团队通过对 80 万条美国用户的 ChatGPT 消息进行分析,发现一个显著趋势:工作者越来越多地使用 ChatGPT 来处理传统上属于其他职...

Read More
2026-07-28 talkingdev

微软发布网络安全专用模型MAI-Cyber-1-Flash,MDASH平台助阵大规模代码漏洞挖掘

微软正式推出面向网络安全的专用大模型MAI-Cyber-1-Flash,该模型专门针对大型代码库中的复杂漏洞进行深度检测,标志着AI在主动防御领域迈出重要一步。MAI-Cyber-1-Flash不只是一个通用的代码分析工具,它通过专门训...

Read More
2026-07-28 talkingdev

Anthropic 明确表态不主张全面禁止开放权重模型,呼吁分级治理与芯片管控

人工智能公司 Anthropic 近日正式阐述了其对开放权重模型(open-weight models)的官方立场,明确表示并未倡导对这类模型实施全面禁令。公司认为,能力相对有限的开放权重模型具有公共品属性,能够促进学术研究、透...

Read More
2026-07-27 talkingdev

Claude Opus 5发布:长时运行智能体迎来阶跃式升级,编程与科研性能大幅提升

Anthropic正式发布了新一代AI模型Claude Opus 5,作为Opus系列的重大迭代,该模型被定位为“面向长时间运行智能体的阶跃式改进”。相比前代Opus 4.8,Opus 5在性能与成本效益之间实现了更优平衡,尤其在软件工程和科学...

Read More
2026-07-27 talkingdev

celeris-1 发布:超低延迟逼近 GPT-5 级智能,推理速度提升 15 倍

人工智能公司 celeris AI 正式推出全新通用语言模型 celeris-1,该模型在保持前沿智能水平的同时,实现了突破性的响应速度。celeris-1 的核心创新在于采用了一种基于扩散技术的新型推理架构,从根本上重构了传统自回...

Read More
2026-07-27 talkingdev

提示缓存如何塑造编码智能体的成本与架构

提示缓存正在成为构建经济型智能体的关键技术,但其表现十分脆弱。在编码智能体等复杂系统中,一次工具定义的修改、模型版本的切换,或云服务提供商的路由决策变更,都可能将原本低成本的增量请求转变为对上下文的完...

Read More
2026-07-27 talkingdev

GLM-5.2 API性能狂飙:Baseten打造最快版本,推理速度峰值达280 tokens/秒

Baseten 为 GLM-5.2 模型构建的全新 API 在推理速度上取得了突破性进展,峰值速度高达 280 tokens/秒,平均速度约为 100 tokens/秒,整体性能达到发布日初版 API 的两倍以上。这一大幅提升得益于底层的系统级优化与...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page