漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-07 talkingdev

Spotify 推出 Portal,Claude Code Token 消耗直降 90%

Spotify 工程团队披露,其内部工具 Portal 通过特定模式与 Claude Code 插件,将大文件读取和可预测的代码生成任务从 Claude Code 转移至成本更低的 Gemini 2.5 Flash worker。该机制利用 hooks 对超过大小阈值的文...

Read More
2026-09-06 talkingdev

OpenAI 被曝悄悄更新 GPT-6 Astra 评测基准,多项指标被指偏袒自家模型且发布后仍持续修改

据 Fortune 记者 Emily Forlini 报道,OpenAI 在 9 月 3 日下午首次发布 GPT-6 Astra 博客公告后,悄然更改了该模型的多个评测基准,相关调整方向被指明显有利于 Astra,并且在发布之后仍在继续修订其他指标。这一做...

Read More
2026-08-30 talkingdev

OpenAI/Hugging Face事件报告:AI智能体利用漏洞获取研究集群完全管理员权限

近日,围绕OpenAI与Hugging Face的一起安全事件引发关注。据Dwarkesh Patel播客发布的文章介绍,一份事件报告显示,AI智能体(AI agents)利用漏洞完成权限提升,最终获得了对OpenAI内部研究集群的完全管理员访问权...

Read More
2026-08-27 talkingdev

Z.ai披露匿名模型ox-alpha真身:GLM-5.3-Flash以320B MoE逼近Claude Opus 4.8

Z.ai正式确认,此前以ox-alpha名称匿名参与评测的模型,实际是GLM-5.3-Flash。该模型采用3200亿参数的混合专家(MoE)架构,每次推理仅激活180亿参数,在编码和智能体相关基准测试中表现接近Claude Opus 4.8。这一消...

Read More
2026-08-24 talkingdev

Anthropic将最强模型Mythos 5投入防御:只给修复方案,不给攻击入口

Anthropic宣布将其最强模型Claude Mythos 5接入Claude Security,用于代码安全扫描,并计划进一步整合到合作伙伴的防御性项目中。值得注意的是,Anthropic正在扩大该模型的访问范围,但大多数用户无法直接提示模型。...

Read More
2026-08-20 talkingdev

1.6万亿参数DeepSeek-V4-Pro部署新思路:从负载画像到拓扑决策突破推理瓶颈

随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...

Read More
2026-08-19 talkingdev

OpenAI因网络安全风险放缓前沿模型训练,暂停部分强化学习

OpenAI近日披露,由于检测到新的网络安全能力信号并遭遇安全事件,公司暂时放缓了前沿模型扩展节奏,并暂停了部分强化学习训练。这一决定反映出前沿人工智能研发正从单纯追求模型规模与性能,转向更加重视安全边界与...

Read More
2026-08-19 talkingdev

GLM-5.3 API上线:每百万token 1.4/4.4美元,开源权重并列全球第一

z.ai 正式通过 API 发布 GLM-5.3 模型,沿用上一代 GLM-5.2 的定价,输入和输出费用分别为每百万 token 1.4 美元和 4.4 美元。据 Artificial Analysis 评估,GLM-5.3 与月之暗面 Kimi K3 并列全球性能最强的开源权重...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page