漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

Three-LLM 实现浏览器本地运行大模型:基于 WebGPU 与 Three.js 将解码速度提升至 566 tokens/s

Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...

Read More
2026-09-04 talkingdev

OpenAI GPT-6 Astra 在 ARC-AGI-3 登顶:标准测试 62.7%,适配器模式 99.9% 创 SOTA

OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 基准上取得了最新领先成绩。在标准测试条件下,该模型在半私有评估集上获得 62.7% 的得分,已达到当前最优水平;而在使用 provider adapter 适配器的测试框架中,成绩进一步提升...

Read More
2026-09-04 talkingdev

微软发布 MAI-Transcribe-2:号称全球最快、最准、最便宜的语音识别模型

微软正式发布 MAI-Transcribe-2 语音识别模型,官方宣称其在速度、准确率和成本方面全面领先,并超越 Gemini 3.5 Transcribe、GPT-Transcribe 和 Whisper V3-Large。该模型集成了说话人分离、可配置转录风格和词级时...

Read More
2026-08-28 talkingdev

小模型时代已至:GPT-5.6-Luna与GLM 5.3引领快速低成本AI新趋势

近期,以gpt-5.6-luna和GLM 5.3为代表的AI模型展示了小参数模型在性能、速度与成本之间的新平衡。它们虽然参数规模较小,但在响应速度和经济性上表现突出,尤其适合那些对实时性要求高、但不依赖极端智能的任务场景...

Read More
2026-08-28 talkingdev

GPT 5.6折扣与杰文斯悖论:OpenRouter数据揭示模型用量激增

7月27日至8月14日,OpenAI对旗下部分模型实施大幅折扣,OpenRouter平台数据显示,这一策略显著刺激了使用量:Luna模型的token消耗增长13.8倍,Terra模型增长5.6倍,而保持原价的Sol模型仅增长1.1倍。这一现象生动体...

Read More
2026-08-27 talkingdev

突发:ChatGPT 正式支持 WebMCP,智能体网络再进一步

OpenAI 已在其 ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 中支持 WebMCP。WebMCP 可视为将模型上下文协议(MCP)思路引入网页环境:网站能够以标准化方式向 AI 智能体暴露工具、数据或操作能力。对 ChatGPT 和...

Read More
2026-08-26 talkingdev

OpenAI自研Jalapeño推理芯片早期基准曝光:GPT-OSS 120B每瓦吞吐更高、Token延迟更低

OpenAI正在将“丰富智能”愿景从模型层延伸到芯片层。其自研Jalapeño推理芯片围绕自身模型工作负载设计,早期基准测试显示,在GPT-OSS 120B模型上,Jalapeño相较测试中的商用系统实现了更高的每千瓦峰值吞吐量,同时To...

Read More
2026-08-25 talkingdev

OpenAI恢复ChatGPT Plus用户Codex和Work五小时使用限制,官方称为平滑算力负载

据9to5Mac报道,OpenAI宣布恢复对ChatGPT Plus用户Codex与Work功能的五小时使用限制,结束了此前数周仅按周总量进行管控的宽松阶段。OpenAI表示,此举旨在平滑其算力负载,避免突发高并发请求对推理集群造成冲击。Co...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page