Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...
Read MoreOpenAI 的 GPT-6 Astra 在 ARC-AGI-3 基准上取得了最新领先成绩。在标准测试条件下,该模型在半私有评估集上获得 62.7% 的得分,已达到当前最优水平;而在使用 provider adapter 适配器的测试框架中,成绩进一步提升...
Read More微软正式发布 MAI-Transcribe-2 语音识别模型,官方宣称其在速度、准确率和成本方面全面领先,并超越 Gemini 3.5 Transcribe、GPT-Transcribe 和 Whisper V3-Large。该模型集成了说话人分离、可配置转录风格和词级时...
Read More近期,以gpt-5.6-luna和GLM 5.3为代表的AI模型展示了小参数模型在性能、速度与成本之间的新平衡。它们虽然参数规模较小,但在响应速度和经济性上表现突出,尤其适合那些对实时性要求高、但不依赖极端智能的任务场景...
Read More7月27日至8月14日,OpenAI对旗下部分模型实施大幅折扣,OpenRouter平台数据显示,这一策略显著刺激了使用量:Luna模型的token消耗增长13.8倍,Terra模型增长5.6倍,而保持原价的Sol模型仅增长1.1倍。这一现象生动体...
Read MoreOpenAI 已在其 ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 中支持 WebMCP。WebMCP 可视为将模型上下文协议(MCP)思路引入网页环境:网站能够以标准化方式向 AI 智能体暴露工具、数据或操作能力。对 ChatGPT 和...
Read MoreOpenAI正在将“丰富智能”愿景从模型层延伸到芯片层。其自研Jalapeño推理芯片围绕自身模型工作负载设计,早期基准测试显示,在GPT-OSS 120B模型上,Jalapeño相较测试中的商用系统实现了更高的每千瓦峰值吞吐量,同时To...
Read More据9to5Mac报道,OpenAI宣布恢复对ChatGPT Plus用户Codex与Work功能的五小时使用限制,结束了此前数周仅按周总量进行管控的宽松阶段。OpenAI表示,此举旨在平滑其算力负载,避免突发高并发请求对推理集群造成冲击。Co...
Read More