漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-04 talkingdev

OpenAI 实时语音架构深度揭秘:半年打造全双工GPT-Live,人机对话迈入“无间断”时代

OpenAI 近期公开了其低延迟实时语音系统 GPT-Live 的技术细节,展示了一套仅用六个月构建的全新架构。区别于传统的轮流发言模式,GPT-Live 采用了全双工语音模型,能够实现一边聆听一边发言的连续对话,大幅减少了交...

Read More
2026-08-03 talkingdev

OpenAI GPT-5.6 系列大幅降价:Luna 成本直降 80%,性能与性价比再突破

OpenAI 宣布对旗下 GPT-5.6 系列模型进行新一轮价格调整,进一步推动企业级 AI 应用的价格性能比前沿。其中,轻量版 GPT-5.6 Luna 输入价格降至每百万 token 0.20 美元,输出降至 1.20 美元,降幅高达 80%;均衡版 T...

Read More
2026-07-31 talkingdev

开源|World Model Optimizer:基于智能体轨迹蒸馏前沿模型,构建持续进化的自主智能

World Model Optimizer(WMO)是由experientiallabs开源的一项工具,直面当前智能体(Agent)系统性能优化与模型成本之间的矛盾。其核心思路是将智能体在实际运行中积累的交互轨迹作为高价值训练数据,通过知识蒸馏...

Read More
2026-07-31 talkingdev

开源| GitHub 推出堆叠拉取请求公开预览,大型变更可拆分为多个小型可审查 PR

GitHub 正式宣布堆叠拉取请求功能进入公开预览阶段,为大型代码变更的管理提供了全新范式。该功能允许开发团队将庞大的功能更新或重构拆解为一组有序、聚焦的小型拉取请求,每一个 PR 对应变更的一个逻辑分层。团队...

Read More
2026-07-31 talkingdev

Cursor 揭秘:为编程智能体构建云开发环境,AI 贡献过半合并 PR

Cursor 团队近日公开了其为云端编程智能体(Coding Agents)构建开发环境的实践经验。为了让人工智能能够更顺畅地理解、运行和测试代码,团队将开发环境本身视作一款直接服务于智能体的产品。通过对单体仓库(Monore...

Read More
2026-07-30 talkingdev

开源|TurboFieldfare:任意M系列MacBook仅需2GB内存即可运行Gemma 4 26B-A4B模型

苹果生态中内存长期被认为是大模型本地推理的瓶颈,而TurboFieldfare项目提供了一个极具突破意义的解决方案。这个专门为Apple Silicon Mac设计的自定义运行时,让庞大的Gemma 4 26B-A4B模型(完整加载需约14.3 GB内...

Read More
2026-07-30 talkingdev

ChatGPT智能体循环优化揭秘:Harness、API与推理三层架构如何实现降本增效

在大语言模型走向产业级部署的进程中,如何在不显著牺牲质量的前提下降低推理成本和响应时延,是各家前沿实验室竞相突破的核心瓶颈。OpenAI工程师团队首次较为系统地披露了支撑ChatGPT及Codex高效运转的智能体循环(...

Read More
2026-07-30 talkingdev

GPT-5.6 如何将前沿智能与极致效率融为一体

OpenAI 最新推出的 GPT-5.6 模型家族,在设计上同时对性能与成本效率进行了深度优化,力求在各类任务中实现更高的“智能投入产出比”。该模型系统通过先进的负载均衡和缓存技术,能够以更经济的方式处理更大规模的令牌...

Read More
  1. Prev Page
  2. 7
  3. 8
  4. 9
  5. Next Page