漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

Three-LLM 实现浏览器本地运行大模型:基于 WebGPU 与 Three.js 将解码速度提升至 566 tokens/s

Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...

Read More
2026-09-03 talkingdev

Val Town:多数 Pro 推荐来自 AI,文档页正成为捕获 AI 代理的复杂查询

随着传统搜索流量持续下降,Val Town 发现其 Pro 订阅的已知推荐现在大多来自 AI 模型,这促使团队将重心转向答案引擎优化(AEO)。其早期策略并非大规模生成面向机器的内容,而是先量化不同模型的推荐与引用表现,...

Read More
2026-09-03 talkingdev

Cloudflare 利用 Zstandard 与 Pingora 打造缓存转码,缓存占用有望降至三分之一

Cloudflare 近日公开了 Cache Transcoding 原型系统,该系统在缓存写入前对符合条件的 HTML、JSON、CSS 和 JavaScript 资源使用 Zstandard 进行压缩,并在不同缓存层级之间以压缩形态存储和传输。初步测试显示,这些...

Read More
2026-09-03 talkingdev

GitHub Copilot 成本优化揭秘:为何更短的输出反而更贵,如何不牺牲任务质量

GitHub 近期分享了一个反直觉的发现:在 AI 编码代理中,单纯缩短单个工具输出未必能降低成本,反而可能推高总开销。原因在于,当输出缺乏必要上下文时,模型会被迫重新打开文件、重新运行命令或增加额外对话轮次,...

Read More
2026-09-03 talkingdev

Meta发布Muse Spark 1.3:编码与智能体性能升级,生产环境更易用

Meta正式发布Muse Spark 1.3,重点提升编码与智能体任务的推理表现,并针对生产环境优化易用性。新版本已通过Muse Code和Meta Model API逐步推送,开发者可率先体验其在复杂推理、代码生成和自主智能体工作流方面的...

Read More
2026-09-01 talkingdev

开源|FnScribe:macOS 本地语音听写工具,快捷键一键输入、隐私不落云

FnScribe 是一款面向 macOS 的私有化语音听写工具,核心特点是语音转写在本地完成,不需要将录音上传至云端,从而降低敏感语音数据外泄风险。用户可以通过快捷键在任意活跃应用中启动听写,并支持免提操作,适合写作...

Read More
2026-09-01 talkingdev

OpenClaw 2.0 意外诞生:从简化安装演变为史上最大规模重构

OpenClaw 项目近日发布迄今为止最大规模版本更新 OpenClaw 2.0。此次升级最初目标是简化安装流程并重构浏览器端体验,但在工程推进中需求范围持续扩大,最终演变为覆盖记忆、技能、模型、自动化、应用、插件、安全等...

Read More
2026-08-31 talkingdev

基础模型不再是瓶颈:GLM5.3与Qwen3.8-27B靠后训练实现家用硬件跑Opus级智能

近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page