漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

开源|WebLLM:基于WebGPU在浏览器中高性能运行开源大模型

WebLLM 是 MLC AI 推出的高性能浏览器端大语言模型推理引擎,它借助 WebGPU 将开源模型的加载与推理全过程放在用户浏览器内完成,不需要后端服务器。该项目提供兼容 OpenAI 的 API,可支持流式输出、JSON 模式等聊天...

Read More
2026-09-04 talkingdev

Three-LLM 实现浏览器本地运行大模型:基于 WebGPU 与 Three.js 将解码速度提升至 566 tokens/s

Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...

Read More
2026-09-04 talkingdev

Funes 为编程智能体装上持久记忆:跨机器、跨代理无缝续接开发上下文

Funes 项目为编程智能体引入了一个可持久化的记忆层,旨在解决当前 AI 编程代理在会话切换后上下文丢失、记忆无法跨工具复用的问题。该方案利用本地索引与嵌入技术,在不依赖外部服务的情况下实现上下文记忆的存储与...

Read More
2026-09-01 talkingdev

开源|FnScribe:macOS 本地语音听写工具,快捷键一键输入、隐私不落云

FnScribe 是一款面向 macOS 的私有化语音听写工具,核心特点是语音转写在本地完成,不需要将录音上传至云端,从而降低敏感语音数据外泄风险。用户可以通过快捷键在任意活跃应用中启动听写,并支持免提操作,适合写作...

Read More
2026-08-31 talkingdev

基础模型不再是瓶颈:GLM5.3与Qwen3.8-27B靠后训练实现家用硬件跑Opus级智能

近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...

Read More
2026-08-28 talkingdev

设备端实时语音克隆新突破:Halo Neuro开源Sopro V2 Turbo

Halo Neuro正式发布Sopro V2语音克隆文本转语音模型家族,并开源其中的轻量级多语言模型Sopro V2 Turbo。该模型仅120M参数,具备语音克隆能力,支持多语言合成,并原生支持欧洲葡萄牙语,能够在笔记本CPU和浏览器环...

Read More
2026-08-27 talkingdev

突发:ChatGPT 正式支持 WebMCP,智能体网络再进一步

OpenAI 已在其 ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 中支持 WebMCP。WebMCP 可视为将模型上下文协议(MCP)思路引入网页环境:网站能够以标准化方式向 AI 智能体暴露工具、数据或操作能力。对 ChatGPT 和...

Read More
2026-08-26 talkingdev

Perplexity联合Nvidia推出Portable Computer:完全本地运行的AI智能体,零Token成本

Perplexity正式发布Portable Computer,这是其智能体计算平台的一个本地化版本,目标是将AI代理任务完全运行在用户自有硬件上。该方案与Nvidia合作,可部署在DGX Spark及RTX系列Linux设备上,模型、用户数据和工作内...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page