漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

开源|WebLLM:基于WebGPU在浏览器中高性能运行开源大模型

WebLLM 是 MLC AI 推出的高性能浏览器端大语言模型推理引擎,它借助 WebGPU 将开源模型的加载与推理全过程放在用户浏览器内完成,不需要后端服务器。该项目提供兼容 OpenAI 的 API,可支持流式输出、JSON 模式等聊天...

Read More
2026-09-04 talkingdev

Three-LLM 实现浏览器本地运行大模型:基于 WebGPU 与 Three.js 将解码速度提升至 566 tokens/s

Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...

Read More
2026-08-31 talkingdev

基础模型不再是瓶颈:GLM5.3与Qwen3.8-27B靠后训练实现家用硬件跑Opus级智能

近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...

Read More
2026-08-20 talkingdev

论文推荐|Agent Lightning v1.0:仅6K样本让Qwen3.5-9B在SWE-bench提升14.6分

现代智能体通常运行在执行外壳(harness)中,由外壳管理工具、上下文与控制流。Agent Lightning v1.0提出一种轻量级“受控智能体强化学习”(harnessed agentic RL)框架,约3500行代码即可将任意智能体外壳接入RL训...

Read More
2026-08-17 talkingdev

阿里Qwen 3.8 27B发布:17GB开源通用模型实现长上下文、工具调用、视觉与代码生成突破

近日,阿里巴巴Qwen研究实验室正式发布Qwen 3.8 27B,这是一款采用Apache 2.0许可的270亿参数开源大语言模型,开放权重约17GB。据知名开发者Simon Willison介绍,该模型在中等参数规模下集成了长上下文处理、高效工...

Read More
2026-08-16 talkingdev

Hugging Face:Qwen衍生模型突破15.1万个,成为开放模型生态最大基础之一

Hugging Face 最新发布的半年度开放模型生态报告显示,开发者基于 Qwen 系列模型已创建超过 151,000 个衍生模型,数量在所有基础模型中位居第一,使 Qwen 成为开放模型生态系统中规模最大、影响力最广的底座之一。报...

Read More
2026-08-14 talkingdev

Netlify 同题实测 11 款大模型:DeepSeek V4 Flash 仅 2.4 积分,Claude Opus 5 高价低效?

近日,Netlify 公布了一项面向 AI 模型选型的横向测试:通过 OpenRouter 接入 DeepSeek、Qwen、Kimi、GLM 等 11 款主流模型,使用同一段构建提示词生成静态咖啡店网站,并比较输出质量与积分消耗。结果显示,模型间...

Read More
2026-08-13 talkingdev

Qwen3.8-2.4T-A95B发布:强化编码与长程智能体能力,推理深度可调

Qwen团队在Hugging Face发布Qwen3.8-2.4T-A95B模型。该模型基于Qwen3.5架构演进而来,重点提升编码与长时程任务处理能力,并通过改进的智能体执行机制提高任务完成可靠性。它支持SGLang、vLLM等主流部署框架,可较顺...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page