漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

Three-LLM 实现浏览器本地运行大模型:基于 WebGPU 与 Three.js 将解码速度提升至 566 tokens/s

Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...

Read More
2026-09-04 talkingdev

NVIDIA确认以129.3亿美元收购Hugging Face,AI模型社区进入算力巨头时代

NVIDIA正式确认以129.3亿美元收购全球最大AI模型社区Hugging Face。Hugging Face目前托管约300万个模型,服务超过1800万开发者,是机器学习领域最重要的开源协作平台之一。英伟达CEO黄仁勋表示,收购后平台将继续保...

Read More
2026-09-04 talkingdev

Gimlet Labs获a16z领投3亿美元、估值30亿,异构AI芯片任务分配成资本新宠

彭博社消息,Gimlet Labs完成由a16z领投的3亿美元新一轮融资,投后估值达到30亿美元。值得注意的是,该公司六个月前刚完成8000万美元A轮融资,估值与融资额均快速跳升。Gimlet Labs的核心方向是将AI计算任务拆分并调...

Read More
2026-09-01 talkingdev

传Anthropic与英伟达支持的Lambda签下350亿美元云合作,英伟达将供芯片并持有德州数据中心租约

据《华尔街日报》援引知情人士消息,AI公司Anthropic已与英伟达支持的云服务商Lambda签署了一份总额高达350亿美元的云计算合同。该交易落地的数据中心位于德克萨斯州,由Hut 8建设,英伟达将负责供应芯片并持有该数...

Read More
2026-08-31 talkingdev

开源|Vercel Labs发布vgpu:面向WebGPU的模块化跨运行时TypeScript库

vgpu 是 Vercel Labs 推出的一个 TypeScript 库,专为 WebGPU 设计,旨在以模块化方式统一着色器、3D 场景、GPU 张量、神经网络和数学可视化等计算与渲染任务。该库提供类型化着色器导入能力,并采用紧凑的 GPU 优先...

Read More
2026-08-31 talkingdev

英伟达AI优势正超越GPU:Vera Rubin架构重塑超大规模数据中心效率

英伟达正在将AI竞争优势从单一GPU扩展到整个数据中心系统层面。在最新的Vera Rubin架构中,除GPU外,英伟达引入Vera CPU等专用组件,重点提升数据编排与调度效率。这意味着其战略正从单纯追求更强处理器算力,转向优...

Read More
2026-08-28 talkingdev

设备端实时语音克隆新突破:Halo Neuro开源Sopro V2 Turbo

Halo Neuro正式发布Sopro V2语音克隆文本转语音模型家族,并开源其中的轻量级多语言模型Sopro V2 Turbo。该模型仅120M参数,具备语音克隆能力,支持多语言合成,并原生支持欧洲葡萄牙语,能够在笔记本CPU和浏览器环...

Read More
2026-08-28 talkingdev

SGLang Diffusion加持:MiniMax-H3视频生成在8×H200上无损提速1.95倍,最高6.24倍

LMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page