漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-31 talkingdev

开源|Vercel Labs发布vgpu:面向WebGPU的模块化跨运行时TypeScript库

vgpu 是 Vercel Labs 推出的一个 TypeScript 库,专为 WebGPU 设计,旨在以模块化方式统一着色器、3D 场景、GPU 张量、神经网络和数学可视化等计算与渲染任务。该库提供类型化着色器导入能力,并采用紧凑的 GPU 优先...

Read More
2026-08-25 talkingdev

Hot Chips 2026:CUDA瞄准RISC-V,英伟达为开源芯片打开GPU计算大门

英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...

Read More
2026-08-17 talkingdev

重磅:SpaceX正式收购Cursor,AI编程工具将获GPU算力加持

SpaceX正式宣布收购AI编程工具Cursor,旨在将其庞大的GPU计算资源应用于AI模型训练,以显著提升模型性能并降低训练成本。借助SpaceX在高性能计算基础设施方面的积累,Cursor有望开发出能力更强、效率更高的代码生成...

Read More
2026-04-06 talkingdev

开源|Gemma Gem:首个完全在设备端通过WebGPU运行谷歌Gemma 4模型的浏览器扩展

近日,GitHub上出现了一个名为Gemma Gem的开源项目,它是一个Chrome浏览器扩展,能够将谷歌最新发布的Gemma 4大型语言模型完全在用户本地设备上运行。该项目最大的技术亮点在于,它通过新兴的WebGPU API来实现高性能...

Read More
2026-02-23 talkingdev

开源|突破显存限制:开发者实现单张RTX 3090运行Llama 3.1 70B,NVMe直连GPU绕过CPU

近日,在GitHub上开源名为“ntransformer”的高效大语言模型推理引擎项目,其核心创新在于探索并实现了通过NVMe存储设备直接与GPU通信,绕过CPU和系统内存的传统数据路径,从而在消费级显卡RTX 3090上成功运行了参数量...

Read More
2026-02-18 talkingdev

开源|BarraCUDA:瞄准AMD GPU的开源CUDA编译器,可将.cu文件编译为GFX11机器码

近日,一个名为BarraCUDA的开源项目在开发者社区引发广泛关注。该项目旨在实现一个能够将NVIDIA CUDA代码(.cu文件)直接编译为AMD GPU(特别是基于RDNA 3架构、代号GFX11)机器代码的编译器。这一尝试打破了长期以...

Read More
2025-12-08 talkingdev

开源|NVIDIA发布cuTile Python:面向GPU的下一代并行编程模型

NVIDIA近日在GitHub上开源了cuTile Python项目,这是一个专为NVIDIA GPU设计的新型并行编程模型。cuTile的核心目标在于简化高性能并行内核的编写过程,它能够自动利用GPU底层的高级硬件特性,同时确保代码在不同代际...

Read More
2025-10-27 talkingdev

PyTorch隐藏Bug曝光:苹果MPS GPU上Adam优化器内存处理异常导致训练停滞

一位开发者在构建稀疏自编码器时遭遇了罕见的PyTorch框架底层Bug。该问题表现为模型训练损失函数持续处于平台期,经深度排查发现根本原因在于苹果硅GPU(MPS)后端执行Adam优化器时,由于内存处理机制缺陷导致部分张...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page