vgpu 是 Vercel Labs 推出的一个 TypeScript 库,专为 WebGPU 设计,旨在以模块化方式统一着色器、3D 场景、GPU 张量、神经网络和数学可视化等计算与渲染任务。该库提供类型化着色器导入能力,并采用紧凑的 GPU 优先...
Read MoreGoogle DeepMind正式发布并开源了新一代气旋预测AI模型WeatherNext,该模型在追踪热带气旋的路径、强度和风场结构方面达到了目前最先进的精度。与现有业务预报方法相比,WeatherNext平均能为预报员额外提供一整天的...
Read MoreSakana AI 提出了一项名为“Diffusing Blame”(扩散归咎)的神经网络学习新技术,其核心创新在于严格遵循神经科学中的戴尔原则(Dale's principle),即每个神经元只释放一种类型的神经递质,或兴奋或抑制,绝不混合...
Read MoreSakana AI 将其在集体智能领域的探索从软件推向了物理世界,发布了“智能细胞砖”(Smart Cellular Bricks)项目。这种模块化硬件砖块摒弃了传统集中式控制架构,每一块砖都内嵌局部通信模块和小型神经网络,能够通过...
Read More近日,Liquid AI宣布推出其最新基础模型LFM2.5-230M,这是一款参数规模仅为2.3亿的非Transformer架构模型。与当前主流的Transformer模型不同,LFM2.5-230M基于状态空间模型与液态神经网络连续时间公式构建。尽管体积...
Read More大型语言模型(LLM)的核心架构是Transformer,它通过引入自注意力机制,从根本上解决了传统循环神经网络(RNN)在处理长序列数据时面临的顺序计算瓶颈与长距离信息衰减问题。本文深入剖析了Transformer的各个关键组...
Read More本文深入探讨了PyTorch在执行和优化神经网络层方面的最新进展,特别是从单个线性操作逐步过渡到融合多层感知机(MLP)的过程。文章详细剖析了如何通过算子融合技术,将多个连续的线性变换和激活函数合并为一个计算核...
Read More一篇发表于arXiv上的新论文《There Will Be a Scientific Theory of Deep Learning》正引发人工智能学术界的广泛讨论。该文阐述了深度学习虽在实践中取得空前成功,但其理论基础仍相对薄弱,核心机制尚未被完全揭示...
Read More