漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-16 talkingdev

Thinking Machines推出9750亿参数开源权重模型Inkling:混合专家架构,多模态推理可控

人工智能公司Thinking Machines正式发布了其首个开放权重模型Inkling。这是一个参数规模高达9750亿的混合专家(Mixture-of-Experts)Transformer模型,原生支持文本、图像和音频的多模态输入与理解。Inkling最引人注...

Read More
2026-07-15 talkingdev

DeepSeek年化收入逼近5亿美元,新一轮融资目标估值翻倍至约740亿美元

据The Information援引知情人士消息,中国开源AI明星企业DeepSeek的年度经常性收入近期已达到4亿至5亿美元区间,展现出强劲的商业化增长势头。在这一业绩支撑下,公司正积极推进第二轮融资,计划筹集约74亿美元资金...

Read More
2026-07-12 talkingdev

开源|Prisma:为Node.js与TypeScript打造的下一代ORM,全面支持主流数据库

在前后端分离与微服务架构盛行的今天,Node.js 和 TypeScript 生态对数据层的抽象与管理提出了更高要求。Prisma 作为一款面向未来的开源 ORM 工具,提供了极富类型安全的数据库查询方式,极大降低了开发者面对复杂 S...

Read More
2026-06-30 talkingdev

DiScoFormer:单一Transformer模型,跨分布同时估计密度与得分,性能碾压传统KDE

近日,AI2研究团队在Hugging Face博客上发布了DiScoFormer模型,这是一种基于Transformer架构的创新方法,能够在单次前向传播中同时完成数据的密度估计和得分函数估计,而无需针对新分布进行重新训练。与经典的核密...

Read More
2026-06-30 talkingdev

代币经济:从封闭垂直集成到模块化生态的转型

人工智能领域正经历一场深刻的架构变革,从封闭的垂直集成系统向由标准化接口(如Transformer架构和推理API)支撑的模块化生态系统演进。这种架构上的解构使得开源权重模型能够与封闭系统有效竞争,大幅降低成本,同...

Read More
2026-06-26 talkingdev

Liquid AI发布LFM2.5-230M:超紧凑非Transformer模型,边缘推理性能媲美三倍规模模型

近日,Liquid AI宣布推出其最新基础模型LFM2.5-230M,这是一款参数规模仅为2.3亿的非Transformer架构模型。与当前主流的Transformer模型不同,LFM2.5-230M基于状态空间模型与液态神经网络连续时间公式构建。尽管体积...

Read More
2026-06-23 talkingdev

资深工程师必读:一文读懂大语言模型的内核——Transformer架构深度解析

大型语言模型(LLM)的核心架构是Transformer,它通过引入自注意力机制,从根本上解决了传统循环神经网络(RNN)在处理长序列数据时面临的顺序计算瓶颈与长距离信息衰减问题。本文深入剖析了Transformer的各个关键组...

Read More
2026-06-06 talkingdev

ICLR 2026最佳论文揭晓:Transformer模型天生具备简洁性

在人工智能顶级会议ICLR 2026上,一篇题为《Transformer are inherently succinct》的论文被评选为三篇杰出论文之一。该研究从理论层面深入论证了Transformer架构在本质上具有简洁性(succinctness),即模型能够在...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page