该观点将当前的大语言模型竞争与上世纪90年代的数据库之争进行了历史性类比,揭示了技术基础设施演进的一种深层规律。作者认为,大语言模型正沿着数据库的发展轨迹前进:从最初作为引发行业狂热的前沿技术,逐步演化...
Read More阿里巴巴旗下半导体公司平头哥在世界人工智能大会(WAIC)上宣布,开源其玄铁系列AI芯片的软件栈SAIL。这一举措旨在降低开发者从英伟达CUDA生态迁移的门槛,直指当前AI算力领域被CUDA深度绑定的行业痛点。长期以来,...
Read More据彭博社报道,日本正计划从英伟达采购27,500颗下一代Rubin芯片,用以构建一个面向机器人领域的国产基础人工智能模型。该项目由Noetra牵头,联合软银、索尼及NEC等科技巨头共同推进,被视为日本在“主权AI”战略上的重...
Read More国内人工智能公司 Moonshot 正式推出新一代旗舰多模态模型 Kimi K3,参数规模高达 2.8 万亿,并原生支持 100 万 token 的超长上下文窗口。K3 的亮点不仅在于规模,更在于工程上的深度优化:团队针对长上下文场景大幅...
Read More一项新研究探索了利用稀疏技术高效训练大语言模型的方法,旨在显著减少算力开销的同时保持模型性能。该方案通过引入结构化稀疏与动态剪枝策略,在训练前期识别并冻结低重要性参数,使有效参数量呈指数级下降,从而降...
Read MoreNVIDIA近期通过一篇官方博客深入探讨了数据在构建强大AI智能体中的核心地位,明确指出开放数据和合成数据是推动下一代AI发展的关键要素。随着AI系统日益复杂,特别是需要具备推理、规划和工具调用等高级能力的智能体...
Read More在人工智能代理(AI Agent)技术飞速发展的当下,如何让代理高效、稳定地与各种外部API和服务进行交互,成为推动自动化与智能化落地的关键瓶颈。近日,GitHub上开源的项目Craft Agents OSS(craft-ai-agents/craft-a...
Read More人工智能领域正经历一场深刻的架构变革,从封闭的垂直集成系统向由标准化接口(如Transformer架构和推理API)支撑的模块化生态系统演进。这种架构上的解构使得开源权重模型能够与封闭系统有效竞争,大幅降低成本,同...
Read More