SpaceX正式宣布收购AI编程工具Cursor,旨在将其庞大的GPU计算资源应用于AI模型训练,以显著提升模型性能并降低训练成本。借助SpaceX在高性能计算基础设施方面的积累,Cursor有望开发出能力更强、效率更高的代码生成...
Read More据科技媒体The Information援引知情人士消息,英伟达已同意向Lancium投资20亿美元,后者正是德克萨斯州Stargate AI超大园区的电力基础设施开发商。Stargate园区由OpenAI与甲骨文等联合推动,被视为全球最具野心的AI...
Read More美国芯片巨头AMD已同意收购多伦多AI芯片创业公司Taalas。这家由前AMD员工及Tenstorrent核心成员创立的公司,专注于将AI模型“硬连线”进定制硅片,从而在前沿推理场景中大幅打破计算与内存瓶颈。与传统依赖通用GPU或庞...
Read More来自Google的研究团队发布了DiffusionGemma技术报告,提出了一种实验性的开源权重语言模型,通过离散扩散生成文本,速度远超传统自回归模型。DiffusionGemma并未从零训练,而是在专家混合架构Gemma 4(激活参数38亿...
Read MoreMistral AI正式发布Shieldstral,这是一款参数量仅为3B的开放权重多模态安全分类器。它能够同时处理文本与图像输入,并在推理时直接接受用自然语言描述的安全策略,无需针对不同政策重新训练模型。尽管体量轻巧,Shi...
Read MoreGoogle Chrome Labs 近日在 GitHub 上开源了一个名为 use-webmcp-tool 的 React Hook,旨在通过实验性的 WebMCP 规范,将应用内部功能以可调用工具的形式暴露给运行在浏览器端的人工智能智能体。该项目的核心创新在...
Read More人工智能初创公司 Liquid AI 近日发布了全新的 LFM2.5-Encoders,这是一系列专门为在 CPU 上执行高效文档级推理而设计的编码器模型。随着企业级应用对长文本处理的需求激增,摆脱对昂贵 GPU 的依赖、实现低成本的边...
Read MoreEschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...
Read More