AMD正式发布了其首款机架级人工智能系统Helios,直接对标英伟达的同类产品,标志着AI基础设施竞赛进入全新阶段。该系统将数据中心级的算力、高速互连与能效优化深度整合在单一机架内,能够为千亿乃至万亿参数大模型...
Read MoreMorph LLM近期发布了一系列针对开源代码生成模型的优化技术,旨在解决当前推理效率瓶颈。首先,团队通过训练一个专注于模型自身编码输出(而非通用互联网数据)的“起草模型”(drafter),在投机解码中取得了显著加速...
Read More近日,一个名为BarraCUDA的开源项目在开发者社区引发广泛关注。该项目旨在实现一个能够将NVIDIA CUDA代码(.cu文件)直接编译为AMD GPU(特别是基于RDNA 3架构、代号GFX11)机器代码的编译器。这一尝试打破了长期以...
Read More根据《华尔街日报》报道,在人工智能技术浪潮的强力驱动下,全球主要芯片制造商在2025年实现了超过4000亿美元的销售额,标志着半导体行业进入了一个由AI需求主导的新增长周期。其中,英伟达凭借其在AI加速器领域的领...
Read More近日,Vercel团队在GitHub上开源了Streamdown项目,这是一个旨在解决AI模型流式输出Markdown内容时特有难题的React库。作为`react-markdown`的直接替代品,Streamdown的核心价值在于其专门针对AI生成内容流式传输过...
Read More业界瞩目的开源AI推理基准测试工具InferenceMAX正式亮相,该工具通过夜间自动化测试对Llama 70B、DeepSeek R1等主流大模型进行持续性能评估。其核心价值在于量化AI推理中的关键权衡:吞吐量(每GPU每秒处理令牌数)...
Read More据彭博社深度报道,OpenAI与英伟达、AMD等科技巨头正在通过复杂的循环交易网络助推人工智能市场估值突破万亿美元。这种企业间相互投资、交叉采购的商业模式引发行业担忧,被认为可能人为制造市场泡沫。具体表现为:A...
Read More人工智能巨头OpenAI与AMD达成战略性合作,计划在未来数年内部署总量达6吉瓦的AMD Instinct系列GPU算力基础设施。首批1吉瓦算力将于2026年底正式投入运营,标志着AMD在AI芯片领域首次获得超大规模订单。若协议全面执...
Read More