AI芯片架构正沿不同技术路线加速分化。英伟达GPU强调可编程性与可扩展架构,在通用AI训练和推理生态中保持主导;谷歌TPU采用专用化设计,针对矩阵乘法进行深度优化,以更高能效支撑大规模深度学习负载;AMD Instinct...
Read More据 The Information 援引知情人士消息,英伟达正洽谈参与 AI 搜索公司 Perplexity 的新一轮股权融资,本轮投后估值可能超过 300 亿美元。除资金支持外,英伟达还曾考虑与 Perplexity 达成技术许可合作,并吸纳其部分...
Read More据《华尔街日报》援引知情人士消息,英伟达正计划利用与初创公司Poolside达成的约60亿美元协议,推动构建开放权重(open-weight)AI模型,以直接对标DeepSeek、Kimi等中国模型。该协议被视为一项覆盖面广泛的合作,...
Read MoreTaoLive团队针对直播电商数字人代理的实时性与适应性矛盾,提出Harness-Aware Training(HAT)后训练方法。其核心是将技能、钩子、系统提示和工具模式从模型权重中解耦,使运行时行为可随业务策略变化而无需重新训练...
Read More在大模型自回归推理过程中,KV缓存用于保存每个请求的注意力键值对,避免每一步解码都重新计算。但随着序列长度增加,KV缓存会线性膨胀,长上下文场景下甚至会消耗比模型权重更多的GPU显存,成为稀缺资源。更严重的...
Read More据英国《金融时报》援引知情人士消息,北京近期允许字节跳动和腾讯在中国大陆的数据中心设施中分别接收约1万颗英伟达H200芯片。此举被视为在先进AI芯片对华出口持续受限的背景下,监管部门以小批量、定向放行的方式...
Read More在近期一场聚焦GPU优化的自动研究竞赛中,参赛者针对批量方阵compact-Householder QR分解(qr_v2)问题展开优化,最终在GPU Mode的qr_v2任务上实现了相对基线高达232倍的内核加速,并在183名参与者中位列第12。该项...
Read More英伟达与OpenAI正接近敲定一项围绕美国俄亥俄州大型数据中心园区的财务安排。根据最新协议,英伟达将为该项目第一阶段提供财务担保,对应电力规模约5吉瓦;OpenAI则需在后续阶段自行决定剩余部分的融资方式和节奏。...
Read More