漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-24 talkingdev

AI芯片架构竞赛升级:英伟达、谷歌TPU、AMD Instinct与Cerebras晶圆级引擎分化演进

AI芯片架构正沿不同技术路线加速分化。英伟达GPU强调可编程性与可扩展架构,在通用AI训练和推理生态中保持主导;谷歌TPU采用专用化设计,针对矩阵乘法进行深度优化,以更高能效支撑大规模深度学习负载;AMD Instinct...

Read More
2026-08-24 talkingdev

传英伟达拟投资 Perplexity,新一轮估值或超 300 亿美元并考虑技术授权与人才引进

据 The Information 援引知情人士消息,英伟达正洽谈参与 AI 搜索公司 Perplexity 的新一轮股权融资,本轮投后估值可能超过 300 亿美元。除资金支持外,英伟达还曾考虑与 Perplexity 达成技术许可合作,并吸纳其部分...

Read More
2026-08-23 talkingdev

英伟达被曝拟借60亿美元交易联手Poolside打造开放权重模型,对标DeepSeek与Kimi

据《华尔街日报》援引知情人士消息,英伟达正计划利用与初创公司Poolside达成的约60亿美元协议,推动构建开放权重(open-weight)AI模型,以直接对标DeepSeek、Kimi等中国模型。该协议被视为一项覆盖面广泛的合作,...

Read More
2026-08-21 talkingdev

论文推荐|TaoLive提出Harness感知训练:35B数字人直播代理实时适应可变接口,P50延迟仅3.4秒

TaoLive团队针对直播电商数字人代理的实时性与适应性矛盾,提出Harness-Aware Training(HAT)后训练方法。其核心是将技能、钩子、系统提示和工具模式从模型权重中解耦,使运行时行为可随业务策略变化而无需重新训练...

Read More
2026-08-21 talkingdev

PagedAttention:用虚拟内存破解KV缓存碎片化,大模型GPU并发推理提升2-4倍

在大模型自回归推理过程中,KV缓存用于保存每个请求的注意力键值对,避免每一步解码都重新计算。但随着序列长度增加,KV缓存会线性膨胀,长上下文场景下甚至会消耗比模型权重更多的GPU显存,成为稀缺资源。更严重的...

Read More
2026-08-19 talkingdev

消息称北京放行字节跳动与腾讯各采购约1万颗英伟达H200芯片

据英国《金融时报》援引知情人士消息,北京近期允许字节跳动和腾讯在中国大陆的数据中心设施中分别接收约1万颗英伟达H200芯片。此举被视为在先进AI芯片对华出口持续受限的背景下,监管部门以小批量、定向放行的方式...

Read More
2026-08-17 talkingdev

Codex辅助自动研究:GPU Mode qr_v2问题实现232倍内核加速

在近期一场聚焦GPU优化的自动研究竞赛中,参赛者针对批量方阵compact-Householder QR分解(qr_v2)问题展开优化,最终在GPU Mode的qr_v2任务上实现了相对基线高达232倍的内核加速,并在183名参与者中位列第12。该项...

Read More
2026-08-17 talkingdev

英伟达大幅缩减OpenAI俄亥俄数据中心担保:从2500亿降至不到1200亿美元

英伟达与OpenAI正接近敲定一项围绕美国俄亥俄州大型数据中心园区的财务安排。根据最新协议,英伟达将为该项目第一阶段提供财务担保,对应电力规模约5吉瓦;OpenAI则需在后续阶段自行决定剩余部分的融资方式和节奏。...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page