漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-03 talkingdev

Cloudflare 利用 Zstandard 与 Pingora 打造缓存转码,缓存占用有望降至三分之一

Cloudflare 近日公开了 Cache Transcoding 原型系统,该系统在缓存写入前对符合条件的 HTML、JSON、CSS 和 JavaScript 资源使用 Zstandard 进行压缩,并在不同缓存层级之间以压缩形态存储和传输。初步测试显示,这些...

Read More
2026-08-29 talkingdev

小米18 Fold折叠屏将首发长鑫LPDDR6内存与自研3nm Xring O3 SoC,9月发布

据路透社报道,小米与国内存储芯片龙头长鑫存储(CXMT)确认,即将发布的旗舰折叠屏手机小米18 Fold将率先搭载长鑫最新LPDDR6 DRAM芯片,并同步首发小米自研3nm Xring O3 SoC,预计9月正式亮相。这是国产DRAM在高端...

Read More
2026-08-29 talkingdev

SK海力士斥资40亿美元在印第安纳州开建先进存储封装厂,2029年下半年量产下一代HBM

据彭博社报道,SK海力士已在印第安纳州为其投资40亿美元的先进存储芯片封装工厂举行奠基仪式,并计划于2029年下半年开始量产下一代高带宽内存(HBM)。该工厂将聚焦存储器封装环节,而封装是HBM堆叠、硅中介层集成及...

Read More
2026-08-26 talkingdev

80亿美元押注AI算力:印度AM Intelligence订购9000套英伟达Vera Rubin系统,拟提供1GW容量

据彭博社报道,印度AI基础设施公司AM Intelligence已向英伟达订购9000套Vera Rubin系统,并计划在总额80亿美元的项目中提供1吉瓦(GW)计算容量。Vera Rubin是英伟达面向下一代AI工作负载推出的高性能计算平台,主要...

Read More
2026-08-24 talkingdev

AI芯片架构竞赛升级:英伟达、谷歌TPU、AMD Instinct与Cerebras晶圆级引擎分化演进

AI芯片架构正沿不同技术路线加速分化。英伟达GPU强调可编程性与可扩展架构,在通用AI训练和推理生态中保持主导;谷歌TPU采用专用化设计,针对矩阵乘法进行深度优化,以更高能效支撑大规模深度学习负载;AMD Instinct...

Read More
2026-08-24 talkingdev

谁为内存成本买单?英伟达(NVDA)还是客户?

英伟达计划将上涨的内存成本转嫁给下游客户,明年出货的AI服务器系统价格预计将上涨超过15%。这一变化的核心在于HBM(高带宽内存)成本持续攀升,而英伟达通过定价策略,把HBM在最终加速器售价中的占比控制在较小范...

Read More
2026-08-20 talkingdev

1.6万亿参数DeepSeek-V4-Pro部署新思路:从负载画像到拓扑决策突破推理瓶颈

随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...

Read More
2026-08-19 talkingdev

消息称北京放行字节跳动与腾讯各采购约1万颗英伟达H200芯片

据英国《金融时报》援引知情人士消息,北京近期允许字节跳动和腾讯在中国大陆的数据中心设施中分别接收约1万颗英伟达H200芯片。此举被视为在先进AI芯片对华出口持续受限的背景下,监管部门以小批量、定向放行的方式...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page