LMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...
Read More英伟达(NVIDIA)最新业绩指引显示,下季度营收将达到1080亿美元,首次站上单季千亿美元台阶;按此年化计算,全年营收约4320亿美元,有望成为全球收入第六大公司。公司认为其业务比以往更健康、更多元化。不过,数据...
Read MoreDylan Patel在访谈中分析,OpenAI与Anthropic正凭借将单位算力(FLOPs)转化为可预测收入的能力,在GPU、数据中心和能源合同的竞价中持续获得优势,预计到2028年可能掌控全球大多数可用AI算力。他认为,AI资本开支急...
Read MorePerplexity正式发布Portable Computer,这是其智能体计算平台的一个本地化版本,目标是将AI代理任务完全运行在用户自有硬件上。该方案与Nvidia合作,可部署在DGX Spark及RTX系列Linux设备上,模型、用户数据和工作内...
Read More承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...
Read More英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...
Read More据9to5Mac报道,OpenAI宣布恢复对ChatGPT Plus用户Codex与Work功能的五小时使用限制,结束了此前数周仅按周总量进行管控的宽松阶段。OpenAI表示,此举旨在平滑其算力负载,避免突发高并发请求对推理集群造成冲击。Co...
Read More据彭博社援引知情人士消息,英伟达投资的AI云计算公司Lambda Inc.正在洽谈一轮最高30亿美元的融资,估值可能超过120亿美元,其今年营收预计将达到15亿美元以上。Lambda是典型的“新云”(neocloud)服务商,主要提供面...
Read More