漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-28 talkingdev

SGLang Diffusion加持:MiniMax-H3视频生成在8×H200上无损提速1.95倍,最高6.24倍

LMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...

Read More
2026-08-27 talkingdev

英伟达下季度营收指引达1080亿美元:年化营收将冲4320亿,应收账款天数升至60天

英伟达(NVIDIA)最新业绩指引显示,下季度营收将达到1080亿美元,首次站上单季千亿美元台阶;按此年化计算,全年营收约4320亿美元,有望成为全球收入第六大公司。公司认为其业务比以往更健康、更多元化。不过,数据...

Read More
2026-08-26 talkingdev

Dylan Patel:OpenAI与Anthropic或将在2028年掌控全球大部分可用AI算力

Dylan Patel在访谈中分析,OpenAI与Anthropic正凭借将单位算力(FLOPs)转化为可预测收入的能力,在GPU、数据中心和能源合同的竞价中持续获得优势,预计到2028年可能掌控全球大多数可用AI算力。他认为,AI资本开支急...

Read More
2026-08-26 talkingdev

Perplexity联合Nvidia推出Portable Computer:完全本地运行的AI智能体,零Token成本

Perplexity正式发布Portable Computer,这是其智能体计算平台的一个本地化版本,目标是将AI代理任务完全运行在用户自有硬件上。该方案与Nvidia合作,可部署在DGX Spark及RTX系列Linux设备上,模型、用户数据和工作内...

Read More
2026-08-25 talkingdev

安全预警:LLM可能通过推理引擎漏洞反控宿主机

承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...

Read More
2026-08-25 talkingdev

Hot Chips 2026:CUDA瞄准RISC-V,英伟达为开源芯片打开GPU计算大门

英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...

Read More
2026-08-25 talkingdev

OpenAI恢复ChatGPT Plus用户Codex和Work五小时使用限制,官方称为平滑算力负载

据9to5Mac报道,OpenAI宣布恢复对ChatGPT Plus用户Codex与Work功能的五小时使用限制,结束了此前数周仅按周总量进行管控的宽松阶段。OpenAI表示,此举旨在平滑其算力负载,避免突发高并发请求对推理集群造成冲击。Co...

Read More
2026-08-25 talkingdev

英伟达支持的AI云服务商Lambda被曝寻求融资30亿美元,估值或超120亿

据彭博社援引知情人士消息,英伟达投资的AI云计算公司Lambda Inc.正在洽谈一轮最高30亿美元的融资,估值可能超过120亿美元,其今年营收预计将达到15亿美元以上。Lambda是典型的“新云”(neocloud)服务商,主要提供面...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page