承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...
Read More英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...
Read More随着大模型能力不断突破,一项AI任务一旦被模型超越其“最大必要智能”阈值,该任务的智能供给就不再稀缺,而会迅速商品化。此时市场竞争从模型本身的能力高低,转向成本、响应延迟、基础设施稳定性和分发渠道效率。对...
Read More近日,匿名编码模型Ox Alpha在OpenCode平台上创下惊人使用纪录:上线前四天,用户累计处理了26万亿个token,吸引327,000名独立用户,并完成8,328,244个会话。该模型目前通过兼容OpenAI的接口免费开放,开发者可以便...
Read MoreNVIDIA的Groq 3 LPX AI推理加速芯片现已进入全面量产阶段。Groq 3 LPX机架作为NVIDIA Vera Rubin平台的扩展,显著提升了AI推理能力,能够为响应敏感型智能体(Agentic)工作负载提供超高速的Token生成表现。在面向智...
Read More据彭博社报道,安全研究人员发现,多个被认为具有中国国家背景的黑客组织正越来越多地将DeepSeek、Kimi K3等开源权重大语言模型整合到网络攻击行动中,用于生成钓鱼邮件、辅助恶意代码开发、开展目标侦察与情报分析...
Read More据9to5Mac报道,OpenAI宣布恢复对ChatGPT Plus用户Codex与Work功能的五小时使用限制,结束了此前数周仅按周总量进行管控的宽松阶段。OpenAI表示,此举旨在平滑其算力负载,避免突发高并发请求对推理集群造成冲击。Co...
Read More据彭博社记者Mark Gurman报道,知情人士透露苹果公司正准备推出近两年来首款全新Mac mini台式电脑,发布时间可能早于9月的iPhone特别活动。更值得关注的是,苹果已在内部测试搭载M5和M6芯片的版本,这暗示新款Mac mi...
Read More