漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-25 talkingdev

安全预警:LLM可能通过推理引擎漏洞反控宿主机

承载前沿大语言模型(LLM)的宿主机正成为高价值攻击目标。这类机器不仅拥有运行先进模型所需的GPU算力,还能直接访问模型权重,并在数据中心内具备比普通互联网主机更高的特权。最新研究指出,LLM可以生成特定token...

Read More
2026-08-25 talkingdev

Hot Chips 2026:CUDA瞄准RISC-V,英伟达为开源芯片打开GPU计算大门

英伟达在Hot Chips 2026上释放重要信号:CUDA生态正计划向RISC-V架构延伸。长期以来,GPU加速计算的主机端主要围绕x86-64与aarch64,而CUDA对RISC-V的支持有望让RISC-V处理器成为GPU计算任务的“入口”,从而丰富数据...

Read More
2026-08-25 talkingdev

AI任务商品化临界点:模型超过“最大必要智能”后,竞争转向成本与分发

随着大模型能力不断突破,一项AI任务一旦被模型超越其“最大必要智能”阈值,该任务的智能供给就不再稀缺,而会迅速商品化。此时市场竞争从模型本身的能力高低,转向成本、响应延迟、基础设施稳定性和分发渠道效率。对...

Read More
2026-08-25 talkingdev

匿名AI模型Ox Alpha四天处理26万亿token,刷新OpenRouter首发纪录

近日,匿名编码模型Ox Alpha在OpenCode平台上创下惊人使用纪录:上线前四天,用户累计处理了26万亿个token,吸引327,000名独立用户,并完成8,328,244个会话。该模型目前通过兼容OpenAI的接口免费开放,开发者可以便...

Read More
2026-08-25 talkingdev

NVIDIA Groq 3 LPX AI推理加速芯片全面量产,Vera Rubin迎来史上最快Token生成速度

NVIDIA的Groq 3 LPX AI推理加速芯片现已进入全面量产阶段。Groq 3 LPX机架作为NVIDIA Vera Rubin平台的扩展,显著提升了AI推理能力,能够为响应敏感型智能体(Agentic)工作负载提供超高速的Token生成表现。在面向智...

Read More
2026-08-25 talkingdev

中国关联黑客组织加速AI网络攻击:DeepSeek与Kimi K3成主要工具

据彭博社报道,安全研究人员发现,多个被认为具有中国国家背景的黑客组织正越来越多地将DeepSeek、Kimi K3等开源权重大语言模型整合到网络攻击行动中,用于生成钓鱼邮件、辅助恶意代码开发、开展目标侦察与情报分析...

Read More
2026-08-25 talkingdev

OpenAI恢复ChatGPT Plus用户Codex和Work五小时使用限制,官方称为平滑算力负载

据9to5Mac报道,OpenAI宣布恢复对ChatGPT Plus用户Codex与Work功能的五小时使用限制,结束了此前数周仅按周总量进行管控的宽松阶段。OpenAI表示,此举旨在平滑其算力负载,避免突发高并发请求对推理集群造成冲击。Co...

Read More
2026-08-25 talkingdev

苹果新款Mac mini最快下月登场:抢先iPhone发布会,已测试M5/M6芯片

据彭博社记者Mark Gurman报道,知情人士透露苹果公司正准备推出近两年来首款全新Mac mini台式电脑,发布时间可能早于9月的iPhone特别活动。更值得关注的是,苹果已在内部测试搭载M5和M6芯片的版本,这暗示新款Mac mi...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page