漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-08 talkingdev

开源|OpenScreen:免费开源GPU加速录屏工具,支持Windows/macOS/Linux且无水印无订阅

OpenScreen是一个在GitHub上开放源码的桌面录屏项目,面向Windows、macOS和Linux三大平台,主打无水印、无订阅的屏幕录制体验。该项目采用GPU加速录制,能够降低视频编码过程中的性能占用,适合开发者、产品经理和内...

Read More
2026-09-08 talkingdev

开源|CVE MCP Server:为Claude接入27种安全情报工具,统一漏洞分析与威胁情报

CVE MCP Server 是一款面向模型上下文协议(MCP)生态的安全情报聚合服务器,旨在为 Claude 等 AI 智能体提供统一、可编程的漏洞研究与威胁情报增强能力。该服务器将 27 种安全情报工具和 21 个 API 封装在 MCP 之后...

Read More
2026-09-08 talkingdev

vLLM在AMD GPU上的推测解码实践:MTP、EAGLE-3、DFlash与DSpark性能调优指南

vLLM团队发布了一份关于在AMD GPU上使用推测解码(Speculative Decoding)的实用指南。推测解码允许vLLM在单次目标模型传递中验证多个草稿token,同时保持目标模型的输出行为不变,有望显著提升推理效率。该指南基于...

Read More
2026-09-08 talkingdev

Vortex 实现从 S3 到 GPU 的单次拷贝,演示扫描性能较 Parquet 快约 30 倍

在 QCon London 2026 上,SpiralDB 团队展示了 Vortex 如何将压缩列式数据从 S3 直接流式传输到 GPU 内存,全程仅需一次拷贝。相比传统方案先将数据落盘或依赖 CPU 解压,Vortex 的列式布局能够在传输前对数据进行裁...

Read More
2026-09-08 talkingdev

开源|Qwen-Drive-1.0:打通感知、语言与规划的自动驾驶视觉语言基础模型

QwenLM团队在GitHub开源了Qwen-Drive-1.0项目,定位为面向自动驾驶的视觉语言基础模型。该项目采用分阶段训练策略,将感知、语言理解和规划目标融合到统一框架中,使模型既能获得专业驾驶能力,又能保留广泛的视觉理...

Read More
2026-09-08 talkingdev

开源|Google发布Accelerator Agents:用Gemini将PyTorch工作负载迁至JAX并优化TPU内核

Google在GitHub开源了Accelerator Agents工具包,面向Google Cloud TPU开发场景,利用Gemini模型帮助开发者将PyTorch工作负载迁移到JAX,并优化自定义内核。该工具包包含MaxCode和MaxKernel两个核心模块:MaxCode负...

Read More
2026-09-08 talkingdev

谷歌TPUv7 Ironwood第三方推理首测:FP8每美元性能较B200/B300最高提升50%

谷歌TPUv7 Ironwood的第三方推理结果首次在InferenceX官方预览中亮相。在与Nvidia B200/B300进行同口径FP8对比时,Ironwood每美元性能最高可领先50%,意味着单位成本下能够提供明显更强的推理吞吐。值得关注的是,Ir...

Read More
2026-09-08 talkingdev

AI代理被工具输出“背刺”?ARMO:提示注入其实是两个事件,你的屏幕只读到一个

随着AI代理越来越多地调用外部工具并消费返回结果,工具输出已成为提示注入的新攻击面。ARMO最新分析指出,隐藏在工具结果中的恶意指令之所以能绕过常规防护,核心原因是输入检查与动作检查分别发生在代理循环的不同...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page