漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-20 talkingdev

Netflix 自研内部 LLM 推理平台:基于 vLLM 与 Triton 的统一服务架构,实现高效模型部署与 A/B 测试

Netflix 近期公开了其内部自研的大语言模型(LLM)推理服务平台的设计与实践。与依赖外部托管 API 不同,该平台将模型部署和推理完全集成到 Netflix 现有的生产环境中,既保障了数据安全与低延迟,又实现了对模型的...

Read More
2026-06-27 talkingdev

OpenAI 预览 GPT-5.6 Sol:下一代模型在编程、科学和网络安全领域能力大幅跃升

OpenAI 正式对外预览了其下一代旗舰模型——GPT-5.6 Sol。这一模型不仅在编程、科学研究和网络安全等关键领域展现出显著增强的能力,更引人关注的是,它首次搭载了OpenAI迄今最先进的安全栈。从技术层面看,GPT-5.6 So...

Read More
2026-05-04 talkingdev

开源|AutoRound:10分钟单GPU搞定7B大模型量化,极致压缩精度不减

在大型语言模型(LLM)和视觉语言模型(VLM)部署中,模型量化是降低计算和存储成本的关键技术。然而,传统量化方法往往需要在模型大小和推理精度之间做出艰难取舍,尤其是在超低位宽(如2-bit、3-bit)下,精度损失...

Read More
2026-04-06 talkingdev

开源|Gemma Gem:首个完全在设备端通过WebGPU运行谷歌Gemma 4模型的浏览器扩展

近日,GitHub上出现了一个名为Gemma Gem的开源项目,它是一个Chrome浏览器扩展,能够将谷歌最新发布的Gemma 4大型语言模型完全在用户本地设备上运行。该项目最大的技术亮点在于,它通过新兴的WebGPU API来实现高性能...

Read More
2026-04-02 talkingdev

开源|富士通发布OneComp:面向大语言模型的后训练量化开源库

富士通研究院近日开源了名为“OneCompression”(简称OneComp)的Python库,这是一个专门用于大语言模型后训练量化的工具。该库集成了当前最先进的量化算法,包括GPTQ和DBF,旨在帮助开发者和研究人员高效地将庞大的LL...

Read More
2026-02-28 talkingdev

OpenAI与五角大楼达成合作,将AI模型部署至美军涉密网络

据多方信源证实,人工智能领域的领军企业OpenAI已与美国国防部(五角大楼)达成一项重要协议,计划将其先进的人工智能模型部署至美国军方的涉密网络环境中。这一合作标志着生成式AI技术正加速进入国家级安全与国防应...

Read More
2026-02-27 talkingdev

Anthropic CEO公开表态:坚守AI安全底线,拒绝为国防部移除模型防护

人工智能安全领域的领先公司Anthropic近日就其与美国国防部的合作讨论发表公开声明。该公司CEO达里奥·阿莫代伊明确表示,Anthropic坚信AI技术在捍卫美国及其他民主国家安全、对抗专制对手方面具有重要价值,因此已主...

Read More
2026-02-20 talkingdev

开源|StepFun发布前沿开源模型Step 3.5 Flash:高效推理与智能体能力新标杆

近日,StepFun正式发布了其前沿开源基础模型Step 3.5 Flash。该模型定位为高效、高速推理与具备智能体(Agent)能力的先进模型,其核心特性在于集成了工具使用、长上下文处理以及支持本地部署等关键能力。Step 3.5 F...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page