漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-31 talkingdev

NVIDIA发布DeepSeek-V4-Pro-0813-NVFP4量化模型:MoE架构助力智能体与企业级AI

NVIDIA在Hugging Face平台推出DeepSeek-V4-Pro-0813-NVFP4量化模型,该模型是DeepSeek-V4-Pro-0813的量化版本,采用自回归混合专家(MoE)语言模型架构。通过NVIDIA Model Optimizer量化后,模型在保持高级推理能力...

Read More
2026-08-25 talkingdev

中国关联黑客组织加速AI网络攻击:DeepSeek与Kimi K3成主要工具

据彭博社报道,安全研究人员发现,多个被认为具有中国国家背景的黑客组织正越来越多地将DeepSeek、Kimi K3等开源权重大语言模型整合到网络攻击行动中,用于生成钓鱼邮件、辅助恶意代码开发、开展目标侦察与情报分析...

Read More
2026-08-23 talkingdev

英伟达被曝拟借60亿美元交易联手Poolside打造开放权重模型,对标DeepSeek与Kimi

据《华尔街日报》援引知情人士消息,英伟达正计划利用与初创公司Poolside达成的约60亿美元协议,推动构建开放权重(open-weight)AI模型,以直接对标DeepSeek、Kimi等中国模型。该协议被视为一项覆盖面广泛的合作,...

Read More
2026-08-20 talkingdev

1.6万亿参数DeepSeek-V4-Pro部署新思路:从负载画像到拓扑决策突破推理瓶颈

随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...

Read More
2026-08-14 talkingdev

DeepSeek Harness 开发者预览版发布:一切皆插件,智能体编排全面模块化

DeepSeek Harness 已进入开发者预览阶段,为开发者提供面向智能体(Agent)编排的模块化插件系统。该平台将模型接入、工具调用、任务调度等关键能力抽象为可替换、可扩展的插件,开发者可以按需组合,显著提升构建复...

Read More
2026-08-14 talkingdev

Netlify 同题实测 11 款大模型:DeepSeek V4 Flash 仅 2.4 积分,Claude Opus 5 高价低效?

近日,Netlify 公布了一项面向 AI 模型选型的横向测试:通过 OpenRouter 接入 DeepSeek、Qwen、Kimi、GLM 等 11 款主流模型,使用同一段构建提示词生成静态咖啡店网站,并比较输出质量与积分消耗。结果显示,模型间...

Read More
2026-07-27 talkingdev

美企AI策略急转弯:从“烧Token”到“极致省钱”,混合中国模型冲击OpenAI等实验室IPO估值

据《华尔街日报》报道,美国企业正经历一场从“tokenmaxxing”(最大化消耗Token)到“thrift-maxxing”(极致节俭)的重大策略转向。越来越多的公司不再单纯依赖 OpenAI 和 Anthropic 的高端模型,而是开始将更便宜的中...

Read More
2026-07-22 talkingdev

中国AI模型已占OpenRouter美国企业六成Token用量,技术封锁恐反噬本土生态

彭博社报道揭示了一个正在重塑全球AI竞争格局的关键数据:在主流大模型路由平台OpenRouter上,来自中国的AI模型已经贡献了美国企业约60%的Token使用量。这意味着,无论从模型调用频次还是实际算力消耗来看,中国大模...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page