NVIDIA在Hugging Face平台推出DeepSeek-V4-Pro-0813-NVFP4量化模型,该模型是DeepSeek-V4-Pro-0813的量化版本,采用自回归混合专家(MoE)语言模型架构。通过NVIDIA Model Optimizer量化后,模型在保持高级推理能力...
Read More据彭博社报道,安全研究人员发现,多个被认为具有中国国家背景的黑客组织正越来越多地将DeepSeek、Kimi K3等开源权重大语言模型整合到网络攻击行动中,用于生成钓鱼邮件、辅助恶意代码开发、开展目标侦察与情报分析...
Read More据《华尔街日报》援引知情人士消息,英伟达正计划利用与初创公司Poolside达成的约60亿美元协议,推动构建开放权重(open-weight)AI模型,以直接对标DeepSeek、Kimi等中国模型。该协议被视为一项覆盖面广泛的合作,...
Read More随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...
Read MoreDeepSeek Harness 已进入开发者预览阶段,为开发者提供面向智能体(Agent)编排的模块化插件系统。该平台将模型接入、工具调用、任务调度等关键能力抽象为可替换、可扩展的插件,开发者可以按需组合,显著提升构建复...
Read More近日,Netlify 公布了一项面向 AI 模型选型的横向测试:通过 OpenRouter 接入 DeepSeek、Qwen、Kimi、GLM 等 11 款主流模型,使用同一段构建提示词生成静态咖啡店网站,并比较输出质量与积分消耗。结果显示,模型间...
Read More据《华尔街日报》报道,美国企业正经历一场从“tokenmaxxing”(最大化消耗Token)到“thrift-maxxing”(极致节俭)的重大策略转向。越来越多的公司不再单纯依赖 OpenAI 和 Anthropic 的高端模型,而是开始将更便宜的中...
Read More彭博社报道揭示了一个正在重塑全球AI竞争格局的关键数据:在主流大模型路由平台OpenRouter上,来自中国的AI模型已经贡献了美国企业约60%的Token使用量。这意味着,无论从模型调用频次还是实际算力消耗来看,中国大模...
Read More