漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-12 talkingdev

英伟达发布Switchyard路由器:AI模型可在任务中途动态切换,自测任务成本降至三分之一

英伟达推出了全新的Nemotron 3.5 Lightning模型和NeMo Switchyard开源库,旨在大幅降低AI代理的推理成本并提升效率。Nemotron 3.5 Lightning是一个拥有300亿参数的混合专家模型(MoE),专为高吞吐量的专用代理任务...

Read More
2026-08-11 talkingdev

开源|Qwen-MM-Plugins发布:让任意智能体原生多模态化

阿里巴巴通义千问团队在GitHub上正式开源了Qwen-MM-Plugins项目,这是一个专为Qwen模型设计的原生多模态插件集合。该项目的核心目标是让任意基于大模型的智能体能够直接“看”懂多种模态信息,而不仅仅局限于文本交互...

Read More
2026-08-07 talkingdev

阿里Qwen下一代开源模型将向商业大户抽成,月之暗面Kimi K3已率先收取30%收入分成

路透社援引知情人士消息称,阿里巴巴正酝酿对其下一代Qwen开源大模型采取商业化分成策略,计划向重度商业用户要求分享一部分收入。这一举措标志着国产开源模型从完全免费走向可持续变现的重要转向。与此同时,月之暗...

Read More
2026-08-03 talkingdev

Qwen3.8-Max震撼登场:2.4万亿参数重新定义编码与协作的极限

通义千问团队正式发布了其新一代旗舰模型Qwen3.8-Max,该模型以惊人的2.4万亿参数量,在编码、办公协同、深度研究及长周期任务处理等多个维度实现了代际跨越。不同于仅能提供简单问答的常规模型,Qwen3.8-Max展现出...

Read More
2026-07-30 talkingdev

Escha-W2:将35B混合专家模型压缩至12.3GB,单张消费级GPU即可本地运行

EschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...

Read More
2026-07-22 talkingdev

通义千问发布Qwen-Image-3.0图像生成模型:支持4.5k token输入,原生渲染12种语言

阿里巴巴通义千问团队近日正式推出第三代基础图像生成模型Qwen-Image-3.0,在内容丰富度、细节真实感和世界知识融合方面实现全面升级。该模型支持最高4.5k token的文本输入,能够精准理解复杂长文本的语义,并生成富...

Read More
2026-07-22 talkingdev

中国AI模型已占OpenRouter美国企业六成Token用量,技术封锁恐反噬本土生态

彭博社报道揭示了一个正在重塑全球AI竞争格局的关键数据:在主流大模型路由平台OpenRouter上,来自中国的AI模型已经贡献了美国企业约60%的Token使用量。这意味着,无论从模型调用频次还是实际算力消耗来看,中国大模...

Read More
2026-07-20 talkingdev

阿里巴巴宣布2.4万亿参数模型Qwen3.8即将开源,预览版已上线

阿里巴巴通义千问团队正式公布Qwen3.8,这是一款参数规模高达2.4万亿的超大规模语言模型,并明确表示将以开放权重(Open-Weight)的方式面向全球发布。这不仅是Qwen系列模型参数的又一次飞跃,也反映出阿里巴巴在开...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page