漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

Vals分析:开源模型执行多阶段任务的环境影响可达简单查询1万倍

AI基准测试机构Vals AI的最新分析显示,开源权重模型在执行多阶段任务时,其环境代价可能远超简单查询。以构建一个Web应用为例,这类复杂任务涉及多轮推理、代码生成、工具调用与验证等步骤,模型需要消耗的能源或水...

Read More
2026-08-25 talkingdev

中国关联黑客组织加速AI网络攻击:DeepSeek与Kimi K3成主要工具

据彭博社报道,安全研究人员发现,多个被认为具有中国国家背景的黑客组织正越来越多地将DeepSeek、Kimi K3等开源权重大语言模型整合到网络攻击行动中,用于生成钓鱼邮件、辅助恶意代码开发、开展目标侦察与情报分析...

Read More
2026-08-19 talkingdev

GLM-5.3 API上线:每百万token 1.4/4.4美元,开源权重并列全球第一

z.ai 正式通过 API 发布 GLM-5.3 模型,沿用上一代 GLM-5.2 的定价,输入和输出费用分别为每百万 token 1.4 美元和 4.4 美元。据 Artificial Analysis 评估,GLM-5.3 与月之暗面 Kimi K3 并列全球性能最强的开源权重...

Read More
2026-08-10 talkingdev

模型基因组:给大模型做个“DNA鉴定”,一眼看穿是否从零训练

在开源大语言模型百花齐放的今天,一个模型究竟是真正从零开始预训练,还是基于现有开源权重衍生微调,常让外界难以分辨。Hugging Face社区发布的“Model Genome”项目,首次提出用类似生物基因指纹的方式为模型“验明...

Read More
2026-08-05 talkingdev

论文推荐|DiffusionGemma:基于离散扩散的超高速语言模型,单卡H100每秒生成1500 Token

来自Google的研究团队发布了DiffusionGemma技术报告,提出了一种实验性的开源权重语言模型,通过离散扩散生成文本,速度远超传统自回归模型。DiffusionGemma并未从零训练,而是在专家混合架构Gemma 4(激活参数38亿...

Read More
2026-07-31 talkingdev

开源权重LLM在生命科学监管任务中准确率比肩闭源模型,成本仅三分之一

一项针对生命科学临床与监管场景的基准测试ClinReg显示,开源权重大语言模型在准确率上已追平顶尖闭源模型。测试中,GLM 5.2、Kimi K3等开源模型在监管和临床任务上的表现与GPT 5.6 Sol等商业模型的差异落在一个标准...

Read More
2026-07-31 talkingdev

Thinking Machines发布Inkling-Small:仅四分之一规模,多模态推理能力不打折

人工智能公司Thinking Machines正式推出开源权重模型Inkling-Small,以更小的体量实现了与Inkling相当的性能。该模型采用混合专家架构,总参数量达276B,但每次推理仅激活12B参数,大幅降低算力需求。Inkling-Small...

Read More
2026-07-24 talkingdev

Kimi K3 设计奥秘藏于思维痕迹:思考令牌量暴增 12 倍,链式思维模拟智能体迭代

Moonshot AI 最新开源权重模型 Kimi K3 在单次前端竞技场(Frontend Arena)中以 1392 的 Elo 分夺得第一,排名较 Kimi K2.6 上升了 10 位,较 Kimi K2.7 Code 上升了 16 位,创下 Moonshot 模型史上最大跃升记录。...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page