漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-28 talkingdev

Cohere发布Parse文档智能模型:支持9种语言,每千页仅1.5美元

Cohere 推出 Parse 文档智能解析服务,可将复杂多模态文件(如文档、表格、图像)转换为结构化、机器可读的数据。该服务基于高成本效益的视觉语言模型,面向企业大规模文档处理场景,能够检测并理解关键视觉元素,并...

Read More
2026-08-17 talkingdev

阿里Qwen 3.8 27B发布:17GB开源通用模型实现长上下文、工具调用、视觉与代码生成突破

近日,阿里巴巴Qwen研究实验室正式发布Qwen 3.8 27B,这是一款采用Apache 2.0许可的270亿参数开源大语言模型,开放权重约17GB。据知名开发者Simon Willison介绍,该模型在中等参数规模下集成了长上下文处理、高效工...

Read More
2026-08-11 talkingdev

开源|Qwen-MM-Plugins发布:让任意智能体原生多模态化

阿里巴巴通义千问团队在GitHub上正式开源了Qwen-MM-Plugins项目,这是一个专为Qwen模型设计的原生多模态插件集合。该项目的核心目标是让任意基于大模型的智能体能够直接“看”懂多种模态信息,而不仅仅局限于文本交互...

Read More
2026-08-11 talkingdev

开源|antirez发布h3-metal:将MiniMax H3原生推理引擎搬上Mac,M3 Max/M5 Max获极致Metal优化

知名开发者antirez(Redis之父)在GitHub上推出了新项目h3-metal,将MiniMax最新的H3模型原生带入苹果芯片生态。该项目并非简单的模型移植,而是一个完全面向Apple Silicon的推理引擎,当前已支持prompt直接生成视频...

Read More
2026-07-31 talkingdev

Thinking Machines发布Inkling-Small:仅四分之一规模,多模态推理能力不打折

人工智能公司Thinking Machines正式推出开源权重模型Inkling-Small,以更小的体量实现了与Inkling相当的性能。该模型采用混合专家架构,总参数量达276B,但每次推理仅激活12B参数,大幅降低算力需求。Inkling-Small...

Read More
2026-07-29 talkingdev

微软推出轻量级多模态模型家族Mage:4B参数实现高效训练与部署

微软研究团队近期发布了Mage,一个专为研究场景设计的轻量级多模态模型家族。该系列模型严格遵循40亿参数的固定预算,在保持紧凑架构的同时,性能足以比肩规模大得多的开源系统。Mage包含两大核心成员:Mage-VL和Mag...

Read More
2026-07-24 talkingdev

微软发布MAI-Image-2.5-Pro与MAI-Voice-2-Flash:高保真图像生成和超低延迟语音模型正式公开预览

微软正式推出两款全新自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进一步强化其在多模态生成领域的布局。MAI-Image-2.5-Pro专注于高保真图像生成与编辑,能够根据复杂文本描述生成细节丰富、构图精准的高质...

Read More
2026-07-16 talkingdev

Thinking Machines推出9750亿参数开源权重模型Inkling:混合专家架构,多模态推理可控

人工智能公司Thinking Machines正式发布了其首个开放权重模型Inkling。这是一个参数规模高达9750亿的混合专家(Mixture-of-Experts)Transformer模型,原生支持文本、图像和音频的多模态输入与理解。Inkling最引人注...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page