漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

微软发布 MAI-Transcribe-2:号称全球最快、最准、最便宜的语音识别模型

微软正式发布 MAI-Transcribe-2 语音识别模型,官方宣称其在速度、准确率和成本方面全面领先,并超越 Gemini 3.5 Transcribe、GPT-Transcribe 和 Whisper V3-Large。该模型集成了说话人分离、可配置转录风格和词级时...

Read More
2026-09-01 talkingdev

谷歌发布TimesFM-3:万亿时间点预训练,多变量预测进入零样本时代

谷歌近日发布TimesFM-3,这是一款拥有3.3亿参数的时间序列基础模型,预训练数据规模超过1万亿个时间点。该模型聚焦零样本预测,可在不进行任务特定微调的情况下对多个目标变量进行联合预测,并支持历史协变量和已知...

Read More
2026-08-31 talkingdev

基础模型不再是瓶颈:GLM5.3与Qwen3.8-27B靠后训练实现家用硬件跑Opus级智能

近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...

Read More
2026-08-21 talkingdev

论文推荐|TaoLive提出Harness感知训练:35B数字人直播代理实时适应可变接口,P50延迟仅3.4秒

TaoLive团队针对直播电商数字人代理的实时性与适应性矛盾,提出Harness-Aware Training(HAT)后训练方法。其核心是将技能、钩子、系统提示和工具模式从模型权重中解耦,使运行时行为可随业务策略变化而无需重新训练...

Read More
2026-08-16 talkingdev

Hugging Face:Qwen衍生模型突破15.1万个,成为开放模型生态最大基础之一

Hugging Face 最新发布的半年度开放模型生态报告显示,开发者基于 Qwen 系列模型已创建超过 151,000 个衍生模型,数量在所有基础模型中位居第一,使 Qwen 成为开放模型生态系统中规模最大、影响力最广的底座之一。报...

Read More
2026-08-11 talkingdev

Meta发布开源智能体模型Muse Glimmer:300亿参数,可在消费级硬件本地运行

Meta旗下超级智能实验室正式推出Muse Glimmer,一个拥有300亿参数的开源智能体模型,采用Apache 2.0许可证。该模型专为消费级硬件上的常驻本地工作流优化,重点面向编程、函数调用和模型评估等场景,并展现出强大的...

Read More
2026-08-07 talkingdev

字节跳动被曝预训练10万亿参数超大模型,规模达Kimi K3的三倍,刷新行业纪录

据《金融时报》援引知情人士消息,TikTok母公司字节跳动正在预训练一个参数量高达10万亿的超大规模人工智能模型。这一数字大约是月之暗面Kimi K3模型参数量的三倍,也超过了Anthropic传闻中Mythos 5约8万亿参数的预...

Read More
2026-07-31 talkingdev

MiniMax发布H3开源模型:首创文图视音统一上下文,直出2K立体声视频

MiniMax正式推出开源模型H3,首次在单一模型中打破了任务与模态的边界,实现了文本、图像、视频和音频的统一理解与生成。H3不再是简单的多模态拼接,而是在统一上下文中进行深层语义融合,尤其在视频生成领域带来了...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page