漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-01 talkingdev

OpenAI重消费轻开发,Anthropic靠AI编程工具实现营收与估值反超

据《华尔街日报》援引消息人士报道,OpenAI在营收增长和公司估值上正被竞争对手Anthropic逐渐甩开,原因在于其过度押注消费者聊天机器人和各类博眼球的副项目,而忽视了悄然爆发的AI编程工具机遇。知情人士透露,当O...

Read More
2026-07-31 talkingdev

MiniMax发布H3开源模型:首创文图视音统一上下文,直出2K立体声视频

MiniMax正式推出开源模型H3,首次在单一模型中打破了任务与模态的边界,实现了文本、图像、视频和音频的统一理解与生成。H3不再是简单的多模态拼接,而是在统一上下文中进行深层语义融合,尤其在视频生成领域带来了...

Read More
2026-07-24 talkingdev

微软发布MAI-Image-2.5-Pro与MAI-Voice-2-Flash:高保真图像生成和超低延迟语音模型正式公开预览

微软正式推出两款全新自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进一步强化其在多模态生成领域的布局。MAI-Image-2.5-Pro专注于高保真图像生成与编辑,能够根据复杂文本描述生成细节丰富、构图精准的高质...

Read More
2026-07-24 talkingdev

开源|吴恩达团队发布OpenWorker:本地桌面AI同事,跨文件跨应用自主完成任务

人工智能领军人物吴恩达(Andrew Ng)在GitHub上开源了一个名为OpenWorker的新项目。该项目旨在构建一个运行在本地桌面端的AI同事,它能够理解用户指令,自主跨越不同的文件、文件夹乃至桌面应用程序来执行复杂工作...

Read More
2026-07-22 talkingdev

通义千问发布Qwen-Image-3.0图像生成模型:支持4.5k token输入,原生渲染12种语言

阿里巴巴通义千问团队近日正式推出第三代基础图像生成模型Qwen-Image-3.0,在内容丰富度、细节真实感和世界知识融合方面实现全面升级。该模型支持最高4.5k token的文本输入,能够精准理解复杂长文本的语义,并生成富...

Read More
2026-07-17 talkingdev

LM Studio 发布 Bionic:面向开放模型的 AI 代理,本地云端无缝切换

知名本地大模型运行平台 LM Studio 正式推出 AI 代理 Bionic,专门为开放模型打造的智能助手,覆盖编码、研究和文档管理等多种生产力场景。Bionic 最大的特点在于架构灵活性:用户既可以选择在本地设备上完全离线运...

Read More
2026-07-17 talkingdev

Wispr Flow:让语音输入秒杀键盘,AI 应用的“嘴”替时代来了

当我们还在为向 ChatGPT 或 Claude 输入一段精准提示词而反复斟酌措辞时,一款名为 Wispr Flow 的工具正试图让键盘成为次选项。它并非简单的语音转文字,而是专为 AI 交互打造的流式语音输入引擎,支持用自然口语一...

Read More
2026-07-14 talkingdev

开源|LHTB:用密集奖励评分考验AI智能体长期终端工作能力

在大型语言模型(LLM)驱动的AI智能体日益普及的今天,如何可靠地评估其在长时间、多步骤任务中的实际生产力,仍是行业面临的核心挑战。GitHub上最新发布的开源项目LHTB(Long-Horizon Terminal Benchmark)正试图填...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page