漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-04-03 talkingdev

谷歌DeepMind发布Gemma 4:基于Gemini 3研究的新一代开源推理模型

谷歌DeepMind正式推出了新一代开源模型系列Gemma 4,该系列模型基于其旗舰模型Gemini 3的研究成果构建,被官方称为“迄今为止最智能的开源模型”。Gemma 4的核心优化方向聚焦于复杂的推理能力和智能体(Agent)工作流...

Read More
2026-04-03 talkingdev

开源巨作!Arcee AI发布3990亿参数MoE模型Trinity-Large-Thinking,Apache 2.0许可商用无忧

在ChatGPT于2022年底掀起生成式AI浪潮后,开源大模型的接力棒在多家公司间传递。近日,美国AI初创公司Arcee AI正式发布了其重量级开源模型——Trinity-Large-Thinking。该模型采用混合专家架构,参数量高达3990亿,是...

Read More
2026-04-02 talkingdev

OpenMed突破:仅165美元训练覆盖25个物种的mRNA语言模型,CodnRoBERTa性能显著领先

近日,OpenMed团队在Hugging Face平台发布了一项重要成果,展示了其构建的端到端蛋白质AI全流程。该流程涵盖了蛋白质结构预测、序列设计以及关键的密码子优化环节。研究团队对多种Transformer架构进行了深入的密码子...

Read More
2026-04-02 talkingdev

开源|富士通发布OneComp:面向大语言模型的后训练量化开源库

富士通研究院近日开源了名为“OneCompression”(简称OneComp)的Python库,这是一个专门用于大语言模型后训练量化的工具。该库集成了当前最先进的量化算法,包括GPTQ和DBF,旨在帮助开发者和研究人员高效地将庞大的LL...

Read More
2026-04-02 talkingdev

Arcee AI发布Trinity-Large-Thinking:开源前沿推理模型,为复杂长程智能体而生

人工智能公司Arcee AI近日正式发布了其前沿开源推理模型“Trinity-Large-Thining”。该模型专为处理复杂、长程任务的智能体(Agent)以及多轮工具调用场景而设计,被业界认为是目前中国境外发布的最强大的开源模型之一...

Read More
2026-03-31 talkingdev

开源|谷歌发布TimesFM时间序列基础模型,革新时序预测范式

谷歌研究团队近日在GitHub上开源了TimesFM(Time Series Foundation Model),这是一个预训练的时间序列基础模型,专为时间序列预测任务而设计。该模型采用了一种创新的“分块解码器”风格注意力架构,并在一个大规模...

Read More
2026-03-26 talkingdev

闭源与开源AI的隐秘战场:决定胜负的并非技术差距,而是“货币化鸿沟”

当前人工智能领域正上演一场闭源与开源模式间的激烈竞争。表面上看,开源模型的能力正迅速逼近甚至在某些方面与前沿实验室的闭源模型(如OpenAI、Anthropic等)达到同等水平,这引发了市场对后者高昂估值的质疑。然...

Read More
2026-03-26 talkingdev

英伟达押注!初创公司Reflection欲打造“西方版DeepSeek”,估值剑指250亿美元

由英伟达支持的美国人工智能初创公司Reflection正引领一项重要行动,旨在构建可自由获取的美国本土AI系统。作为少数几家与英伟达关联、致力于构建开源AI模型网络的初创企业之一,Reflection目前正进行融资谈判,计划...

Read More
  1. Prev Page
  2. 4
  3. 5
  4. 6
  5. Next Page