漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-10 talkingdev

模型基因组:给大模型做个“DNA鉴定”,一眼看穿是否从零训练

在开源大语言模型百花齐放的今天,一个模型究竟是真正从零开始预训练,还是基于现有开源权重衍生微调,常让外界难以分辨。Hugging Face社区发布的“Model Genome”项目,首次提出用类似生物基因指纹的方式为模型“验明...

Read More
2026-08-10 talkingdev

中国AI视频模型横扫全球榜单:前十独占九席,或将在构建世界模型上建立优势

根据人工智能分析机构Artificial Analysis的最新排名,全球排名前十的文生视频模型中,中国AI实验室占据了其中九席,展现出在视频生成领域压倒性的技术集群优势。彭博社评论指出,过去一段时间,外界对中国人工智能...

Read More
2026-08-07 talkingdev

ChatGPT升级GPT-5.6 Sol模型,免费用户畅享无限对话与“思考”功能

OpenAI近日宣布对ChatGPT进行重要更新,核心围绕GPT-5.6 Sol与GPT-5.6 Luna两大模型展开。此次升级显著提升了GPT-5.6 Sol的响应准确性和一致性,使其在事实核查、逻辑推理和专业内容生成等任务上表现更为可靠,背后...

Read More
2026-08-06 talkingdev

Anthropic 组建自研 AI 芯片设计团队,软硬协同加速 Claude 进化

人工智能公司 Anthropic 正式确认计划通过联合设计定制化芯片与 AI 模型,来提升其大语言模型 Claude 的运行速度与计算能效。该公司已开始对外招募芯片设计工程师,旨在现有硬件合作伙伴关系之外,寻求更多底层基础...

Read More
2026-08-06 talkingdev

AI语音赛道融资额一年暴涨7倍,OpenAI和谷歌押注语音成下一代AI代理核心交互界面

根据PitchBook的最新数据,全球AI语音初创公司在2026年第一季度共获得70亿美元融资,而该数字在2025年同期仅为10亿美元,同比增幅高达600%。这一爆发式增长反映出资本对语音赛道的强烈信心,背后推手是人工智能行业...

Read More
2026-08-05 talkingdev

AI基准测试缘何失效?新研究揭示规模才是保持效用的关键

一项针对60个广泛使用的大语言模型基准的系统性研究发现,其中29个已经达到饱和状态,意味着当前顶尖模型在这些测试上的表现已无统计学上的显著差异,无法有效区分模型能力。研究指出,基准测试的年龄和测试集规模是...

Read More
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-08-03 talkingdev

开源|smevals:专为小模型和大模型设计的AI评估框架

大语言模型竞争日益激烈的当下,如何科学、标准化地衡量不同规模模型的能力上限正成为一个核心议题。Prime Radiant公司近日开源的smevals评估框架正是瞄准了这一痛点,它提供了一套轻量且专为小模型和大模型运行基...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page