漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-07 talkingdev

字节跳动被曝预训练10万亿参数超大模型,规模达Kimi K3的三倍,刷新行业纪录

据《金融时报》援引知情人士消息,TikTok母公司字节跳动正在预训练一个参数量高达10万亿的超大规模人工智能模型。这一数字大约是月之暗面Kimi K3模型参数量的三倍,也超过了Anthropic传闻中Mythos 5约8万亿参数的预...

Read More
2026-08-06 talkingdev

Prime Agent开源亮相:自我改进的RLM代理在ARC-AGI-3上首超人类专家

Prime Agent是Prime Intellect发布的一款开源自我改进编码工具,其核心架构围绕递归语言模型(RLM)和持续训练框架(Continual Harness)两大抽象展开。该框架通过更优的上下文管理、多智能体协同与长期评估机制,赋...

Read More
2026-08-06 talkingdev

Anthropic 组建自研 AI 芯片设计团队,软硬协同加速 Claude 进化

人工智能公司 Anthropic 正式确认计划通过联合设计定制化芯片与 AI 模型,来提升其大语言模型 Claude 的运行速度与计算能效。该公司已开始对外招募芯片设计工程师,旨在现有硬件合作伙伴关系之外,寻求更多底层基础...

Read More
2026-08-06 talkingdev

AI语音赛道融资额一年暴涨7倍,OpenAI和谷歌押注语音成下一代AI代理核心交互界面

根据PitchBook的最新数据,全球AI语音初创公司在2026年第一季度共获得70亿美元融资,而该数字在2025年同期仅为10亿美元,同比增幅高达600%。这一爆发式增长反映出资本对语音赛道的强烈信心,背后推手是人工智能行业...

Read More
2026-08-05 talkingdev

AI基准测试缘何失效?新研究揭示规模才是保持效用的关键

一项针对60个广泛使用的大语言模型基准的系统性研究发现,其中29个已经达到饱和状态,意味着当前顶尖模型在这些测试上的表现已无统计学上的显著差异,无法有效区分模型能力。研究指出,基准测试的年龄和测试集规模是...

Read More
2026-08-05 talkingdev

极简却强大:Pi 编码工具凭 4 个工具与千 token 提示夺得性能与成本双冠

在人工智能编码工具日趋复杂化的浪潮中,一款名为 Pi 的工具却以极简设计逆势突围。Pi 仅向用户提供四种工具,且其系统提示词被严格压缩在 1000 个 token 以内。这一看似“缩水”的策略,在多项实际测试中展现出更优的...

Read More
2026-08-05 talkingdev

论文推荐|DiffusionGemma:基于离散扩散的超高速语言模型,单卡H100每秒生成1500 Token

来自Google的研究团队发布了DiffusionGemma技术报告,提出了一种实验性的开源权重语言模型,通过离散扩散生成文本,速度远超传统自回归模型。DiffusionGemma并未从零训练,而是在专家混合架构Gemma 4(激活参数38亿...

Read More
2026-08-04 talkingdev

LLMs奖励专业知识:领域专家比“万金油”更能释放大模型潜能

大型语言模型(LLMs)的普及正在重塑技术工作的完成方式。它们大幅降低了编程、内容生成等任务的入门门槛,让原本技能有限的用户也能产出看似不错的成果,将许多人瞬间转变为“通才”式的多面手。然而,一项最新分析指...

Read More
  1. Prev Page
  2. 4
  3. 5
  4. 6
  5. Next Page