漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-31 talkingdev

论文推荐|谷歌推出WikiSkill:将智能体经验固化为持久知识,驱动技能持续进化

谷歌提出WikiSkill框架,目标是解决智能体技能开发中经验分散、难以跨迭代复用的问题。该框架将原始执行经验、累积知识和可执行技能分层解耦,并持续把执行经验整合到持久知识库wiki中,使后续技能更新能够建立在不...

Read More
2026-08-31 talkingdev

基础模型不再是瓶颈:GLM5.3与Qwen3.8-27B靠后训练实现家用硬件跑Opus级智能

近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...

Read More
2026-08-28 talkingdev

SGLang Diffusion加持:MiniMax-H3视频生成在8×H200上无损提速1.95倍,最高6.24倍

LMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...

Read More
2026-08-22 talkingdev

OpenAI高管离职潮下,总裁Greg Brockman权力大幅扩张,全面接管产品与扩展团队

OpenAI正经历一轮剧烈的组织重构。在多位高管陆续离职、公司又深陷与联合创始人埃隆·马斯克的诉讼拉锯之际,总裁Greg Brockman的职责显著扩大,开始直接掌控产品团队与扩展(scaling)团队。这一安排不仅是人事层面...

Read More
2026-08-19 talkingdev

OpenAI因网络安全风险放缓前沿模型训练,暂停部分强化学习

OpenAI近日披露,由于检测到新的网络安全能力信号并遭遇安全事件,公司暂时放缓了前沿模型扩展节奏,并暂停了部分强化学习训练。这一决定反映出前沿人工智能研发正从单纯追求模型规模与性能,转向更加重视安全边界与...

Read More
2026-08-16 talkingdev

Pathway 凭借“后Transformer”BDH架构获3000万美元种子轮融资,估值达5亿美元

人工智能研究公司Pathway近日获得3000万美元种子轮融资,投后估值达到5亿美元。该公司正在开发基于其称为“Post-Transformer”(后Transformer)的BDH架构AI模型,这一路线被外界视为对当前主流Transformer架构的探索...

Read More
2026-08-14 talkingdev

空货架还是丢钥匙?谷歌研究:GPT-5与Gemini 3事实性错误的瓶颈在“回忆”

大模型事实性错误常被简单归因为训练知识不足,但谷歌研究团队通过知识画像框架对Gemini 3、GPT-5等先进模型进行分析后发现,模型对事实知识的编码已接近饱和,真正的瓶颈出现在参数化回忆阶段。也就是说,模型并非...

Read More
2026-06-23 talkingdev

AI模型规模狂飙:到2031年参数量将达1.4千万亿?核心约束竟是内存速度

一篇来自LessWrong社区的技术文章深入探讨了2023年至2031年间大型语言模型(LLM)规模扩展的物理极限。文章指出,虽然预训练算力是决定模型规模的关键,但一个常被忽视的硬性约束在于推理时的令牌生成速度。具体来说...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page