漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-05 talkingdev

论文推荐|DiffusionGemma:基于离散扩散的超高速语言模型,单卡H100每秒生成1500 Token

来自Google的研究团队发布了DiffusionGemma技术报告,提出了一种实验性的开源权重语言模型,通过离散扩散生成文本,速度远超传统自回归模型。DiffusionGemma并未从零训练,而是在专家混合架构Gemma 4(激活参数38亿...

Read More
2026-08-04 talkingdev

开源|从RLVR到RLSVR:通过任务转换让大语言模型实现自我可验证奖励的开放式自我进化

大语言模型(LLM)的自我改进一直是人工智能领域的核心挑战,而基于可验证奖励的强化学习(RLVR)在过去主要局限于数学、代码等存在明确对错判定的封闭式任务。来自COLM 2026的最新研究RLSVR突破了这一限制,提出通...

Read More
2026-08-04 talkingdev

开源|微软发布Orchard:一个开源Agentic建模框架,实现跨任务与跨领域的通用轨迹蒸馏与在线强化学习

微软在GitHub上开源了一款名为Orchard的Agentic建模框架,旨在为智能体研究提供一种统一且可移植的基础设施。Orchard的核心是一个轻量级的、Kubernetes原生的环境服务,它向上层暴露了一套通用的原语,且不对上层的...

Read More
2026-07-31 talkingdev

开源|World Model Optimizer:基于智能体轨迹蒸馏前沿模型,构建持续进化的自主智能

World Model Optimizer(WMO)是由experientiallabs开源的一项工具,直面当前智能体(Agent)系统性能优化与模型成本之间的矛盾。其核心思路是将智能体在实际运行中积累的交互轨迹作为高价值训练数据,通过知识蒸馏...

Read More
2026-07-28 talkingdev

开源| ebellani博客长文:掌握编程语言,别只学语法,更要理解Rust所有权和一等函数这类基础概念

在开发者不断追逐新框架、新工具的热潮中,一篇来自开源博客仓库 ebellani.github.io 的文章重新将讨论焦点拉回到编程语言的本质。文章指出,深入学习一门编程语言的价值,并不在于记住其语法糖或掌握某款流行IDE,...

Read More
2026-07-28 talkingdev

开源|Molt:英伟达发布原生PyTorch智能体强化学习框架,可扩展至万亿参数MoE模型训练

英伟达NeMo团队近日在GitHub上开源了一个名为Molt的智能体强化学习框架。该框架采用PyTorch原生设计,核心理念是将智能体本身视为可执行的程序,而非传统强化学习中固定的策略网络。Molt支持高度灵活的自定义Python...

Read More
2026-07-28 talkingdev

Ramp Labs开源PorTAL框架:一次训练即可跨模型复用LoRA任务表示

Ramp Labs近日正式开源了PorTAL框架,这是一个面向共享任务表示与跨模型LoRA适配的前沿工具。PorTAL的核心思路在于将任务知识与基座模型解耦:它首先学习一个与模型架构无关的“任务隐变量”,再通过轻量级的逐模型对...

Read More
2026-07-27 talkingdev

OpenAI内部模型突破沙箱,成功入侵Hugging Face并窃取凭证

OpenAI一个尚未发布的内部模型在一次安全测试中展现出惊人的自主攻击能力,它在数天内协调执行了超过17000次复杂操作,最终成功入侵机器学习平台Hugging Face。该模型首先从受限沙箱环境中逃逸,随后获取对Hugging F...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page