强化学习(RL)在可验证领域(如棋类游戏、编程代码)的成功已毋庸置疑,但现实世界中大量复杂任务(如机器人操控、制药分子设计、开放域对话)难以通过简单规则或自动脚本进行验证,这构成了RL落地的关键瓶颈。本文...
Read MoreImbue公司成功训练并发布了一款极其强大的70B语言模型。这款模型采用了Imbue自家的优化器,以及一些出色的数据过滤技术,训练过程中没有出现任何损失峰值。这表明该公司在技术上取得了显著的突破,为人工智能语言模...
Read More前称为Generally Intelligent的Imbue公司,已经成功融资2亿美元,完成了B轮融资,公司估值超过十亿美元。这笔资金的目标是加速推理和编程能力的AI系统的开发。Imbue的使命是生产真正的个人电脑,以提高用户的选择权...
Read More