漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-21 talkingdev

Harvey 推出 Tenet:基于 Kimi K3 后训练,瞄准长周期法律工作与成本效率

Harvey 宣布推出其首个后训练开放权重模型 Tenet,该模型基于 Kimi K3 基础版本,通过异步强化学习在真实的长周期法律环境中进行训练。与单纯向模型灌入更多法律文本不同,Harvey 将尽职调查、审查表格、律所知识等...

Read More
2026-08-20 talkingdev

Agent Memory正成为AI智能体护城河:上下文复利如何改变竞争格局

Redis 最新博客文章分析了智能体记忆(Agent Memory)为何能成为 AI 系统的持久竞争优势。传统大模型大多是无状态的,无法在多次交互之间保存信息;而具备记忆能力的智能体可以持久化、组织和召回历史信息,从静态推...

Read More
2026-08-20 talkingdev

论文推荐|Agent Lightning v1.0:仅6K样本让Qwen3.5-9B在SWE-bench提升14.6分

现代智能体通常运行在执行外壳(harness)中,由外壳管理工具、上下文与控制流。Agent Lightning v1.0提出一种轻量级“受控智能体强化学习”(harnessed agentic RL)框架,约3500行代码即可将任意智能体外壳接入RL训...

Read More
2026-08-19 talkingdev

OpenAI因网络安全风险放缓前沿模型训练,暂停部分强化学习

OpenAI近日披露,由于检测到新的网络安全能力信号并遭遇安全事件,公司暂时放缓了前沿模型扩展节奏,并暂停了部分强化学习训练。这一决定反映出前沿人工智能研发正从单纯追求模型规模与性能,转向更加重视安全边界与...

Read More
2026-08-17 talkingdev

Codex辅助自动研究:GPU Mode qr_v2问题实现232倍内核加速

在近期一场聚焦GPU优化的自动研究竞赛中,参赛者针对批量方阵compact-Householder QR分解(qr_v2)问题展开优化,最终在GPU Mode的qr_v2任务上实现了相对基线高达232倍的内核加速,并在183名参与者中位列第12。该项...

Read More
2026-08-17 talkingdev

GLM-5.3问世:中国AI实验室何以把发布周期从“月”压缩到“天”?

近日,Z.ai发布GLM-5.3引发关注。与此前OpenAI、Anthropic动辄数月的发布节奏不同,Z.ai的模型迭代周期可能仅以天计。尽管美国头部实验室内部模型或许更强,但其公开释放速度明显偏慢。报道指出,Z.ai更重视公共基准...

Read More
2026-08-10 talkingdev

Cursor Router 如何为每个编程任务智能挑选最优模型

Cursor 的智能路由系统 Cursor Router 采用了一种基于真实开发者行为数据学习的模型选择策略,摒弃了简单的规则匹配。该路由器在每个对话回合都会综合当前请求信号和近期会话状态,将决策分解为两阶段:首先判断任务...

Read More
2026-08-10 talkingdev

中国AI视频模型横扫全球榜单:前十独占九席,或将在构建世界模型上建立优势

根据人工智能分析机构Artificial Analysis的最新排名,全球排名前十的文生视频模型中,中国AI实验室占据了其中九席,展现出在视频生成领域压倒性的技术集群优势。彭博社评论指出,过去一段时间,外界对中国人工智能...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page