漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-23 talkingdev

Anthropic发布Claude Opus 5.5:智能体编码与知识工作领先,运行成本降低40%

Anthropic正式发布Claude Opus 5.5,官方称其在智能体编码和知识工作场景中处于领先水平,并在典型工作负载下将运行成本较Opus 5降低40%。这意味着模型在保持旗舰能力的同时,进一步优化了推理效率与部署经济性,对...

Read More
2026-09-16 talkingdev

AI编程代理“省时却会造假”?LLM基准与智能体编码验证面临信任危机

文章指出,AI编程代理在显著提升开发效率、节省大量时间的同时,也可能生成看似可信但实际错误的“证据”,因此围绕智能体编码的验证流程与模型能力同等重要。作者强调,不能仅依赖一次性基准测试或团队口口相传的“工...

Read More
2026-09-15 talkingdev

智能体编程让 CI 作业量 25 倍暴增,Anthropic 重构测试影响分析实现稳定水平扩展

Anthropic 官方博客披露,智能体编码(Agentic Coding)在六个月内推动 CI 作业量增长 25 倍,原有测试影响分析服务作为单例运行,即便持续加配更大机器、实施包分片(package sharding)并每日重启,仍难以避免过载...

Read More
2026-07-22 talkingdev

Poolside 发布 Laguna S 2.1:1180 亿参数 MoE 模型,专攻智能体编程,上下文窗口突破 100 万 token

专攻 AI 编码的初创公司 Poolside 在 Hugging Face 上正式发布了其最新大型语言模型 Laguna S 2.1。该模型采用混合专家架构,总参数量高达 1180 亿,但每个 token 仅激活其中 80 亿个参数,在保持强大能力的同时实现...

Read More
2026-07-12 talkingdev

开源|Traycer:为智能体编码打造的中枢神经编排平台

Traycer 作为一款新兴的开源 AI 编排应用,正在重新定义智能体编码的工作流。它并非另一个需要单独付费的 AI 模型,而是一个强大的“神经中枢”,允许开发者连接现有的各种智能体订阅服务。其核心技术突破在于通过共享...

Read More
2026-07-12 talkingdev

论文推荐| Z.ai提出SAO:单次展开异步优化,稳定训练千步,超越GRPO并已部署于GLM-5.2

在大语言模型后训练中,强化学习正变得愈发关键,但面向长周期智能体任务时,传统同步、批次交替的RL流程效率低下。异步强化学习通过随到随更新的方式提升了效率,然而现有系统多偏重吞吐量,训练稳定性和任务有效性...

Read More
2026-04-23 talkingdev

Qwen3.6-27B震撼发布:27B稠密模型实现旗舰级编码性能,超越前代397B MoE巨兽

Qwen团队今日发布了其最新的开源权重模型Qwen3.6-27B,在AI社区引发广泛关注。该模型虽然仅有27B参数(稠密架构),却在智能体编码任务中实现了旗舰级性能。据Qwen团队宣称,Qwen3.6-27B在全部主流编码基准测试中均...

Read More
2026-04-21 talkingdev

通义千问Qwen3.6-Max-Preview发布:世界知识更强,代码能力大幅进化

阿里云旗下通义千问团队近日发布了其大型语言模型的最新预览版本——Qwen3.6-Max-Preview。该版本在多个核心能力上实现了显著提升,尤其是在世界知识的掌握与指令遵循的准确性方面表现突出。更为关键的是,模型在广泛...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page