Anthropic正式发布Claude Opus 5.5,官方称其在智能体编码和知识工作场景中处于领先水平,并在典型工作负载下将运行成本较Opus 5降低40%。这意味着模型在保持旗舰能力的同时,进一步优化了推理效率与部署经济性,对...
Read More文章指出,AI编程代理在显著提升开发效率、节省大量时间的同时,也可能生成看似可信但实际错误的“证据”,因此围绕智能体编码的验证流程与模型能力同等重要。作者强调,不能仅依赖一次性基准测试或团队口口相传的“工...
Read MoreAnthropic 官方博客披露,智能体编码(Agentic Coding)在六个月内推动 CI 作业量增长 25 倍,原有测试影响分析服务作为单例运行,即便持续加配更大机器、实施包分片(package sharding)并每日重启,仍难以避免过载...
Read More专攻 AI 编码的初创公司 Poolside 在 Hugging Face 上正式发布了其最新大型语言模型 Laguna S 2.1。该模型采用混合专家架构,总参数量高达 1180 亿,但每个 token 仅激活其中 80 亿个参数,在保持强大能力的同时实现...
Read MoreTraycer 作为一款新兴的开源 AI 编排应用,正在重新定义智能体编码的工作流。它并非另一个需要单独付费的 AI 模型,而是一个强大的“神经中枢”,允许开发者连接现有的各种智能体订阅服务。其核心技术突破在于通过共享...
Read More在大语言模型后训练中,强化学习正变得愈发关键,但面向长周期智能体任务时,传统同步、批次交替的RL流程效率低下。异步强化学习通过随到随更新的方式提升了效率,然而现有系统多偏重吞吐量,训练稳定性和任务有效性...
Read MoreQwen团队今日发布了其最新的开源权重模型Qwen3.6-27B,在AI社区引发广泛关注。该模型虽然仅有27B参数(稠密架构),却在智能体编码任务中实现了旗舰级性能。据Qwen团队宣称,Qwen3.6-27B在全部主流编码基准测试中均...
Read More阿里云旗下通义千问团队近日发布了其大型语言模型的最新预览版本——Qwen3.6-Max-Preview。该版本在多个核心能力上实现了显著提升,尤其是在世界知识的掌握与指令遵循的准确性方面表现突出。更为关键的是,模型在广泛...
Read More