谷歌近日正式推出 Gemini 3.8 Flash,这一新模型在编程、智能体工作流和多步推理方面均有显著提升,同时延续了与 3.7 Flash 相同的入门定价,意味着开发者可以在不增加成本的情况下获得更强的任务执行能力。值得关注...
Read More在模型开发领域,“新扩展轴”往往意味着一次能力跃升。从扩大参数规模到扩大数据规模,行业每开辟一条新扩展路径,都会带来模型效果的显著提升。测试时训练(Test-Time Training)正被视为一个极具吸引力的新扩展轴:...
Read More近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...
Read More近日,GLM-5.3正式发布,聚焦前沿编码智能与网络空间安全能力。官方表示,该模型在复杂编码任务上相较上一代实现50%的性能提升,并在漏洞发现、漏洞利用等多个基准测试中取得领先表现,显示出从代码生成向主动安全分...
Read MoreOpenAI正式预览了GPT-5.6 Sol的Ultrafast模式,该模式在推理速度上实现显著突破,最高可生成750个输出token/秒,整体处理速度达到标准模式的14倍。值得关注的是,这一性能提升并非通过切换更小的轻量模型来实现,而...
Read MorexAI 推出的 Grok 4.6 在 Grok 4.5 基础上进一步聚焦长时间运行智能体以及更具挑战性的交互式与视觉任务。官方介绍,该版本在多项编码和知识型工作基准上显示出性能提升,并着重强化安全性与可用性,能够将产品构想转...
Read More通义千问团队正式发布了其新一代旗舰模型Qwen3.8-Max,该模型以惊人的2.4万亿参数量,在编码、办公协同、深度研究及长周期任务处理等多个维度实现了代际跨越。不同于仅能提供简单问答的常规模型,Qwen3.8-Max展现出...
Read MorePoolside AI联合首席执行官Eiso Kant深度分享了其团队如何以精简但高效的研究架构,构建起能够训练118B参数混合专家模型Laguna S的“模型工厂”。Laguna S在实际表现中据称超越了Thinky近1万亿参数的开放权重模型,显...
Read More