漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-03 talkingdev

谷歌发布 Gemini 3.8 Flash 与 Flash Cyber:智能体推理和网络安全能力再升级

谷歌近日正式推出 Gemini 3.8 Flash,这一新模型在编程、智能体工作流和多步推理方面均有显著提升,同时延续了与 3.7 Flash 相同的入门定价,意味着开发者可以在不增加成本的情况下获得更强的任务执行能力。值得关注...

Read More
2026-09-03 talkingdev

Test-Time Training:测试时训练有望成为大模型新扩展轴,持续学习仍是难题

在模型开发领域,“新扩展轴”往往意味着一次能力跃升。从扩大参数规模到扩大数据规模,行业每开辟一条新扩展路径,都会带来模型效果的显著提升。测试时训练(Test-Time Training)正被视为一个极具吸引力的新扩展轴:...

Read More
2026-08-31 talkingdev

基础模型不再是瓶颈:GLM5.3与Qwen3.8-27B靠后训练实现家用硬件跑Opus级智能

近期开放模型在短短数月内取得显著进展,基础模型已不再是能力提升的主要瓶颈。以GLM5.3和Qwen3.8-27B为代表的新一代模型,其相较上一代的性能提升主要来自后训练阶段的优化,而非单纯扩大基础模型规模。值得关注的...

Read More
2026-08-17 talkingdev

GLM-5.3重磅发布:编码与漏洞攻防能力提升50%,两周后开源

近日,GLM-5.3正式发布,聚焦前沿编码智能与网络空间安全能力。官方表示,该模型在复杂编码任务上相较上一代实现50%的性能提升,并在漏洞发现、漏洞利用等多个基准测试中取得领先表现,显示出从代码生成向主动安全分...

Read More
2026-08-14 talkingdev

OpenAI发布GPT-5.6 Sol超高速模式:推理速度最高提升14倍,每秒输出750 tokens

OpenAI正式预览了GPT-5.6 Sol的Ultrafast模式,该模式在推理速度上实现显著突破,最高可生成750个输出token/秒,整体处理速度达到标准模式的14倍。值得关注的是,这一性能提升并非通过切换更小的轻量模型来实现,而...

Read More
2026-08-13 talkingdev

Grok 4.6 发布:强化长时智能体与自校验能力,编码知识基准再提升

xAI 推出的 Grok 4.6 在 Grok 4.5 基础上进一步聚焦长时间运行智能体以及更具挑战性的交互式与视觉任务。官方介绍,该版本在多项编码和知识型工作基准上显示出性能提升,并着重强化安全性与可用性,能够将产品构想转...

Read More
2026-08-03 talkingdev

Qwen3.8-Max震撼登场:2.4万亿参数重新定义编码与协作的极限

通义千问团队正式发布了其新一代旗舰模型Qwen3.8-Max,该模型以惊人的2.4万亿参数量,在编码、办公协同、深度研究及长周期任务处理等多个维度实现了代际跨越。不同于仅能提供简单问答的常规模型,Qwen3.8-Max展现出...

Read More
2026-07-24 talkingdev

如何打造前沿模型工厂:Poolside AI揭示118B MOE模型Laguna S背后的训练体系

Poolside AI联合首席执行官Eiso Kant深度分享了其团队如何以精简但高效的研究架构,构建起能够训练118B参数混合专家模型Laguna S的“模型工厂”。Laguna S在实际表现中据称超越了Thinky近1万亿参数的开放权重模型,显...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page