近期,一篇深度技术博文揭示出“智能体操控计算机(agentic computer use)”领域正面临根本性瓶颈:当前的主流模型倾向于彻底绕开图形用户界面(GUI),而非像人类一样直接与界面元素进行交互。文章指出,现有的智能...
Read MoreEschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...
Read MoreVercel 实验室近日在 GitHub 上开源了一款名为 Scriptc 的创新型编译器,它能够将标准 TypeScript 代码直接编译为高效的原生可执行文件,彻底摆脱了对传统 JavaScript 引擎的依赖。这一工具的核心突破在于同时提供了...
Read More谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...
Read More月之暗面(Moonshot)正式开放其最新旗舰模型Kimi K3的权重,并同步发布详细技术报告。Kimi K3是一个总参数量达到2.8万亿的混合专家(MoE)模型,首次在架构层面原生融合视觉理解能力,可直接处理图像与文本交织的多...
Read MoreGitHub上新晋开源项目Instatic正在引发Dev社区关注。作为一个自托管的可视化内容管理系统,它将可视化编辑器、内容引擎与发布工具全部封装进单一服务端,用户只需极少配置即可快速搭建并发布站点。Instatic定位为 We...
Read More英伟达实验室(NVIDIA Research)正式推出SANA-Video 2.0,一套面向长视频和高分辨率生成的最新模型方案。该方法在架构上融合了线性注意力(linear attention)与周期性softmax层,一改传统自注意力机制在长序列下的...
Read MoreBaseten 为 GLM-5.2 模型构建的全新 API 在推理速度上取得了突破性进展,峰值速度高达 280 tokens/秒,平均速度约为 100 tokens/秒,整体性能达到发布日初版 API 的两倍以上。这一大幅提升得益于底层的系统级优化与...
Read More