漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-31 talkingdev

智能体操控计算机界面远未解决:规划与执行分离的新范式剑指万亿级推理困局

近期,一篇深度技术博文揭示出“智能体操控计算机(agentic computer use)”领域正面临根本性瓶颈:当前的主流模型倾向于彻底绕开图形用户界面(GUI),而非像人类一样直接与界面元素进行交互。文章指出,现有的智能...

Read More
2026-07-30 talkingdev

Escha-W2:将35B混合专家模型压缩至12.3GB,单张消费级GPU即可本地运行

EschaLabs 近日发布了 Escha-W2,这是对 Qwen3.6-35B-A3B 混合专家(MoE)模型进行 2 比特量化后的构建版本。Qwen3.6-35B-A3B 本身是一个包含 256 个专家的庞大架构,总参数量达到 35B,但在每次推理中仅激活 3B 参...

Read More
2026-07-28 talkingdev

开源|Scriptc:Vercel 实验室发布 TypeScript 到原生代码编译器,告别 JavaScript 引擎依赖

Vercel 实验室近日在 GitHub 上开源了一款名为 Scriptc 的创新型编译器,它能够将标准 TypeScript 代码直接编译为高效的原生可执行文件,彻底摆脱了对传统 JavaScript 引擎的依赖。这一工具的核心突破在于同时提供了...

Read More
2026-07-28 talkingdev

谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力

谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...

Read More
2026-07-28 talkingdev

月之暗面发布Kimi K3模型权重与技术报告:2.8T MoE原生视觉理解,百万Token上下文

月之暗面(Moonshot)正式开放其最新旗舰模型Kimi K3的权重,并同步发布详细技术报告。Kimi K3是一个总参数量达到2.8万亿的混合专家(MoE)模型,首次在架构层面原生融合视觉理解能力,可直接处理图像与文本交织的多...

Read More
2026-07-27 talkingdev

开源|Instatic:全能自托管CMS崛起,欲做Webflow与WordPress的开源终结者

GitHub上新晋开源项目Instatic正在引发Dev社区关注。作为一个自托管的可视化内容管理系统,它将可视化编辑器、内容引擎与发布工具全部封装进单一服务端,用户只需极少配置即可快速搭建并发布站点。Instatic定位为 We...

Read More
2026-07-27 talkingdev

英伟达发布SANA-Video 2.0:单GPU即可生成长时720p视频,延迟大幅降低

英伟达实验室(NVIDIA Research)正式推出SANA-Video 2.0,一套面向长视频和高分辨率生成的最新模型方案。该方法在架构上融合了线性注意力(linear attention)与周期性softmax层,一改传统自注意力机制在长序列下的...

Read More
2026-07-27 talkingdev

GLM-5.2 API性能狂飙:Baseten打造最快版本,推理速度峰值达280 tokens/秒

Baseten 为 GLM-5.2 模型构建的全新 API 在推理速度上取得了突破性进展,峰值速度高达 280 tokens/秒,平均速度约为 100 tokens/秒,整体性能达到发布日初版 API 的两倍以上。这一大幅提升得益于底层的系统级优化与...

Read More
  1. Prev Page
  2. 4
  3. 5
  4. 6
  5. Next Page