漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-27 talkingdev

celeris-1 发布:超低延迟逼近 GPT-5 级智能,推理速度提升 15 倍

人工智能公司 celeris AI 正式推出全新通用语言模型 celeris-1,该模型在保持前沿智能水平的同时,实现了突破性的响应速度。celeris-1 的核心创新在于采用了一种基于扩散技术的新型推理架构,从根本上重构了传统自回...

Read More
2026-07-27 talkingdev

英伟达发布SANA-Video 2.0:单GPU即可生成长时720p视频,延迟大幅降低

英伟达实验室(NVIDIA Research)正式推出SANA-Video 2.0,一套面向长视频和高分辨率生成的最新模型方案。该方法在架构上融合了线性注意力(linear attention)与周期性softmax层,一改传统自注意力机制在长序列下的...

Read More
2026-07-27 talkingdev

提示缓存如何塑造编码智能体的成本与架构

提示缓存正在成为构建经济型智能体的关键技术,但其表现十分脆弱。在编码智能体等复杂系统中,一次工具定义的修改、模型版本的切换,或云服务提供商的路由决策变更,都可能将原本低成本的增量请求转变为对上下文的完...

Read More
2026-07-27 talkingdev

GLM-5.2 API性能狂飙:Baseten打造最快版本,推理速度峰值达280 tokens/秒

Baseten 为 GLM-5.2 模型构建的全新 API 在推理速度上取得了突破性进展,峰值速度高达 280 tokens/秒,平均速度约为 100 tokens/秒,整体性能达到发布日初版 API 的两倍以上。这一大幅提升得益于底层的系统级优化与...

Read More
2026-07-27 talkingdev

美企AI策略急转弯:从“烧Token”到“极致省钱”,混合中国模型冲击OpenAI等实验室IPO估值

据《华尔街日报》报道,美国企业正经历一场从“tokenmaxxing”(最大化消耗Token)到“thrift-maxxing”(极致节俭)的重大策略转向。越来越多的公司不再单纯依赖 OpenAI 和 Anthropic 的高端模型,而是开始将更便宜的中...

Read More
2026-07-26 talkingdev

前Meta团队打造AI原生图像传感器,Elio获2100万美元A轮融资

由前Meta硬件工程师创立的初创公司Elio宣布完成2100万美元的A轮融资,本轮由Innovation Endeavors和Xora联合领投。Elio正在开发一种颠覆传统思路的图像传感器架构,其设计目标不再是为人眼所见的视觉质量服务,而是...

Read More
2026-07-24 talkingdev

如何打造前沿模型工厂:Poolside AI揭示118B MOE模型Laguna S背后的训练体系

Poolside AI联合首席执行官Eiso Kant深度分享了其团队如何以精简但高效的研究架构,构建起能够训练118B参数混合专家模型Laguna S的“模型工厂”。Laguna S在实际表现中据称超越了Thinky近1万亿参数的开放权重模型,显...

Read More
2026-07-23 talkingdev

美国能源部联手Arcee AI推出开放权重模型Genesis-Science-1,助力科学计算可复现

美国能源部与开放智能实验室Arcee AI宣布联合开发Genesis-Science-1(GS1),一个面向科学计算工作流的开放权重AI模型。该项目旨在解决科学研究中计算流程难以复现的长期痛点,通过透明、可定制的模型架构和开放权重...

Read More
  1. Prev Page
  2. 9
  3. 10
  4. 11
  5. Next Page