漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-31 talkingdev

NVIDIA发布DeepSeek-V4-Pro-0813-NVFP4量化模型:MoE架构助力智能体与企业级AI

NVIDIA在Hugging Face平台推出DeepSeek-V4-Pro-0813-NVFP4量化模型,该模型是DeepSeek-V4-Pro-0813的量化版本,采用自回归混合专家(MoE)语言模型架构。通过NVIDIA Model Optimizer量化后,模型在保持高级推理能力...

Read More
2026-08-27 talkingdev

Salesforce联手Anthropic推出Claudeforce,Benioff回应“SaaSpocalypse”担忧

Salesforce与Anthropic宣布扩大合作,正式推出名为Claudeforce的Claude聊天机器人插件。该插件内置37项预构建销售技能,可帮助用户高效访问数据并更新记录,将Anthropic的推理能力直接嵌入Salesforce企业流程。Sales...

Read More
2026-08-25 talkingdev

NVIDIA Groq 3 LPX AI推理加速芯片全面量产,Vera Rubin迎来史上最快Token生成速度

NVIDIA的Groq 3 LPX AI推理加速芯片现已进入全面量产阶段。Groq 3 LPX机架作为NVIDIA Vera Rubin平台的扩展,显著提升了AI推理能力,能够为响应敏感型智能体(Agentic)工作负载提供超高速的Token生成表现。在面向智...

Read More
2026-08-13 talkingdev

微软发布 MAI-Thinking-1:面向企业级场景的高性价比中型推理模型

微软正式发布 MAI-Thinking-1,这是一款面向企业工作负载的中等规模推理模型,重点提升编码、数学和知识类任务中的成本效率。该模型强调在推理能力与部署成本之间取得平衡,适合需要大规模调用又对响应速度和预算敏...

Read More
2026-08-06 talkingdev

Prime Agent开源亮相:自我改进的RLM代理在ARC-AGI-3上首超人类专家

Prime Agent是Prime Intellect发布的一款开源自我改进编码工具,其核心架构围绕递归语言模型(RLM)和持续训练框架(Continual Harness)两大抽象展开。该框架通过更优的上下文管理、多智能体协同与长期评估机制,赋...

Read More
2026-08-03 talkingdev

两个独立团队同时用GPT-5.6 Sol Ultra攻克同一量子密码难题,论文提交仅差3小时,引爆科研优先权争议

在人工智能深度介入前沿科学研究的浪潮中,一场关于优先权的微妙竞赛悄然上演。据《科学美国人》报道,来自麻省理工学院的一名博士生与加州大学系统的两位密码学家,几乎在同一时间将顶级大模型GPT-5.6 Sol Ultra应...

Read More
2026-07-31 talkingdev

Thinking Machines发布Inkling-Small:仅四分之一规模,多模态推理能力不打折

人工智能公司Thinking Machines正式推出开源权重模型Inkling-Small,以更小的体量实现了与Inkling相当的性能。该模型采用混合专家架构,总参数量达276B,但每次推理仅激活12B参数,大幅降低算力需求。Inkling-Small...

Read More
2026-07-28 talkingdev

谷歌云发布Gemini蒸馏服务:用gemini-2.5-flash复现大模型推理能力

谷歌云在Gemini企业智能体平台上正式推出Gemini蒸馏服务(Gemini Distillation Service),旨在通过大型“教师”模型的输出和推理路径,训练出更小、更高效的“学生”模型。该服务专门针对高吞吐量、低延迟严苛要求的应...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page