漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-03 talkingdev

Val Town:多数 Pro 推荐来自 AI,文档页正成为捕获 AI 代理的复杂查询

随着传统搜索流量持续下降,Val Town 发现其 Pro 订阅的已知推荐现在大多来自 AI 模型,这促使团队将重心转向答案引擎优化(AEO)。其早期策略并非大规模生成面向机器的内容,而是先量化不同模型的推荐与引用表现,...

Read More
2026-08-31 talkingdev

NVIDIA发布DeepSeek-V4-Pro-0813-NVFP4量化模型:MoE架构助力智能体与企业级AI

NVIDIA在Hugging Face平台推出DeepSeek-V4-Pro-0813-NVFP4量化模型,该模型是DeepSeek-V4-Pro-0813的量化版本,采用自回归混合专家(MoE)语言模型架构。通过NVIDIA Model Optimizer量化后,模型在保持高级推理能力...

Read More
2026-07-22 talkingdev

谷歌推出Gemini 3.6 Flash、3.5 Flash-Lite与3.5 Flash Cyber,全面优化效率与安全

谷歌正式发布了三款新一代Gemini模型:Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。其中,Gemini 3.6 Flash在编码和多模态任务上显著提升了性能,同时通过优化输出token的消耗,进一步降低了使用成本,使其...

Read More
2025-12-22 talkingdev

卡帕西年度回顾:2025年大语言模型的五大范式变革

人工智能领域知名专家安德烈·卡帕西(Andrej Karpathy)近期发布了其对2025年大语言模型(LLM)发展的年度回顾,系统性地梳理了行业在过去一年中经历的深刻范式转变。报告指出,技术演进的核心驱动力已从单纯追求模...

Read More
2025-11-18 talkingdev

AA-Omniscience基准发布:Claude 4.1 Opus在40+主题知识幻觉测试中夺魁

人工智能评估机构Artificial Analysis最新推出AA-Omniscience基准测试体系,该体系针对40余个专业领域的大语言模型知识储备与幻觉现象进行系统性评估。测试结果显示,在关键指标上仅有三个模型能够保持正确回答率高...

Read More
2025-10-16 talkingdev

Anthropic发布Claude Haiku 4.5:小模型实现前沿性能突破

人工智能公司Anthropic正式推出新一代小型AI模型Claude Haiku 4.5,该模型在保持成本效益与运行速度优势的同时,实现了接近前沿大模型的性能表现。据官方披露,这款模型在多项基准测试中不仅超越了前代版本,更在计...

Read More
2025-06-16 talkingdev

ParetoQ算法突破低比特量化技术瓶颈,统一二元、三元及2至4位量化方案

PyTorch官方博客最新发布的ParetoQ训练算法在低比特量化领域取得重大突破。该技术首次实现了二元(1-bit)、三元(1.58-bit)和2至4位量化的统一框架,并在所有量化级别上均达到当前最优性能。这一突破性进展尤其适...

Read More
2025-06-02 talkingdev

谷歌低调发布AI Edge Gallery应用:支持本地运行Hugging Face模型

谷歌近日悄然推出一款名为AI Edge Gallery的应用程序,该应用允许用户直接在安卓设备上查找、下载并运行来自Hugging Face的兼容AI模型,且无需联网即可使用。这一突破性进展标志着移动端AI技术的重大进步,使得高性...

Read More
  1. Next Page