漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-14 talkingdev

微软揭秘:如何平稳支撑数千个生产级AI代理的幕后技术架构

微软在其Foundry平台和Copilot系列产品中已大规模部署AI代理,背后是一套精妙的工程化机制。微软核心AI产品副总裁Marco Casalaina指出,将检索建模为独立的子代理是成功的关键,这种设计让复杂任务可以分解为多个专...

Read More
2026-07-13 talkingdev

LangChain推出OpenWiki Brains:为AI智能体打造主动式记忆「个人大脑」

LangChain正式发布了OpenWiki Brains项目,为AI智能体引入了一种“主动记忆”机制。与传统被动检索知识库不同,OpenWiki Brains允许智能体自主地从Gmail、Notion、Git、X(原Twitter)、Hacker News以及网络搜索等日常...

Read More
2026-07-12 talkingdev

OpenAI 揭露编程评估基准 SWE-Bench Pro 近三成任务存缺陷,建议撤回升级推荐

OpenAI 近期对当前广泛使用的 AI 编程能力评估基准 SWE-Bench Pro 进行了一次系统性审计,结果发现约 30% 的任务存在严重瑕疵,令该基准的可靠性与准确性备受质疑。此次审计由 Anthropic 团队执行,结合了自动化筛查...

Read More
2026-06-30 talkingdev

DiScoFormer:单一Transformer模型,跨分布同时估计密度与得分,性能碾压传统KDE

近日,AI2研究团队在Hugging Face博客上发布了DiScoFormer模型,这是一种基于Transformer架构的创新方法,能够在单次前向传播中同时完成数据的密度估计和得分函数估计,而无需针对新分布进行重新训练。与经典的核密...

Read More
2026-06-26 talkingdev

Liquid AI发布LFM2.5-230M:超紧凑非Transformer模型,边缘推理性能媲美三倍规模模型

近日,Liquid AI宣布推出其最新基础模型LFM2.5-230M,这是一款参数规模仅为2.3亿的非Transformer架构模型。与当前主流的Transformer模型不同,LFM2.5-230M基于状态空间模型与液态神经网络连续时间公式构建。尽管体积...

Read More
2026-06-25 talkingdev

数据库基准测试的谎言:QuestDB 揭示性能排名真相

QuestDB 在其最新的博文中深入探讨了数据库基准测试中常见的误导性问题。作为一款开源的高性能时序数据库,QuestDB 以超低延迟和高吞吐量著称。然而,其研究指出,基准测试结果极易受到测试方法的影响。例如,进程持...

Read More
2026-06-23 talkingdev

开源模型 GLM-5.2 硬刚 Claude Opus:3D 游戏开发实测,成本与性能的终极博弈

在 AI 大模型竞争白热化的当下,开源模型与闭源旗舰的性能差距一直是业界关注的焦点。知名科技评测媒体 Tech Stackups 发布了一项引人注目的对比测试:将智谱开源的大型语言模型 GLM-5.2 与 Anthropic 的顶级闭源模...

Read More
2026-06-19 talkingdev

Perplexity发布“自我进化记忆”系统Brain,让AI代理告别“从零开始”

Perplexity AI公司近日在其官方博客中披露了一项名为Brain的新型记忆系统。该系统旨在解决当前AI代理在执行复杂任务时缺乏上下文和长期记忆的痛点。Brain通过构建一个跨任务、项目、决策、文件和资料源的持续上下文...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page