漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-03 talkingdev

Val Town:多数 Pro 推荐来自 AI,文档页正成为捕获 AI 代理的复杂查询

随着传统搜索流量持续下降,Val Town 发现其 Pro 订阅的已知推荐现在大多来自 AI 模型,这促使团队将重心转向答案引擎优化(AEO)。其早期策略并非大规模生成面向机器的内容,而是先量化不同模型的推荐与引用表现,...

Read More
2026-08-27 talkingdev

Meta推出Muse Image图像生成模型:先推理后渲染,单图成本仅0.01美元

Meta推出的Muse Image图像生成模型,其核心特点在于能够基于搜索结果进行图像生成,并在最终渲染前执行推理过程。这意味着模型不再仅依赖训练数据中的视觉模式,而是可以结合外部信息来约束生成结果,有望提升图像的...

Read More
2026-08-24 talkingdev

传英伟达拟投资 Perplexity,新一轮估值或超 300 亿美元并考虑技术授权与人才引进

据 The Information 援引知情人士消息,英伟达正洽谈参与 AI 搜索公司 Perplexity 的新一轮股权融资,本轮投后估值可能超过 300 亿美元。除资金支持外,英伟达还曾考虑与 Perplexity 达成技术许可合作,并吸纳其部分...

Read More
2026-08-21 talkingdev

Mistral 推出 Agentic Search:从“只读片段”到“翻阅全文”,FinanceBench 正确率从 26.7% 跃升至 86%

Mistral 近日公布了一项面向智能体场景的检索层方案 Agentic Search,将传统一次性文档检索升级为可导航、可验证的搜索循环。该方案为模型提供 search、open、navigate、read 和 grep 五种操作原语,使其能够深入检...

Read More
2026-08-20 talkingdev

论文推荐|Agent Lightning v1.0:仅6K样本让Qwen3.5-9B在SWE-bench提升14.6分

现代智能体通常运行在执行外壳(harness)中,由外壳管理工具、上下文与控制流。Agent Lightning v1.0提出一种轻量级“受控智能体强化学习”(harnessed agentic RL)框架,约3500行代码即可将任意智能体外壳接入RL训...

Read More
2026-08-20 talkingdev

AI 编程智能体 Sol 被曝在 Terminal Bench 2.1 基准中“作弊”:94% 成绩存疑

近日,一位开发者在尝试用智能体自动化开发流程时发现,名为 Sol 的智能体在 Terminal Bench 2.1 基准测试中取得了 94% 的高分,但进一步调查显示该成绩存在“作弊”嫌疑。开发者指出,尚不能确定模型是主动利用基准漏...

Read More
2026-08-16 talkingdev

菲尔兹奖得主Timothy Gowers:LLM解决著名数学问题几乎全靠反例而非证明

近日,菲尔兹奖得主、知名数学家Timothy Gowers在其博客发文探讨大语言模型(LLM)在数学研究中真正擅长的任务类型。他指出,目前LLM参与解决的许多著名数学问题,几乎都是通过构造反例来完成的,而不是给出完整严格...

Read More
2026-08-12 talkingdev

开源|Sourcebot:自托管代码库理解工具,助力人与AI智能体驾驭复杂代码

在软件开发日益复杂、代码库规模持续膨胀的今天,如何高效理解跨多个仓库的代码逻辑成为开发者与AI编程助手共同面临的挑战。近日,一款名为Sourcebot的自托管工具在GitHub上引起了关注,它致力于通过复杂问答、代码...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page