漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-21 talkingdev

论文推荐|TaoLive提出Harness感知训练:35B数字人直播代理实时适应可变接口,P50延迟仅3.4秒

TaoLive团队针对直播电商数字人代理的实时性与适应性矛盾,提出Harness-Aware Training(HAT)后训练方法。其核心是将技能、钩子、系统提示和工具模式从模型权重中解耦,使运行时行为可随业务策略变化而无需重新训练...

Read More
2026-08-21 talkingdev

AI真的会“思考”吗?梅拉妮·米切尔称其为“异类智能”:我们可能测错了方向

计算机科学家梅拉妮·米切尔认为,当前对人工智能“智能”的讨论常常陷入拟人化误区。她指出,大语言模型表现出的对话、推理和解题能力,并不意味着它们像人类一样思考或理解,而更像一种“异类智能”。为了更准确地衡量...

Read More
2026-08-21 talkingdev

Harvey 推出 Tenet:基于 Kimi K3 后训练,瞄准长周期法律工作与成本效率

Harvey 宣布推出其首个后训练开放权重模型 Tenet,该模型基于 Kimi K3 基础版本,通过异步强化学习在真实的长周期法律环境中进行训练。与单纯向模型灌入更多法律文本不同,Harvey 将尽职调查、审查表格、律所知识等...

Read More
2026-08-21 talkingdev

PagedAttention:用虚拟内存破解KV缓存碎片化,大模型GPU并发推理提升2-4倍

在大模型自回归推理过程中,KV缓存用于保存每个请求的注意力键值对,避免每一步解码都重新计算。但随着序列长度增加,KV缓存会线性膨胀,长上下文场景下甚至会消耗比模型权重更多的GPU显存,成为稀缺资源。更严重的...

Read More
2026-08-21 talkingdev

Mistral 推出 Agentic Search:从“只读片段”到“翻阅全文”,FinanceBench 正确率从 26.7% 跃升至 86%

Mistral 近日公布了一项面向智能体场景的检索层方案 Agentic Search,将传统一次性文档检索升级为可导航、可验证的搜索循环。该方案为模型提供 search、open、navigate、read 和 grep 五种操作原语,使其能够深入检...

Read More
2026-08-21 talkingdev

ChatGPT更新:Mac端正式接入Apple Messages,iMessage/SMS/RCS全兼容

ChatGPT桌面版在macOS上迎来一项重要集成更新:用户现在可以直接在应用内访问和处理来自Apple Messages的对话内容,覆盖iMessage、SMS与RCS三类消息协议。这一变化使ChatGPT从独立问答窗口进一步嵌入苹果原生信息生...

Read More
2026-08-20 talkingdev

Agent Memory正成为AI智能体护城河:上下文复利如何改变竞争格局

Redis 最新博客文章分析了智能体记忆(Agent Memory)为何能成为 AI 系统的持久竞争优势。传统大模型大多是无状态的,无法在多次交互之间保存信息;而具备记忆能力的智能体可以持久化、组织和召回历史信息,从静态推...

Read More
2026-08-20 talkingdev

1.6万亿参数DeepSeek-V4-Pro部署新思路:从负载画像到拓扑决策突破推理瓶颈

随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...

Read More
  1. Prev Page
  2. 10
  3. 11
  4. 12
  5. Next Page