TaoLive团队针对直播电商数字人代理的实时性与适应性矛盾,提出Harness-Aware Training(HAT)后训练方法。其核心是将技能、钩子、系统提示和工具模式从模型权重中解耦,使运行时行为可随业务策略变化而无需重新训练...
Read More计算机科学家梅拉妮·米切尔认为,当前对人工智能“智能”的讨论常常陷入拟人化误区。她指出,大语言模型表现出的对话、推理和解题能力,并不意味着它们像人类一样思考或理解,而更像一种“异类智能”。为了更准确地衡量...
Read MoreHarvey 宣布推出其首个后训练开放权重模型 Tenet,该模型基于 Kimi K3 基础版本,通过异步强化学习在真实的长周期法律环境中进行训练。与单纯向模型灌入更多法律文本不同,Harvey 将尽职调查、审查表格、律所知识等...
Read More在大模型自回归推理过程中,KV缓存用于保存每个请求的注意力键值对,避免每一步解码都重新计算。但随着序列长度增加,KV缓存会线性膨胀,长上下文场景下甚至会消耗比模型权重更多的GPU显存,成为稀缺资源。更严重的...
Read MoreMistral 近日公布了一项面向智能体场景的检索层方案 Agentic Search,将传统一次性文档检索升级为可导航、可验证的搜索循环。该方案为模型提供 search、open、navigate、read 和 grep 五种操作原语,使其能够深入检...
Read MoreChatGPT桌面版在macOS上迎来一项重要集成更新:用户现在可以直接在应用内访问和处理来自Apple Messages的对话内容,覆盖iMessage、SMS与RCS三类消息协议。这一变化使ChatGPT从独立问答窗口进一步嵌入苹果原生信息生...
Read MoreRedis 最新博客文章分析了智能体记忆(Agent Memory)为何能成为 AI 系统的持久竞争优势。传统大模型大多是无状态的,无法在多次交互之间保存信息;而具备记忆能力的智能体可以持久化、组织和召回历史信息,从静态推...
Read More随着DeepSeek-V4-Pro等1.6万亿参数Mixture-of-Experts(MoE)模型同时发布FP8与FP4权重,如何在真实资源约束下高效服务前沿模型成为AI基础设施团队的核心挑战。LMSYS博客文章指出,服务配置不应仅依据硬件规格或孤立...
Read More