Anthropic 正计划将外部安全评估机构 METR 引入内部,对其近期涉及 AI 智能体的安全事件进行独立审查。与此同时,该公司已暂停最高风险级别的强化学习研究,但仍公开分享了一项刻意训练出奖励追求型 Claude 版本的研...
Read More在模型开发领域,“新扩展轴”往往意味着一次能力跃升。从扩大参数规模到扩大数据规模,行业每开辟一条新扩展路径,都会带来模型效果的显著提升。测试时训练(Test-Time Training)正被视为一个极具吸引力的新扩展轴:...
Read MoreMeta正式发布Muse Spark 1.3,重点提升编码与智能体任务的推理表现,并针对生产环境优化易用性。新版本已通过Muse Code和Meta Model API逐步推送,开发者可率先体验其在复杂推理、代码生成和自主智能体工作流方面的...
Read MoreMeta正在加速推进其AI代理超级应用项目,该项目内部代号为Project Hatch,正式发布名称已确定为Muse。目前iOS端应用已开放等待列表,桌面应用中也新增了“computer use”设置入口。更值得关注的是,Meta似乎在内部测试...
Read MoreFnScribe 是一款面向 macOS 的私有化语音听写工具,核心特点是语音转写在本地完成,不需要将录音上传至云端,从而降低敏感语音数据外泄风险。用户可以通过快捷键在任意活跃应用中启动听写,并支持免提操作,适合写作...
Read MoreVercel 近日披露了其如何利用编码代理(coding agents)大规模生成符合品牌规范的页面,核心是一份名为 design.md 的公开文件。该文件为不同工具和上下文提供统一的品牌设计参数,使 AI 编码代理在构建页面时能够遵...
Read More近期安全研究显示,Claude Code Opus 5 的 Auto Mode(自动模式)存在提示注入攻击风险。攻击者通过构造简单的网站摘要请求,即可劫持自动模式下的编码代理,并在实测中实现代码执行,攻击成功率达到60%至80%。这一...
Read MoreNeon 官方博客披露其基于 Lakebase Postgres 实现的数据库实时自动扩缩容机制。该方案将存储与计算解耦,使计算规模可以根据 CPU 负载、内存使用以及缓存工作集大小实时调整,而无需中断在线操作。相比传统数据库扩...
Read More