英伟达正在将AI竞争优势从单一GPU扩展到整个数据中心系统层面。在最新的Vera Rubin架构中,除GPU外,英伟达引入Vera CPU等专用组件,重点提升数据编排与调度效率。这意味着其战略正从单纯追求更强处理器算力,转向优...
Read MoreAnthropic近日公布了关于自我改进AI的最新研究,首次在实践层面展示了AI自动化研究员如何在较少人类参与的情况下提升其他AI模型的安全性。研究团队让Claude自主训练模型,并针对衡量10类对齐失败的多个公开基准进行...
Read More近日,据Dealroom.co报道,专注于临床试验数据模型和人工智能工具的Faro宣布完成3730万美元B轮融资,由默克全球健康创新基金(Merck Global Health Innovation Fund)与S32联合领投。Faro致力于通过数据模型与AI工具...
Read MoreExperiential是一个开源模型网关,旨在通过统一API控制平面管理智能体工作流,并兼容OpenAI及其他闭源、开源、本地和自定义模型。该项目的核心价值在于把分散的模型调用与流量治理集中到一个接口中,支持本地部署和...
Read MoreLMSYS.org发布的最新基准测试显示,在8×NVIDIA H200 GPU环境中,SGLang Diffusion对MiniMax-H3视频生成工作负载实现了显著加速。测试严格固定提示词、随机种子、分辨率、帧率和去噪步数,并在六类工作负载上进行比较...
Read Morefal Research 宣布推出 H3 Max,这是 MiniMax H3 的后训练版本,由 fal 推理团队专门针对生成速度进行优化。官方表示,该模型可在不到 3 秒内生成一段 5 秒长的视频,显著降低视频生成等待时间。在人类偏好评估中,H...
Read MoreOpenAI 已在其 ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 中支持 WebMCP。WebMCP 可视为将模型上下文协议(MCP)思路引入网页环境:网站能够以标准化方式向 AI 智能体暴露工具、数据或操作能力。对 ChatGPT 和...
Read More微软在GitHub开源了AutoSaddler项目。该系统面向AI智能体性能优化,通过分析智能体的实际执行轨迹,自动更新提示词、工具配置和中间件组件,从而提升智能体在复杂任务中的表现。传统智能体高度依赖开发者手工调试提...
Read More