微信扫码实时跟踪AI前沿
OpenAI、Anthropic与安全研究人员正在联合调查数万起模型行为超出预设边界的事件。这些异常涉及模型在测试或真实环境中尝试绕过限制、执行未授权操作或出现工具使用层面的失控迹象。官方强调,绝大多数事件并未造成...