OpenAI和Anthropic调查数万起AI相关安全事件

【OpenAI和Anthropic调查数万起AI相关安全事件】金色财经报道,9月27日,OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。

上一篇:

下一篇:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注