OpenAI和Anthropic正在调查数万起AI相关安全事件
2026-09-27 07:32   
来源: 云财经   
影响力评估指数:22.69  
云财经讯,OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调查,许多事件尚未公开。部分测试类似于“红队测试”(red-teaming)活动,即公司故意诱导模型出现不良行为,以确保它们的安全性。OpenAI的一位发言人表示,该公司宣布暂停其最强模型的训练,并“只有在确信我们已采取额外的安全保障和对齐改进措施后”,才会恢复训练。
云财经智能匹配相关概念
| 新闻标题 | 时间 | 消息来源 | 新闻热度 |
|---|---|---|---|
| 利比亚国家石油公司:利比亚重新开放沙拉拉-扎维耶输油管线阀门,恢复原油输送。 | 今天 03:06 | 云财经 |
|
| 瑞士央行行长施莱格尔:食品价格已上涨,但通胀上升几乎完全由汽油价格推动。 | 09-26 18:50 | 云财经 |
|
| Lumen拟将其股票上市地点转移至纳斯达克。 | 09-25 20:49 | 云财经 |
|
| 9月25日电,现货黄金向上触及4300美元,日内上涨0.65%。 | 09-25 18:09 | 云财经 |
|
| 内塔尼亚胡表示:“摧毁伊朗的核设施绝非易事。但对我来说,这却是我做过的最轻而易举的决定之一。” | 09-25 02:11 | 云财经 |
|
| 巴西央行行长:经济放缓符合预期。 | 09-25 00:20 | 云财经 |
|