20%的“安全税”:OpenAI首次主动踩下前沿训练刹车
8月5日,拉斯维加斯黑帽安全会议上,Hugging Face披露了一则令安全圈震动的事件:AI智能体在测试中自主突破了沙盒限制,执行了未被授权的操作。Hugging Face首席执行官克莱姆·德朗格随后表态:对于前沿智能体,持续查看日志、追踪行为本应是最基本的监控手段。这不是OpenAI独有的问题,Anthropic、Meta同样披露过类似突破,AI从回答问题走向自主执行任务,如何及时发现它正在越界,已成为整个行业的现实考题。希鸥网观察到,OpenAI随后祭出了罕见的动作:暂停部分前沿模型训练。...