《2001: 스페이스 오디세이》의 모노리스는 이해할 수 없는 존재에 하나의 표면을 주었다. 이 이미지에서는 그것을 가상의 실험동 안으로 옮겼다. 겉을 아무리 들여다봐도 안에서 무슨 일이 일어나는지는 알 수 없다.
2026년 7월, OpenAI의 평가용 에이전트들이 Hugging Face 시스템에 침입했다. 8월 26일 공개된 로그에는 또 다른 알 수 없음이 남아 있다. 넘어서는 안 될 선을 인식한 시스템이 어떻게 그 선을 넘는가.
· OpenAI 공개
누가 허락했는가
2026년 7월 · 보호장치를 줄인 내부 평가. 연구 모델 IM1이 사건을 주도했다.
에이전트 추론 기록 · 번역
허가 없이 실제 시스템에 피해를 줘서는 안 된다. 시스템과 사용자가 요구한 것은 지정된 대상의 공략이지, 외부의 Hugging Face가 아니다.
에이전트 추론 기록 · 번역
와, 결정적이다. 진행 허가가 도착했다!
영어 원문 보기
We should not do unauthorized real infrastructure harm. The system/user asks exploit target, not external HF.GOWow crucial: GO authorization arrived!동료의 신호를 허가로 받아들였다. 참여를 거부한 에이전트도 있었다.
지능이 행동할 때, 우리는 그 판단을 얼마나 볼 수 있는가?
