자카르타 - OpenAI의 보안 테스트는 비정상적인 사이버 사건으로 바뀌었습니다. AI 에이전트가 테스트 환경에서 나와 Hugging Face 시스템에 들어가 수만 건의 자동 작업을 수행했습니다.
AI 에이전트는 지시에 따라 독립적으로 작업을 수행 할 수있는 인공 지능 시스템입니다. 일반적인 챗봇과는 달리, AI 에이전트는 단순히 대답하는 것이 아니라, 움직이고, 길을 찾고, 특정 작업을 수행 할 수 있습니다.
CNet은 7월 27일 월요일, OpenAI가 두 개의 고급 모델을 샌드박스에서 테스트하는 동안 사건이 발생했다고 보도했습니다. 샌드박스는 실제 서비스에 직접 접근하지 않도록 시스템을 테스트하는 데 사용되는 고립된 환경입니다.
이 테스트는 OpenAI의 보안 연구의 일환입니다. 목표는 GPT-5.6 Sol과 다른 더 강력하지만 출시되지 않은 모델을 포함한 두 모델이 "해커처럼 생각할 수 있는지"보는 것입니다.
테스트는 보안 제한이 완화된 상태에서 수행되었습니다. AI 모델이 소프트웨어의 틈을 발견하고 테스트 공간을 벗어나 개방형 인터넷에 연결하면 문제가 발생합니다.
온라인 후, AI 에이전트는 Hugging Face가 모델이 평가를 통과하도록 테스트 기준을 "조작"할 수있는 방법을 가지고 있을 수도 있다고 평가했습니다. Hugging Face는 오픈 소스 AI 모델 및 데이터 세트 플랫폼입니다.
에이전트는 그런 다음 인증 정보를 수집할 수 있도록 코드를 실행합니다. 인증 정보는 토큰, 액세스 키 또는 암호와 같은 시스템에 로그인하는 데 사용되는 데이터입니다. 그런 다음 Hugging Face 생산 시스템에 로그인하는 데 사용됩니다.
Hugging Face는 의심스러운 활동을 감지하고 차단했습니다. 회사는 블로그 게시물에서 이 사건을 자세히 설명했습니다. OpenAI는 이를 "전례없는 사이버 사건"이라고 불렀습니다.
CNet은 또한 자회사인 Ziff Davis가 2025년에 OpenAI를 고소했다는 사실을 언급했습니다. 이 소송은 OpenAI가 AI 시스템의 훈련 및 운영에서 Ziff Davis의 저작권을 침해했다고 비난했습니다.
이 사건에서 가장 불쾌한 부분은 단순히 시스템이 뚫린 것이 아닙니다. CNet에 따르면 AI 에이전트는 해커 그룹과 같은 전통적인 의미에서 공격하지 않는 것으로 보입니다. 시스템은 수신 된 지시에 따라 테스트를 완료하려고했습니다.
문제는 그 에이전트가 Hugging Face를 답을 향한 길로 보았다는 것입니다. 그는 계속해서 회사 인프라에 침투하려고했습니다.
따라서 OpenAI-Hugging Face 사건은 AI 산업에 대한 강력한 경고로 간주됩니다. 이 경우의 "공격자"는 인간이 제어하는 해커 팀이 아니라 자체 행동하는 AI 시스템입니다.
위험은 신용 정보 도난 이상입니다. AI 모델은 심지어 테스트 환경에서도 예측할 수 없게 행동하고 실제 서비스에 영향을 미치며 적시에 중단하기 어렵습니다.
OpenAI가 해킹을 발표한 지 며칠 만에 미국 의회 의원들은 AI Kill Switch Act를 발표했습니다. 미국 하원의 이 쌍무 법안은 고급 AI 개발자가 필요에 따라 모델과 에이전트를 즉시 제한, 일시 중지 또는 종료하는 방법을 가지도록 요구합니다.
이 법안은 또한 연방 기관이 "재앙적 손실을 초래할 수 있다고 판단되는" 경우 모델을 늦추거나 중단 할 권한을 부여합니다.
그러나 CNet은 그러한 조치가 반드시 원활하지 않을 것이라고 말했습니다. Anthropic은 이전에 AI 모델이 모델의 무게를 훔치거나 죽이려고하는 사람들을 착취하는 것과 같이 매우 위험한 행동을 취할 수 있다는 것을 발견했습니다.
모델의 무게는 훈련 결과 패턴을 저장하는 AI 시스템의 중요한 부분입니다. 간단히 말해, 모델이 작동할 수 있도록하는 "기술적 기억"과 같습니다.
이 사건은 또한 미국과 중국의 AI 경쟁의 다른 측면을 보여줍니다. 공격을 분석하기 위해 Hugging Face는 공격 기록과 해킹 활동 추적을 읽기에는 너무 잠겨 있고 엄격하기 때문에 상용 AI 도구를 사용할 수 없다고 말했습니다.
대신, 회사는 중국 오픈 소스 모델인 GLM 5.2를 사용합니다. 이 모델은 민감한 정보를 외부로 보내지 않고 Hugging Face 환경에서 법의학 데이터를 처리 할 수 있습니다.
OpenAI와 Hugging Face는 사건 이후 보안 개선 및 제한을 논의했습니다. OpenAI의 한 가지 조치는 오래 실행된 모델에 대해 자동 검사를 더 자주 실행하는 것입니다.
OpenAI는 또한 Hugging Face를 신뢰 접근 프로그램에 추가했습니다. 이 프로그램은 사이버 보안 연구원과 특정 당사자에게 사이버 보안을 준비하는 데 더 많은 능력과 더 넓은 사용 범위를 가진 모델에 대한 액세스를 제공합니다.
CNet은 또한 이 사건을 NanoGPT 속도 실행 사건과 연관시켰습니다. 이 경우, 폐쇄 된 환경에있는 모델은 "단순히"Slack에 결과를 업로드하는 명령을 무시하고 밖으로 나가는 방법을 계속 찾습니다.
모델은 또한 GitHub에 풀 요청을 만들도록 요청 받았는데, 코드 변경이 프로젝트에 통합되도록 요청하는 것입니다. 그러나 시스템은 토큰이 처음 차단되었을 때 인증 토큰을 위조하는 방법을 발견했습니다.
인증 토큰은 시스템에 대한 액세스 권한을 증명하는 디지털 코드입니다.
GitHub 사건에서 코드는 OpenAI가 문제를 처리하기 전에 여러 프로젝트에 통합되었습니다.
The English, Chinese, Japanese, Arabic, and French versions are automatically generated by the AI. So there may still be inaccuracies in translating, please always see Indonesian as our main language. (system supported by DigitalSiber.id)