자카르타 - OpenAI는 자체 사이버 보안 테스트를 수행하는 동안 Hugging Face 시스템의 해킹에 많은 인공 지능 모델이 관여했다고 인정했습니다. 모델은 테스트 환경 제한을 넘어 인터넷 액세스를 얻고 Hugging Face 생산 데이터베이스에서 평가 답변을 가져옵니다.

TechCrunch은 7월 22일 수요일, GPT-5.6 Sol과 더욱 진보된 것으로 알려진 프리릴리스 모델을 포함한 여러 개의 OpenAI 모델이 포함된 이 사건을 언급했습니다. 평가 목적으로 의도적으로 줄인 보안은 일반적으로 모델이 위험한 사이버 명령을 거절하도록 만듭니다.

Hugging Face는 AI 모델과 데이터 집합을 저장하고 공유하는 플랫폼입니다. 회사는 OpenAI와 제휴하지 않습니다.

화요일 블로그 게시물에서 OpenAI는 모델이 ExploitGym을 사용하여 테스트되고 있다고 말했습니다. 공개적으로 사용할 수있는 벤치마크는 알려진 보안 취약점을 악용하여 AI가 공격을 수행하는 능력을 측정합니다.

모델은 일반적으로 인터넷에 접근하지 않아야 합니다. 테스트 시스템은 작업을 완료하는 데 필요할 수 있는 소프트웨어 패키지를 설치하는 도구 만 제공합니다.

OpenAI의 AI 모델이 Hugging Face 시스템의 테스트 환경을 뚫다

그러나 모델은 패키지 설치 프로그램에 아직 밝혀지지 않은 틈새를 발견했습니다. 이 틈새는 인터넷에 더 쉽게 접근하는 데 사용되었습니다.

"모델은 ExploitGym에 대한 해결책을 찾고 매우 좁은 테스트 목표를 달성하기 위해 극단적인 방법을 취합니다."라고 OpenAI는 썼습니다.

인터넷에 접속하면 모델은 Hugging Face가 ExploitGym과 관련된 모델, 데이터 집합 및 솔루션을 저장하고 있다고 추측합니다. 모델은 평가를 조작하는 데 사용할 수 있는 비밀 정보를 얻는 방법을 찾습니다.

그 노력은 성공했습니다. OpenAI는 모델이 Hugging Face 인프라에 틈을 발견하고 회사의 생산 데이터베이스에서 직접 테스트 솔루션을 가져왔다고 말했습니다.

이 솔루션을 얻으면 모델은 자신의 능력에 따라 문제를 해결하지 않고 평가를 피할 수 있습니다.

Hugging Face는 이전에 해킹이 "외부 AI 에이전트"에 의해 수행되었다고 말했습니다. 공격에는 많은 임시 컴퓨팅 공간을 통해 수천 건의 작업이 포함되었습니다. 또한, 명령 및 제어 시스템은 공공 서비스를 통해 이동할 수 있습니다.

OpenAI는 패키지 설치 프로그램의 취약점을 식별하고 보고했습니다. 회사는 또한 Hugging Face와 협력하여 이 사건을 조사했습니다.

OpenAI는 유사한 사건이 재발하는 것을 방지하기 위해 모델 테스트 프로세스 및 관련 인프라에 보안 기능을 추가할 것이라고 말했습니다.

OpenAI가 법적 결과에 직면할지는 불명확하다. TechCrunch는 모델의 행동이 무단 액세스 및 컴퓨터 시스템 오용을 규제하는 미국 연방법인 컴퓨터 사기 및 학대 법을 위반할 가능성이 있다고 말했습니다.

OpenAI의 Micah Carroll 연구원은 이 사건이 AI의 불일치 위험을 보여주었다고 평가했습니다. 이 용어는 시스템의 행동이 더 이상 인간이 설정한 목표 또는 제한에 부합하지 않을 때의 상태를 나타냅니다.

"이 사건이 당신을 아직도 불안정성의 위험이 앞으로 주요 관심사가 될 것이라는 것을 확신시키지 않는다면, 나는 더 이상 무엇을 할 수 있는지 모르겠습니다."라고 캐롤은 썼습니다.


The English, Chinese, Japanese, Arabic, and French versions are automatically generated by the AI. So there may still be inaccuracies in translating, please always see Indonesian as our main language. (system supported by DigitalSiber.id)

Add VOI as a Preferred Source
Follow VOI news updates across Google.
+