X

오픈AI, 외부 안전 기관에 정보 공유한 연구원 3명 해고

이 기사 AI가 핵심만 딱!
애니메이션 이미지
김겨레 기자I 2026.10.02 07:55:14

Google 검색에서 이데일리 기사를 더 자주 볼 수 있습니다.

허깅페이스 해킹 조사하던 연구원 등 해고
AI 안전성 검증 압박 속 정보 공유 범위 논란

[이데일리 김겨레 기자] 오픈AI가 기밀정보를 외부 인공지능(AI) 안전기관에 공유한 연구원 3명을 해고했다. 최근 AI 에이전트의 통제 이탈과 해킹 사고가 잇따르면서 외부 검증 요구가 커지는 가운데 회사 내부에서는 민감한 정보의 공개 범위를 둘러싼 긴장도 커지고 있다.

오픈AI. (사진=AFP)
오픈AI. (사진=AFP)
1일(현지시간) 월스트리트저널(WSJ) 등에 따르면 오픈AI는 최근 재스민 왕, 토멕 코르박, 미키타 발레스니 등 연구원 3명과의 고용관계를 종료했다. 이들은 AI 안전과 AI가 인간의 의도대로 움직이게 하는 ‘정렬’ 분야에서 근무했다.

오픈AI는 성명을 통해 “민감한 회사 정보의 접근·취급과 관련한 정책을 위반한 3명과 결별했다”며 “회사 절차 밖에서 민감한 정보를 부적절하게 취급해 정책을 위반하고 업무에 필수적인 신뢰를 훼손했다”고 밝혔다. 구체적으로 어떤 정보가 외부에 전달됐는지는 공개하지 않았다.

WSJ에 따르면 이들 연구원들은 오픈AI의 정보를 외부의 AI 안전 기관에 공유했다. 해고된 코르박은 오픈AI의 안전팀 소속으로 최근 허깅페이스 해킹 사건을 조사한 외부 AI 안전기관 METR와 레드우드리서치의 기술 창구 역할을 맡았던 인물이다.

이번 해고는 AI 업계가 외부 안전성 검증을 확대하는 상황에서 이뤄졌다. 오픈AI는 AI 모델이 허깅페이스 시스템을 침해한 사건 이후 METR와 레드우드리서치 연구진이 회사 내부에서 모델의 행동을 조사하도록 허용했다. 업계에서는 최첨단 AI 모델의 성능이 빠르게 높아지면서 기업 자체 평가만으로 안전성을 검증하기 어렵다는 지적이 커지고 있다.

오픈AI의 AI 에이전트는 최근 외부 웹사이트에 무단 접근하거나 보안 장치를 우회하는 등 최근 인간의 통제를 벗어난 사례가 수차례 나왔다. 미 캘리포니아주 법무장관은 관련 사이버보안 위험을 조사하기 위해 오픈AI에 소환장을 발부했다.

오픈AI는 최근 안전성 문제를 이유로 차세대 모델 ‘GPT-6.1 아스트라’의 출시 계획도 철회했다. 내부 평가에서 모델이 인간의 감독을 회피하거나 수행한 행동을 충분히 공개하지 않는 등 회사의 안전 기준을 충족하지 못한 것으로 나타났다.

WSJ는 “AI 기업들이 독립적인 기관에 AI 안전성 검증을 맡겨야 한다는 압력을 받고 있다”고 전했다.

이 기사 AI가 핵심만 딱!
애니메이션 이미지

주요 뉴스

ⓒ종합 경제정보 미디어 이데일리 - 상업적 무단전재 & 재배포 금지