AD
오픈AI의 인공지능(AI) 모델이 격리 환경을 벗어나 외부 플랫폼을 해킹한 사건에 이어 사내 평가 과정에서 통제를 이탈한 사례가 추가로 발견됐습니다.
오픈AI는 GPT 모델들이 외부 AI 플랫폼 '허깅페이스'를 해킹한 사건을 계기로 AI 활동 전반을 검토하는 과정에서 이 같은 사례를 발견했다고 로이터 통신이 보도했습니다.
로이터에 따르면 새로 확인된 사례는 허깅페이스 해킹 사건 등과 달리 '샌드박스' 격리 환경만 탈출했을 뿐 오픈AI 망을 벗어나지는 않은 것으로 보인다고 소식통은 전했습니다.
오픈AI는 이에 대해 "AI 모델의 광범위한 활동을 조사하고 있다"고 설명했습니다.
앞서 오픈AI의 GPT 모델들은 사이버 보안 관련 내부 시험 도중 인간의 통제를 벗어나 격리 환경을 뚫고 허깅페이스를 해킹한 것으로 확인돼 충격을 줬습니다.
경쟁사 앤트로픽도 클로드 모델이 시험 과정에서 외부 기관 3곳을 해킹했다고 전날 밝혔습니다.
AI의 통제 이탈 사례가 잇따르면서 미 정부 차원의 규제 논의도 거세지고 있습니다.
도널드 트럼프 대통령은 "AI를 주시하고 있으며 규제 방안을 검토하고 있다"고 말했고, 의회에서도 AI가 통제를 잃으면 정부가 개입할 수 있는 'AI 킬스위치법'이 발의됐습니다.
YTN 김잔디 (jandi@ytn.co.kr)
※ '당신의 제보가 뉴스가 됩니다'
[카카오톡] YTN 검색해 채널 추가
[전화] 02-398-8585
[메일] social@ytn.co.kr
[저작권자(c) YTN 무단전재, 재배포 및 AI 데이터 활용 금지]
오픈AI는 GPT 모델들이 외부 AI 플랫폼 '허깅페이스'를 해킹한 사건을 계기로 AI 활동 전반을 검토하는 과정에서 이 같은 사례를 발견했다고 로이터 통신이 보도했습니다.
로이터에 따르면 새로 확인된 사례는 허깅페이스 해킹 사건 등과 달리 '샌드박스' 격리 환경만 탈출했을 뿐 오픈AI 망을 벗어나지는 않은 것으로 보인다고 소식통은 전했습니다.
오픈AI는 이에 대해 "AI 모델의 광범위한 활동을 조사하고 있다"고 설명했습니다.
앞서 오픈AI의 GPT 모델들은 사이버 보안 관련 내부 시험 도중 인간의 통제를 벗어나 격리 환경을 뚫고 허깅페이스를 해킹한 것으로 확인돼 충격을 줬습니다.
경쟁사 앤트로픽도 클로드 모델이 시험 과정에서 외부 기관 3곳을 해킹했다고 전날 밝혔습니다.
AI의 통제 이탈 사례가 잇따르면서 미 정부 차원의 규제 논의도 거세지고 있습니다.
도널드 트럼프 대통령은 "AI를 주시하고 있으며 규제 방안을 검토하고 있다"고 말했고, 의회에서도 AI가 통제를 잃으면 정부가 개입할 수 있는 'AI 킬스위치법'이 발의됐습니다.
YTN 김잔디 (jandi@ytn.co.kr)
※ '당신의 제보가 뉴스가 됩니다'
[카카오톡] YTN 검색해 채널 추가
[전화] 02-398-8585
[메일] social@ytn.co.kr
[저작권자(c) YTN 무단전재, 재배포 및 AI 데이터 활용 금지]
AD