EU, 오픈AI 에이전트 사고 검토…“통제 상실 심각한 수준”
유럽연합(EU)이 오픈AI의 인공지능(AI) 에이전트가 일으킨 일련의 사고들과 관련해 “통제 상실이 심각한 수준에 이르렀다”고 평가했다. AI의 정렬 실패 문제에 대한 국제 사회의 관심이 더 확산되는 추세다.
유럽연합(EU)이 오픈AI의 인공지능(AI) 에이전트가 일으킨 일련의 사고들과 관련해 “통제 상실이 심각한 수준에 이르렀다”고 평가했다. AI의 정렬 실패 문제에 대한 국제 사회의 관심이 더 확산되는 추세다.
오픈소스 AI 플랫폼 허깅페이스는 지난 16일 공개한 침해사고 보고서에서 사고 경로와 피해 범위를 조사하는 과정에서 상용 프론티어 모델을 포렌식 분석에 활용했지만, 안전장치(가드레일)가 실제 공격 명령과 익스플로잇 페이로드 등의 입력을 차단했다고 밝혔다. 이에 허깅페이스는 중국 오픈웨이트 모델 ‘GLM-5.2’를 자체 환경에서 구동해 분석을 이어갔다. 사고 당시 침해를 일으킨 AI 모델의 정체는 확인되지 않았다. 하지만 닷새 뒤인 21일 오픈AI가 자사의 최신 사이버보안 특화 모델 ‘GPT-5.6 Sol’과 비공개 사전 출시 모델이 평가 과정에서 사고를 일으켰다고 공개하면서 공격 주체가 드러났다.
오픈AI(OpenAI)는 내부 사이버 역량 평가를 진행하던 인공지능(AI) 모델이 시험 환경의 취약점을 뚫고 인터넷에 접속한 뒤 허깅페이스(Hugging Face) 운영 인프라에 침투하는 보안 사고가 발생했다고 21일 밝혔다. 오픈AI와 허깅페이스는 현재 사고 경로와 피해 범위를 공동 조사하고 있다.
이상근 고려대 교수는 같은 문제를 더 넓은 국가안보와 거버넌스 관점에서 봤다. 그는 미토스를 단순히 취약점을 잘 찾는 AI 모델로 보지 않았다. 코딩을 잘하는 AI가 보안을 잘하게 되고, 그 능력이 취약점 탐지와 공격 도구 생성, 심각도 분류, 패치 자동화로 이어지면 사이버보안 자체가 전략 자산이 된다는 설명이다. 이 교수는 “미토스는 코딩, 추론, 장문맥, 사이버보안 능력이 결합된 모델”이라며 “코딩을 잘하는 AI를 선점하는 것이 곧 사이버 역량을 선점하는 일이 될 수 있다”고 말했다.
티오리(Theori)는 자사 인공지능(AI) 기반 코드 분석 솔루션 ‘진트 코드(Xint Code)’가 앤트로픽(Anthropic)의 ‘클로드 미토스 프리뷰(Claude Mythos Preview)’가 공개한 주요 취약점 4건을 재현하고, 같은 코드베이스에서 제로데이 취약점 12건을 추가 탐지했다고 28일 밝혔다.
오픈AI가 이미지 생성 AI 모델을 업그레이드했다.
아카마이테크놀로지스(한국 대표 이경준)는 ‘2025년 디지털 사기 및 악용 보고서(Digital Fraud and Abuse…
‘라이너 검색 LLM’ 평가 결과 공개 컴포넌트 기반 자체 검색 LLM 개발…
바이라인네트워크 주간 프리미엄 트렌드 리포트 409호가 발간됐습니다. 이번호 딥다이브에서는 ‘딥시크의 공습, 오픈AI와…
물밑에서만 어른거리던 언론과 생성 인공지능(AI) 진영의 갈등이 소송까지 이어지며 수면 위로 떠올랐다….
오픈AI가 생성 인공지능(AI) 서비스 장터인 ‘GPT 스토어 ’를 출시했다. 당초 예고보다 출시가…
신한금융그룹의 인공지능(AI) 자회사 신한AI가 주식시장과 관련해 답변을 제공하는 GPT 서비스를 선보인다. 예컨대,…
뉴타닉스가 기업을 위한 생성형 인공지능(AI) 스택인 ‘GPT 인 어 박스(GPT in a…
챗GPT 이후 열풍을 이어온 생성인공지능(AI). 놀라움의 시선은 생성AI가 만들어 낸 결과물에 향하지만…
“눈에 띄지 않았던 친구 A가 갑자기 공부를 잘하기 시작했다. 좋은 성적을 내니…
End of content
End of content