[그게 뭔가요] AI 샌드박스 탈출 사태 막을 수 있다는 ‘AI 정렬’
|

[그게 뭔가요] AI 샌드박스 탈출 사태 막을 수 있다는 ‘AI 정렬’

최신 인공지능(AI) 모델에 시스템의 취약점을 찾는 보안 평가 과제를 맡겼더니, 시험 환경을 벗어나 실제 기업 시스템까지 침입했다. AI는 목표를 달성하기 위해 사람이 예상하지 못한 경로를 찾아냈다. 최근 오픈AI와 앤트로픽에서 일어난 사고다. 이번 사고를 계기로 AI와 보안업계에서는 ‘AI 정렬(AI Alignment)’의 중요성이 부각되고 있다. AI 정렬은 AI가 사람의 목표와 의도를 이해하고, 정해진 규칙 안에서 안전하게 행동하도록 만드는 과정을 뜻한다. 반대로 AI가 목표를 잘못 이해하거나 목표를 이루는 과정에서 사람이 정한 범위를 벗어나는 현상은 AI ’정렬 실패’ 혹은 ’오정렬’이라고 한다.

마이크로소프트 “AI 신뢰의 기본은 규제 준수와 거버넌스”

마이크로소프트 “AI 신뢰의 기본은 규제 준수와 거버넌스”

“결국 인간은 신뢰하는 기술만 사용합니다. AI 기술 확산의 전제는 신뢰입니다. 그리고 신뢰의 기본은 규제와 거버넌스 준수에서 시작됩니다.” 페츠너 고문은 AI 확산을 기술 경쟁만의 문제가 아니라 신뢰의 문제로 풀었다. 그는 클라우드 확산기에도 신뢰가 핵심이었고, AI 시대에는 그 중요성이 더 커졌다고 말했다. 기술이 널리 쓰이려면 성능보다 먼저 안전장치와 통제 구조를 갖춰야 한다는 설명이다.

End of content

End of content