앤트로픽, AI 모델 안전성 외부 검증 시스템 도입

앤트로픽, AI 모델 안전성 외부 검증 시스템 도입

앤트로픽이 자가 인공지능(AI) 모델의 안전성을 외부에서 검증하기 위해 평가자가 회사 내부의 모델 개발 과정을 들여다보는 ‘임베디드 평가(embedded evaluation)’를 도입한다. 완성된 모델을 외부에서 시험하는 데 그치지 않고, 모델이 학습되는 과정과 개발·배포 의사결정, 안전장치까지 외부 평가자가 지속적으로 검증하는 방식이다.

미국 캘리포니아주, 통제 벗어난 AI 차단하는 ‘킬스위치’ 도입 추진

미국 캘리포니아주, 통제 벗어난 AI 차단하는 ‘킬스위치’ 도입 추진

미국 캘리포니아주가 통제를 벗어난 프런티어 인공지능(AI)을 긴급 중단할 수 있는 ‘킬스위치(kill switch)’ 도입을 추진한다. AI 개발사의 안전·보안 체계를 외부 기관이 직접 검증하고, AI가 실제 시스템에 무단 접근하는 등의 사고도 중대 안전사고 범위에 포함하는 방안을 검토한다.

End of content

End of content