[그게 뭔가요] AI 샌드박스 탈출 사태 막을 수 있다는 ‘AI 정렬’
|

[그게 뭔가요] AI 샌드박스 탈출 사태 막을 수 있다는 ‘AI 정렬’

최신 인공지능(AI) 모델에 시스템의 취약점을 찾는 보안 평가 과제를 맡겼더니, 시험 환경을 벗어나 실제 기업 시스템까지 침입했다. AI는 목표를 달성하기 위해 사람이 예상하지 못한 경로를 찾아냈다. 최근 오픈AI와 앤트로픽에서 일어난 사고다. 이번 사고를 계기로 AI와 보안업계에서는 ‘AI 정렬(AI Alignment)’의 중요성이 부각되고 있다. AI 정렬은 AI가 사람의 목표와 의도를 이해하고, 정해진 규칙 안에서 안전하게 행동하도록 만드는 과정을 뜻한다. 반대로 AI가 목표를 잘못 이해하거나 목표를 이루는 과정에서 사람이 정한 범위를 벗어나는 현상은 AI ’정렬 실패’ 혹은 ’오정렬’이라고 한다.

스페이스XAI, ‘그록 4.5’ 출시…“오푸스급이고 더 싸다”
|

스페이스XAI, ‘그록 4.5’ 출시…“오푸스급이고 더 싸다”

스페이스XAI(전 xAI)가 최신 프론티어 AI 모델 ‘그록 4.5(Grok 4.5)’를 공개했다. 딥페이크 포르노 영상과 반유대주의 이미지 생성으로 악명을 떨쳤던 그록은 이제 코딩 작업을 수행할 뿐 아니라 법률 문제를 처리하고 엑살이나 파워포인트 문서 작업도 수행하는 어른스러운 모델로 재포장됐다.

CJ온스타일, ‘클로드 엔터프라이즈’ 전사 공식 AI 플랫폼으로 도입

CJ온스타일, ‘클로드 엔터프라이즈’ 전사 공식 AI 플랫폼으로 도입

CJ온스타일이 앤트로픽의 기업용 생성형 AI 솔루션 ‘클로드 엔터프라이즈(Claude Enterprise)’를 전사 공식 AI 플랫폼으로 도입한다. 앞서 챗GPT 쇼핑 서비스 출시로 AI 기반 고객 경험을 혁신했다면, 이번 도입으로 기업 운영 전반에도 AI를 내재화해 AI를 기업 경쟁력 핵심 인프라로 구축한다는 목표다. 

[미토스 이후, 전문가에게 듣는다⑨] 보안 전문가들이 본 AI 시대의 사이버보안, 무엇이 달라졌나
| | |

[미토스 이후, 전문가에게 듣는다⑨] 보안 전문가들이 본 AI 시대의 사이버보안, 무엇이 달라졌나

미토스 이후의 변화에 대해 국내 보안 전문가들의 진단을 종합하면 이렇다. “미토스는 단순히 취약점을 잘 찾는 AI 모델이 아니라, 사이버 공격의 비용과 속도, 방어자의 대응 구조, 국가안보와 기업 거버넌스의 전제를 함께 흔드는 강력한 신호”라는 것이다.

[미토스 이후, 전문가에게 듣는다⑧] 김창훈 대구대 교수 “AI 위협, 사이버 팬데믹처럼 대응해야”
| | |

[미토스 이후, 전문가에게 듣는다⑧] 김창훈 대구대 교수 “AI 위협, 사이버 팬데믹처럼 대응해야”

김창훈 대구대학교 컴퓨터정보공학부 교수는 미토스 이후 국내 AI 보안 대책이 보안 특화 모델 개발, 취약점 탐지, 빠른 패치 등 일부분에 매몰돼 있다고 지적했다. 모두 필요한 과제지만, 당장 공격자가 어디를 노릴지와 실제로 어떻게 막을지를 먼저 봐야 한다는 지적이다. 김 교수는 “본질은 막는 것”이라며 “취약점을 찾고 패치를 빨리 하자는 논의와 대책이 나오고 있지만, 정작 어디가 공격받을 가능성이 큰지, 그 기관을 실제로 어떻게 보호할지에 대한 현실적인 논의는 부족한 실정”이라고 짚었다.

스노우플레이크, 엔트로픽과 엔터프라이즈AI 연합
|

스노우플레이크, 엔트로픽과 엔터프라이즈AI 연합

스노우플레이크가 앤트로픽과 파트너십을 확대하고, 클로드 모델과 스노우플레이크 생성형 AI 제품을 통합해 기업용 AI 시장을 공략한다. 스노우플레이크의 플랫폼은 앤트로픽의 프론티어 모델을 네이티브로 통합하고, 앤트로픽 클로드 모델은 스노우플레이크 플랫폼의 보안과 거버넌스 역량 하에 놓인다.

End of content

End of content