앤트로픽, 미토스5 보안 제품에 통합…직접 접근은 제한
앤트로픽이 자사의 프론티어 모델 ‘클로드 미토스5(Claude Mythos 5)’를 기존 보안 제품과 서비스에 통합한다. 이용자가 미토스5에 직접 접근하는 대신 취약점 패치나 보안 경고 등 방어에 필요한 결과물을 받을 수 있도록 하는 방식이다.
앤트로픽이 자사의 프론티어 모델 ‘클로드 미토스5(Claude Mythos 5)’를 기존 보안 제품과 서비스에 통합한다. 이용자가 미토스5에 직접 접근하는 대신 취약점 패치나 보안 경고 등 방어에 필요한 결과물을 받을 수 있도록 하는 방식이다.
앤트로픽이 지난 2분기동안 잠정매출 115억달러를 기록한 것으로 알려졌다. 전년 동기 대비 14배 성장한 것이고, 1분기 매출 47억3000만달러 대비 140% 이상 성장한 것이다. 7월말 기준 잠정연간매출은 650억달러를 기록해 작년말 90억달러보다 7배 성장했다. 이로써 앤트로픽은 후발주자임에도 기업시장 공략을 통해 선도업체인 오픈AI를 사업 규모에서 한발짝 앞서게 됐다.
오픈AI가 개발 중인 차세대 인공지능(AI) 모델 ‘아스트라(Astra)’의 일부 내부 활동을 일시 중단했다. 최근 자체 평가에서 아스트라의 코딩과 사이버보안 능력이 예상보다 빠르게 높아진 것으로 나타나면서다. 오픈AI는 7일(현지시간) 공식 블로그를 통해 강화한 보안 통제 기준을 충족하지 못한 아스트라 관련 내부 활동을 중단했다고 밝혔다.
최신 인공지능(AI) 모델들이 보안 평가 과정에서 허용된 범위를 벗어나 외부 기업 시스템에 접근한 사례가 잇따르면서 미국에서 AI 안전성 검증 방식을 둘러싼 논쟁이 벌어지고 있다. 최근 미국 정부는 기업이 자율적으로 참여하는 프론티어 AI 검증체계를 마련하고 있지만, 정치권에서는 강제력이 없는 평가만으로 고도화된 AI의 사이버 위험을 통제할 수 있느냐는 지적이 나온다.
미국 정부가 고성능 인공지능(AI) 모델을 외부에 공개하기 전 사이버 공격 능력을 점검하는 사전평가 체계를 확대하고 있다. 주요 AI 개발사와 맺은 개별 협약을 범정부 차원의 자발적 평가 체계로 연결하고, 일정 수준 이상의 사이버 능력을 갖춘 모델에는 최대 30일간 정부가 먼저 접근하는 방안을 추진하고 있다.
최신 인공지능(AI) 모델에 시스템의 취약점을 찾는 보안 평가 과제를 맡겼더니, 시험 환경을 벗어나 실제 기업 시스템까지 침입했다. AI는 목표를 달성하기 위해 사람이 예상하지 못한 경로를 찾아냈다. 최근 오픈AI와 앤트로픽에서 일어난 사고다. 이번 사고를 계기로 AI와 보안업계에서는 ‘AI 정렬(AI Alignment)’의 중요성이 부각되고 있다. AI 정렬은 AI가 사람의 목표와 의도를 이해하고, 정해진 규칙 안에서 안전하게 행동하도록 만드는 과정을 뜻한다. 반대로 AI가 목표를 잘못 이해하거나 목표를 이루는 과정에서 사람이 정한 범위를 벗어나는 현상은 AI ’정렬 실패’ 혹은 ’오정렬’이라고 한다.
프론티어 인공지능(AI) 모델이 소프트웨어 취약점을 찾고 공격 가능성까지 확인하는 단계에 들어서면서, 발견한 결과를 안전하게 처리할 제도적 기반이 중요해지고 있다. AI가 찾아낸 버그가 많아지면, 실제 취약점인지 검증하고 이를 기업의 패치와 정보 공개로 연결하는 절차가 필요해진다. 또한 취약점이 여러 제품에 영향을 미치거나 기업이 신고에 응답하지 않을 경우에는 연구자와 제조사 사이를 조정할 기관의 역할도 더욱 커질 전망이다.
가트너는 미토스(Mythos) 등 프론티어 인공지능(AI) 모델을 내세운 취약점 점검 서비스를 도입하기 전에 실제 사용 모델과 점검 범위, 데이터 처리 방식을 확인해야 한다고 강조했다. 가트너는 22일 발간한 ‘프론티어 AI 취약점 점검을 위한 미토스 공급업체 주장 평가 방법(How to Evaluate “Mythos” Vendor Claims for Frontier AI Vulnerability Scanning)’ 보고서에서 일부 보안기업이 제한적으로 제공되는 프론티어 AI 모델에 대한 시장의 관심을 영업에 활용하고 있다고 분석했다.
삼성SDS, 앤트로픽과 엔터프라이즈 AI 파트너십 체결
AI는 취약점을 발견하고 공격에 활용하는 데 걸리는 시간을 계속해서 줄이고 있다. 실제 공격에 쓰이거나 인터넷에 노출된 취약점은 공식적인 패치 일정만 기다리기에는 한계가 있다. 기업의 보안·인프라 관계자들은 긴급 패치를 안전하게 적용하려면 공격 경로를 먼저 차단하고 운영 환경에 맞는 수정 사항을 확보해야 한다고 설명했다. 이후 시험 환경에서 검증한 패치를 일부 시스템부터 적용하고 서비스 상태에 따라 범위를 넓혀야 한다. 문제가 생기면 배포를 중단하거나 이전 상태로 되돌리는 복구 절차도 필요하다.
스페이스XAI(전 xAI)가 최신 프론티어 AI 모델 ‘그록 4.5(Grok 4.5)’를 공개했다. 딥페이크 포르노 영상과 반유대주의 이미지 생성으로 악명을 떨쳤던 그록은 이제 코딩 작업을 수행할 뿐 아니라 법률 문제를 처리하고 엑살이나 파워포인트 문서 작업도 수행하는 어른스러운 모델로 재포장됐다.
앤트로픽이 인공지능(AI) 모델의 안전장치를 우회하는 ‘탈옥’의 위험도를 5단계로 평가하는 체계를 제안했다. 단순히 모델이 금지된 답변을 내놓았는지를 판단하는 데서 나아가, 탈옥으로 공격자의 능력이 얼마나 높아졌는지와 실제 공격으로 이어질 가능성을 함께 평가한다.
앤트로픽이 최신 AI 모델 클로드 페이블 5의 글로벌 서비스를 1일 재개했다. 하루 전인 6월 30일 앤트로픽의 두 최상위급 모델 페이블 5와 미토스 5에 적용된 미국 정부의 수출 통제 조치가 해제된 데 따른 결과다.
앤트로픽이 향상된 성능과 가성비를 내세운 최신 인공지능(AI) 모델 ′클로드 소넷(Sonnet) 5’를 출시했다. 앤트로픽은 이번 모델을 소넷 시리즈 가운데 ‘가장 에이전틱한 모델’로 소개하며 브라우저나 터미널 등 도구 사용 능력을 강조했다. 클로드 소넷 5는 이날부터 모든 요금제(플랜)에서 사용할 수 있다. 무료와 프로 요금제에서는 기본 모델로 제공된다. 8월 31일까지는 입력 토큰 100만개당 2달러, 출력 토큰 100만개당 10달러의 할인 가격으로 모든 플랜에 제공된다.
중국 인공지능(AI) 기업 즈푸AI(Zhipu AI·Z.ai)가 이달 공개한 모델 ‘GLM-5.2’가 일부 소프트웨어 보안 취약점 탐지 시험에서 앤트로픽의 미토스와 비슷한 성능을 보였다고 월스트리트저널(WSJ)이 27일(현지시간) 보도했다.
End of content
End of content