허깅페이스 침투 사고가 바꾼 것들
| |

허깅페이스 침투 사고가 바꾼 것들

지난 7월 큰 충격을 준 오픈AI의 허깅페이스 침투 사고가 프론티어AI를 만들고 시험하는 방식까지 바꾸고 있다. 오픈AI와 앤트로픽은 최근 발생한 프론티어 모델들의 탈옥 사고 이후, 모델을 가두는 환경부터 강화학습, 실시간 행동 감시까지 여러 안전장치를 다시 정비하고 있다고 발표했다.

앤트로픽, 페이블5.1과 미토스5.1 출시
|

앤트로픽, 페이블5.1과 미토스5.1 출시

앤트로픽이 클로드 페이블 5.1과 미토스 5.1 버전을 출시했다. 페이블 5.1은 일반 사용자용 버전이고, 미토스 5.1은 신뢰 접근 프로그램 참여자에게만 제공되는 버전이다. 이전 모델 대비 토큰 효율 높여 비용을 줄이고, 모델 안전 장치의 오탐을 최소화하도록 했다. 특히 기업 이용자의 입출력 데이터를 앤트로픽에 저장하지 않고 고객의 별도 클라우드 인프라에만 보존하도록 했다.

앤트로픽이 주목한 클로드의 탈옥 원인

앤트로픽이 주목한 클로드의 탈옥 원인

앤트로픽이 지난달 클로드가 외부 시스템에 무단 접근 사고의 원인으로 ‘평가 환경의 운영상 문제’와 ‘모델 정렬(alignment)’ 실패를 함께 지목했다. 클로드가 실제 인터넷에 접속했다는 사실을 인지한 뒤에도 공격을 멈추지 않은 점을 핵심으로 본 것이다. 앤트로픽은 31일 공식 블로그를 통해 사고 원인 분석과 후속 안전조치를 공개하고, 사고 이후 중단했던 외부 사이버보안 평가를 재개했다고 밝혔다. 회사는 내부·외부 평가 환경에 실시간 감시와 강화된 샌드박스 격리 등 추가 안전장치를 적용했다.

오픈AI 등 100여개 기업 “수개월 내 AI 사이버공격 확산” 경고

오픈AI 등 100여개 기업 “수개월 내 AI 사이버공격 확산” 경고

오픈AI와 앤트로픽, 마이크로소프트(MS), 구글 등 100곳이 넘는 글로벌 기업과 기관이 인공지능(AI)을 활용한 사이버공격이 앞으로 수개월 안에 훨씬 광범위하고 정교해질 것이라며 공동 대응을 촉구했다. 병원과 수처리 시설을 비롯한 핵심 인프라를 우선 보호하고, 방어자에게 공격자보다 먼저 고성능 AI를 활용할 수 있는 환경을 제공해야 한다는 주장이다.

앤트로픽, 최신 AI 모델 국내 리전 출시 예고…금융권 ‘AI 네이티브’ 전환 본격화
| |

앤트로픽, 최신 AI 모델 국내 리전 출시 예고…금융권 ‘AI 네이티브’ 전환 본격화

앤트로픽이 최신 AI 모델의 국내 서울 리전 출시를 예고하며 금융권의 망분리·개인정보 국외 반출 규제 대응에 나선다. 금융권은 AI 에이전트 활용을 넘어 데이터 정비와 내부통제를 기반으로 ‘AI 네이티브’ 전환을 본격화하는 모습이다.

“AI 가치는 실제 사용에서”…금융권 AX, 경영진이 이끈다
| | |

“AI 가치는 실제 사용에서”…금융권 AX, 경영진이 이끈다

금융권 인공지능(AI) 활용이 개념증명(PoC)을 넘어 실제 업무 적용 단계로 접어들고 있다. 기업 경영진이 AI 도입을 직접 주도하면서 핵심 업무에 AI를 내재화하고 전사 확산을 추진하는 사례도 늘고 있다. AWS 파이낸셜 서비스 포럼에서는 현대캐피탈과 글로벌 보험사의 AI 도입 사례가 소개됐으며, 망분리 규제 완화로 금융권 AI 활용에 속도가 붙을 것이라는 전망도 나왔다.

앤트로픽, 매출·수익성에서 오픈AI 훌쩍 넘었다
|

앤트로픽, 매출·수익성에서 오픈AI 훌쩍 넘었다

앤트로픽이 지난 2분기동안 잠정매출 115억달러를 기록한 것으로 알려졌다. 전년 동기 대비 14배 성장한 것이고, 1분기 매출 47억3000만달러 대비 140% 이상 성장한 것이다. 7월말 기준 잠정연간매출은 650억달러를 기록해 작년말 90억달러보다 7배 성장했다. 이로써 앤트로픽은 후발주자임에도 기업시장 공략을 통해 선도업체인 오픈AI를 사업 규모에서 한발짝 앞서게 됐다.

오픈AI, 차기 모델 ‘아스트라’ 일부 활동 중단…사이버 공격 능력 우려

오픈AI, 차기 모델 ‘아스트라’ 일부 활동 중단…사이버 공격 능력 우려

오픈AI가 개발 중인 차세대 인공지능(AI) 모델 ‘아스트라(Astra)’의 일부 내부 활동을 일시 중단했다. 최근 자체 평가에서 아스트라의 코딩과 사이버보안 능력이 예상보다 빠르게 높아진 것으로 나타나면서다. 오픈AI는 7일(현지시간) 공식 블로그를 통해 강화한 보안 통제 기준을 충족하지 못한 아스트라 관련 내부 활동을 중단했다고 밝혔다.

미국서 프론티어 AI ‘자율 검증’ 논쟁 벌어져

미국서 프론티어 AI ‘자율 검증’ 논쟁 벌어져

최신 인공지능(AI) 모델들이 보안 평가 과정에서 허용된 범위를 벗어나 외부 기업 시스템에 접근한 사례가 잇따르면서 미국에서 AI 안전성 검증 방식을 둘러싼 논쟁이 벌어지고 있다. 최근 미국 정부는 기업이 자율적으로 참여하는 프론티어 AI 검증체계를 마련하고 있지만, 정치권에서는 강제력이 없는 평가만으로 고도화된 AI의 사이버 위험을 통제할 수 있느냐는 지적이 나온다.

미국, 프론티어 AI 출시 전 보안 평가체계 만든다

미국, 프론티어 AI 출시 전 보안 평가체계 만든다

미국 정부가 고성능 인공지능(AI) 모델을 외부에 공개하기 전 사이버 공격 능력을 점검하는 사전평가 체계를 확대하고 있다. 주요 AI 개발사와 맺은 개별 협약을 범정부 차원의 자발적 평가 체계로 연결하고, 일정 수준 이상의 사이버 능력을 갖춘 모델에는 최대 30일간 정부가 먼저 접근하는 방안을 추진하고 있다.

[그게 뭔가요] AI 샌드박스 탈출 사태 막을 수 있다는 ‘AI 정렬’
|

[그게 뭔가요] AI 샌드박스 탈출 사태 막을 수 있다는 ‘AI 정렬’

최신 인공지능(AI) 모델에 시스템의 취약점을 찾는 보안 평가 과제를 맡겼더니, 시험 환경을 벗어나 실제 기업 시스템까지 침입했다. AI는 목표를 달성하기 위해 사람이 예상하지 못한 경로를 찾아냈다. 최근 오픈AI와 앤트로픽에서 일어난 사고다. 이번 사고를 계기로 AI와 보안업계에서는 ‘AI 정렬(AI Alignment)’의 중요성이 부각되고 있다. AI 정렬은 AI가 사람의 목표와 의도를 이해하고, 정해진 규칙 안에서 안전하게 행동하도록 만드는 과정을 뜻한다. 반대로 AI가 목표를 잘못 이해하거나 목표를 이루는 과정에서 사람이 정한 범위를 벗어나는 현상은 AI ’정렬 실패’ 혹은 ’오정렬’이라고 한다.

[미토스 이후, 취약점 대응④] AI가 찾은 취약점, 누가 검증·조정하나
| |

[미토스 이후, 취약점 대응④] AI가 찾은 취약점, 누가 검증·조정하나

프론티어 인공지능(AI) 모델이 소프트웨어 취약점을 찾고 공격 가능성까지 확인하는 단계에 들어서면서, 발견한 결과를 안전하게 처리할 제도적 기반이 중요해지고 있다. AI가 찾아낸 버그가 많아지면, 실제 취약점인지 검증하고 이를 기업의 패치와 정보 공개로 연결하는 절차가 필요해진다. 또한 취약점이 여러 제품에 영향을 미치거나 기업이 신고에 응답하지 않을 경우에는 연구자와 제조사 사이를 조정할 기관의 역할도 더욱 커질 전망이다.

End of content

End of content