알리바바, 최대 30초 영상 생성 모델 ‘완3.0’ 베타 공개
알리바바가 최대 30초 길이의 영상을 생성할 수 있는 ‘완(Wan)3.0’ 베타 버전을 11일 공개했다. 텍스트와 이미지뿐 아니라 영상, 오디오, 웹페이지, PDF, 파워포인트 등 다양한 자료를 참조 입력으로 활용할 수 있는 것이 특징이다.
알리바바가 최대 30초 길이의 영상을 생성할 수 있는 ‘완(Wan)3.0’ 베타 버전을 11일 공개했다. 텍스트와 이미지뿐 아니라 영상, 오디오, 웹페이지, PDF, 파워포인트 등 다양한 자료를 참조 입력으로 활용할 수 있는 것이 특징이다.
정부가 추진하는 독자 인공지능(AI) 파운데이션 모델(독파모) 프로젝트의 2차 단계평가가 이달 11일 마무리된다. 지난 8일부터 진행된 국민평가단 200명의 사용자 평가가 종료되고 이르면 12일 전후로 최종 3차 평가에 진출할 3개 정예팀이 발표될 예정이다.
“텍스트 중심의 AI 보안 체계는 한계점이 명확합니다. 이제는 멀티모달(multimodal) 환경에서 보안 패러다임을 바꿔야 합니다.” 김기홍 샌즈랩 대표는 16일 서울 삼성동 코엑스에서 열린 ‘제32회 정보통신망 정보보호 컨퍼런스(NetSec-KR) 2026’에서 이렇게 말했다. 김 대표는 이날 ‘멀티모달 AI 공격 표현 확장에 따른 보안 패러다임 변화’를 주제로 발표했다. 그는 “거대언어모델(LLM)이 이미지, 음성, 영상, 파일 등 다양한 형식의 데이터를 함께 처리하는 멀티모달 방식으로 진화하고 있다”며 “텍스트 중심 방어만으로는 이런 입력을 조합한 새로운 공격을 막기 어려워졌다”고 설명했다.
카카오가 한국어 맥락 이해에 최적화된 통합 멀티모달 언어모델 2종 성능을 공개했다. 카카오는…
오픈AI가 기존의 GPT를 한 단계 더 진화시킨거대언어모델(LLM) ‘GPT-4 터보(Turbo)’를 발표했다. 더 최신…
인공지능(AI)이 뚝딱 글을 만들어 주는 세상. 입력한 텍스트를 분석해 글로 풀어주는 생성AI는…
챗GPT 이후 초거대 언어모델 GPT의 진화가 계속되고 있다. 지난 14일에는 오픈AI가 차세대…
지난해 인기를 끌었던 에코백스 T9의 후속작, 올인원 로봇청소기 에코백스가 출시됐다. 에코백스 한국…
End of content
End of content