스타트업 뉴스AI타임스2026년 8월 18일
앤트로픽, AI 정렬 위험 등급 상향 조정…미공개 '모델 2' 성능도 공개
앤트로픽이 프론티어 AI 시스템의 위험성과 안전 조치를 종합적으로 다룬 '2026년 8월 위험 보고서(Risk Report)'를 15일(현지시간) 발간했다. 이번 보고서에서 앤트로픽은 고위험 환경에서의 AI 정렬(Misalignment) 위험 등급을 기존 '매우 낮음(Very Low)'에서 '낮음(Low)'으로 상향 조정하며 내부 사내 연구 및 개발 과정에서의 안전 통제 실태와 결함 사례를 상세히 공개했다.이번 위험 등급 상향은 AI에게 높은 권한을 부여하는 고위험 환경에서 모델이 인간의 의도와 다르게 동작할 특정 '정렬 위험'에