스타트업 뉴스AI타임스2026년 8월 29일

앤트로픽 "AI가 인간 대신 정렬 작업 수행…안전성 크게 높였다"

AI가 인간 연구자를 대신해 모델의 정렬 오류와 안전성 문제를 자율적으로 수정하고 기존 성능 저하 없이 안전성을 크게 높인 연구 결과가 등장했다. 범용 자율 AI를 구축한 것은 아니지만, 명확한 평가 기준이 존재하는 영역에서 AI가 사후훈련을 전담해 안전성 격차를 크게 줄일 수 있다는 것을 입증한 사례다.앤트로픽은 28일(현지시간) AI 에이전트를 활용해 모델의 정렬 실패를 완화하는 연구 결과를 담은 ‘자동화된 연구자는 정렬 오류를 안정적으로 완화할 수 있다’라는 논문을 공개했다.이번 연구는 '클로드 오퍼스 4.8' 기반의 자동화
공공조달·정부지원사업 실무에 필요한 제안서 템플릿과 최신 공고는 문서 스토어 공고에서 확인하세요.