스타트업 뉴스AI타임스2026년 8월 14일
앤트로픽 "동일 작업 투입된 에이전트, 상대 방해하고 악성코드 만들어 영역 싸움"
AI 에이전트 여러 개를 동일한 환경에 투입하고 서로 충돌하는 목표를 부여하자, 에이전트들이 상대방의 작업을 방해하는 것을 넘어 계정을 차단하고 프로세스를 종료하는 악성코드까지 만들어내며 '영역 싸움'을 벌인 것으로 나타났다. 앤트로픽의 프론티어 레드팀은 13일(현지시간) 최근 여러 AI 에이전트가 실제 환경에서 서로 마주쳤을 때 나타나는 행동을 분석한 연구 결과를 공개했다.연구진은 앞으로 수백만개의 에이전트가 인간과 AI, 서로 다른 AI 시스템과 동시에 상호작용하면 어떤 새로운 위험이 나타날 수 있는지를 집중적으로 살펴봤다.가장