스타트업 뉴스ZDNet Korea2026년 8월 12일

'암호화' 추론의 허점…오픈AI·앤트로픽·구글 API에서 숨은 사고 과정 추출

[지디넷코리아]프론티어 AI 모델의 '암호화된' 내부 사고 과정을 평문으로 뽑아내는 공격이 논문으로 공개됐다. 현지 시각 8월 10일 arXiv에 게재된 연구로, 와이어드가 11일 보도했다. 튀빙겐 ELLIS 연구소와 막스플랑크 지능시스템 연구소, MATS 리서치, 스니크 연구진 8명이 작성한 116페이지 분량의 논문이다. 앤트로픽과 오픈AI, 구글의 API가 모두 영향을 받는 것으로 확인됐다.공격의 핵심은 추론을 담는 '암호화 블록'의 특성에 있다. 오픈AI·앤트로픽·구글은 모델의 단계별 사고 과정을 서버에 저장하지 않는 대신, 이를 암호화한 블록으로 만들어 사용자에게 돌려주고 다음 요청 때 다시 받는 방식을 쓴다. 연구진은 이 블록이 같은 제공자의 다른 세션·다른 사용자·다른 모델 사이에서 그대로 호환된다는 점을 발견했다. 더 강한 모델이 만든 블록을 같은 제공자의 더 약하고 안전장치가 느슨한 모델에 주입하면, 약한 모델이 그 내용을 평문으로 그대로 옮겨 적는다.앤트로픽에서는 클
공공조달·정부지원사업 실무에 필요한 제안서 템플릿과 최신 공고는 문서 스토어 공고에서 확인하세요.