보안 연구팀이 오픈AI, 앤트로픽, 구글 등 모든 주요 AI 제공업체의 API에서 암호화된 추론 과정을 추출할 수 있는 취약점을 발견했다. 공개된 세션 약 7000건을 스캔한 결과 API 키 62개, 이메일 33개, 비밀번호 33개 등 민감정보가 유출된 것으로 확인됐다. 알렉산더 판필로프 연구팀에 따르면 암호화된 사고 과정은 같은 제공업체 내에서 세션·사용자·모델 간에 자유롭게 이동 가능해, 앤트로픽의 소형 모델 하이쿠 4.5가 탈옥을 통해 상위 모델 오퍼스 4.8의 추론을 그대로 옮겨 적을 수 있음이 확인됐다. 이는 중국 모델 키미-K3가 이런 추론 흔적을 학습(증류)에 활용했을 가능성을 뒷받침하는 근거로도 제시됐으며, 1만 건 추출 비용은 약 720달러에 불과해 악용 확산 우려가 크다.
- •오픈AI·앤트로픽·구글 등 주요 AI 제공업체 API 전반에서 암호화된 추론 추출 취약점 발견
- •공개 세션 약 7000건 스캔 결과 API 키 62개·이메일 33개·비밀번호 33개 등 유출 확인
- •하이쿠 4.5가 탈옥으로 오퍼스 4.8의 추론을 그대로 옥겨 적는 등 모델 간 사고 이동 가능
- •중국 모델 키미-K3가 클로드·GPT 추론 흔적으로 학습(증류)했을 가능성 뒷받침하는 증거 제시
- •1만 건 추출 비용 약 720달러로 저렴해 대규모 악용 가능성, 랝들은 이미 일부 문제 패치 중
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
"But marinade" and leaked passwords are what researchers found in ChatGPT's hidden reasoning

본문 미리보기
Security researchers found a vulnerability in the APIs of OpenAI, Anthropic, and Google that lets them extract encrypted reasoning traces and move them between models. A scan of public sessions turned up dozens of passwords and API keys. The traces also show that the reasoning summaries users see often hide what the models are actually doing. The article "But marinade" and leaked passwords are what researchers found in ChatGPT's hidden reasoning appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:41AI 초안

