오픈AI의 차세대 모델 '아스트라'가 순차적 사고 과정을 벗어나 동일한 질의를 반복 처리하는 '순환 심도(recurrent depth)', 이른바 '불투명 순환(opaque recurrence)' 기법을 사용한다는 보도가 나오면서 AI 안전 전문가들 사이에서 우려가 확산되고 있다. 레드우드 리서치의 벅 슐레게리스 CEO와 즈비 모우쇼비츠 등은 이 기법이 모델의 사고 과정(체인오브소트) 감시를 어렵게 만들어 오작동이나 정렬 이탈을 탐지하기 힘들게 할 수 있다고 지적했다. 오픈AI 수석과학자 야쿠프 파호츠키는 아스트라의 사고 과정이 여전히 읽을 수 있는 수준이라며 '뉴럴리즈'로의 전환 가능성을 일축했지만, 앤트로픽과 구글 딥마인드도 이미 유사 기법을 논의 중인 것으로 알려졌다. 레드우드의 라이언 그린블랫 수석과학자는 이런 불투명 추론이 확대되면 모델의 사고 과정이 사실상 전부 잠재 공간(latent space)에서 이뤄져 가시적 감시 채널이 사라질 수 있다고 경고했다.
- •오픈AI 차세대 모델 '아스트라'가 순차적 사고를 벗어난 '불투명 순환' 기법을 사용하는 것으로 알려졌다.
- •레드우드 리서치 CEO 등 AI 안전 전문가들은 이 기법이 체인오브소트 감시 가능성을 훼손할 수 있다고 우려했다.
- •오픈AI는 아스트라의 사고 과정이 여전히 읽을 수 있는 수준이라며 우려를 일축했다.
- •앤트로픽과 구글 딥마인드도 유사한 기법을 이미 논의 중인 것으로 전해졌다.
- •전문가들은 기법이 확대되면 AI 추론이 전부 잠재 공간에서 이뤄져 감시가 불가능해질 수 있다고 경고했다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
OpenAI’s new reasoning technique alarms AI safety experts
- 1.OpenAI 신규 모델 'Astra'가 '오파크 리커런스' 기법 사용, 순차적 사고 없이 반복 처리
- 2.Redwood Research CEO 등 AI 안전 전문가들, 사고사슬(CoT) 모니터링 저해 우려 제기
- 3.OpenAI는 적용 범위 제한적이며 CoT는 여전히 읽을 수 있다고 반박, '뉴럴리즈' 전환 부인
- 4.Anthropic·Google DeepMind도 유사 기법 논의 중이라고 The Information 후속 보도
왜 중요한가?
CoT 모니터링은 AI 오작동·탈선 감지의 핵심 안전장치인데, 오파크 리커런스가 확산되면 이 감시 체계 자체가 무력화될 수 있어 업계 안전 규범에 위협이 된다는 지적이다.
본문 미리보기
OpenAI’s new Astra model will use “recurrent depth,” a technique that allows the model to operate outside of the sequential thinking that characterizes most reasoning models.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:53AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
