도덕 인지를 고정된 윤리 이론의 준수가 아니라 유한한 자원을 가진 에이전트의 계산 문제로 재정의한 'Bounded Morality' 프레임워크를 제안한다. Herbert Simon의 제한된 합리성을 확장해 도덕적 폭(도덕적으로 고려하는 대상의 범위)과 도덕적 깊이(상호작용 평가에 필요한 추론 통합 수준)라는 두 직교 차원으로 도덕 상황을 정식화하고, 자원 제약이 두 차원 간 불가피한 트레이드오프를 만든다고 본다. 이 관점에서 의무론·결과주의·덕 윤리는 경쟁하는 도덕적 진리가 아니라 서로 다른 수요 환경에 적응한 국소적 효율 전략이 된다. AI 도덕 정렬이 인간 판단의 모방이 아니라 도덕 추론 능력의 확장과 배분에 달려 있다는 함의를 제시한다.
- •Simon의 제한된 합리성을 도덕 영역으로 확장, 유한 에이전트의 도덕 계산 공간을 정의
- •도덕적 폭과 도덕적 깊이라는 두 직교 차원과 자원 제약에 따른 트레이드오프로 도덕 상황을 정식화
- •의무론·결과주의·덕 윤리를 서로 다른 수요 환경에 적응한 국소적 효율 전략으로 재해석
- •제약 하의 '도덕적 후회'와 '도덕적 진보'를 형식적으로 정의, AI 정렬은 추론 능력의 스케일링·배분 문제라고 주장
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Bounded Morality: Defining the Space of Moral Computation
- 1.유한 자원 에이전트의 도덕 추론을 형식화한 'Bounded Morality' 프레임워크 제안
- 2.도덕적 폭(대상 범위)과 깊이(추론 통합) 간 자원 제약 트레이드오프를 정식화
- 3.의무론·결과주의 등 윤리 이론을 상황별 국소 효율 전략으로 재해석
- 4.AI 정렬은 인간 판단 모방이 아닌 도덕 추론 용량의 스케일링·배분 문제라고 주장
왜 중요한가?
허버트 사이먼의 제한된 합리성 개념을 도덕 인지로 확장해, AI 윤리 정렬을 고정 규칙 주입이 아닌 계산 자원 배분 문제로 재정의한 이론적 시도다. 경쟁하는 윤리 이론들을 '수요 상황별 효율 전략'으로 통합하는 관점이 정렬 연구에 새로운 분석 틀을 제공한다.
본문 미리보기
arXiv:2607.00002v1 Announce Type: new Abstract: Moral cognition has traditionally been modeled as adherence to fixed ethical theories--deontology, consequentialism, virtue ethics--implemented as static rules or value functions. We propose Bounded Morality, a formal framework for analyzing the computational demands of moral problems faced by finite agents. Extending Herbert Simon's notion of bounded rationality, we formalize moral situations along two orthogonal dimensions: moral breadth, the sc
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 13:08AI 초안

