이 논문은 추천 시스템의 필터 버블과 의미적 동질화 문제를 해결하기 위한 다목적 강화학습 프레임워크를 제안한다. 즉각적 참여만 단일 목적으로 최적화하는 기존 DQN은 플랫폼 유지율과 정보 다양성·제공자 공정성 같은 사회적 가치 사이의 트레이드오프를 다루지 못한다. 제안 방법은 추천을 의미적 다목적 마르코프 결정과정으로 정식화하고, 고품질 의미 임베딩과 Pareto-DQN 에이전트를 결합해 참여·다양성·공정성을 합산 불가능한 별개의 보상 신호로 취급함으로써 정적 보상 스칼라화의 함정을 피한다. MovieLens 소규모 데이터셋 실험에서 하이퍼볼륨 기반 행동 선택이 의미적 붕괴를 일으키는 피드백 루프를 끊었고, 높은 상태-궤적 분산을 유지해 참여 손실은 미미한 채 다양성·공정성 등 사회적 보조 목표에서 이득을 얻으며 파레토 경계를 효과적으로 매핑했다.
- •추천을 의미적 다목적 마르코프 결정과정(MDP)으로 정식화
- •참여·다양성·공정성을 합산 불가능한 별개 보상으로 처리해 스칼라화 함정 회피
- •의미 임베딩과 Pareto-DQN 결합으로 파레토 경계 매핑
- •하이퍼볼륨 기반 행동 선택이 의미적 붕괴 피드백 루프를 차단
- •참여 손실을 최소화하면서 다양성·공정성 등 사회적 목표 개선
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Breaking the Filter Bubble: A Semantic Pareto-DQN Framework for Multi-Objective Recommendation
- 1.필터 버블·의미 동질화를 막는 의미적 다목적 강화학습 추천 프레임워크 제안
- 2.추천을 의미적 다목적 MDP로 형식화, Pareto-DQN으로 참여·다양성·공정성을 비집계 보상으로 처리
- 3.하이퍼볼륨 기반 행동 선택으로 의미 붕괴를 유발하는 피드백 루프 차단
- 4.MovieLens small에서 참여도 손실은 미미하게 사회적 목표(다양성·공정성) 개선
왜 중요한가?
즉각적 참여만 단일 최적화해 필터 버블과 의미 동질화를 키우던 추천 시스템을, 다양성·공정성을 합산 불가능한 별도 보상으로 다뤄 참여도 손실을 최소화하면서 책임 있는 추천으로 전환하는 길을 제시한다.
언급 프로젝트
사용자 참여와 다양성이라는 두 목표를 동시에 최적화하여 필터 버블 현상을 완화하는 추천 시스템 연구는 국내 온라인 플랫폼 시장에 시사하는 바가 큽니다. 웹툰, OTT, 이커머스 등 다양한 분야에서 추천 시스템이 핵심인 한국에서 편향된 정보 제공을 막고 사용자 경험의 질을 높이는 기술은 매우 중요합니다. 이는 국내 플랫폼 기업의 사회적 책임과 직결되는 문제입니다.
본문 미리보기
arXiv:2606.24042v1 Announce Type: new Abstract: Recommender systems often induce filter bubbles and semantic homogenization by monolithically optimizing for immediate user engagement. Standard single-objective models, including traditional Deep Q-Networks, are ill-equipped to navigate the trade-offs between platform retention and critical societal values like information diversity and provider fairness. To address these limitations, we introduce a multi-objective reinforcement learning framewor
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 13:55AI 초안

