판 이력 — Reinforcement Learning for Evidence-Seeking Diagnostic Reasoning with Large Language Models | AIChainDay