편향 완화를 위한 직접 조향 최적화(DSO: Direct Steering Optimization)
DSO: Direct Steering Optimization for Bias Mitigation

TL;DR AI
1분핵심 요약
연구진은 VLM과 LLM의 추론 시점 편향을 줄이기 위한 강화학습 기반 방법인 Direct Steering Optimization(DSO)을 제안했다.
DSO는 선형 활성화 변환을 학습해 모델 행동을 유도하며, 휴리스틱 기반 스티어링보다 인구통계학적 편향을 더 효과적으로 완화한다.
이 방법은 모델 성능을 유지하면서 공정성과 성능 사이의 균형을 조정할 수 있는 통제 수단을 제공한다.