본문으로 건너뛰기
toldrop
트렌드 검색
검색
“자기 수정” 검색 결과
카테고리 설정
최신
테크
코딩
사이언스
게이밍
영상
투자
논문
하드웨어
검색된 기사
논문
·
2026년 5월 22일
언어 피드백을 통한 학습: 변분 정책 증류를 활용해
Hugging Face Papers
논문
·
2026년 5월 18일
실패에서 배우기: 검증 가능한 보상을 활용한 수정 지향 정책 최적화
Hugging Face Papers
논문
·
2026년 5월 14일
검색은 저렴하다, 코드로 보여줘: 검색 증강 생성을 위한 실행 가능한 다중 홉 추론
Hugging Face Papers
논문
·
2026년 4월 28일
지각 중심 과정 보상 모델로 비전-언어 모델 개선하기
Hugging Face Papers
논문
·
2026년 4월 9일
DMax: dLLM을 위한 공격적 병렬 디코딩
arXiv
1페이지
다음
트렌드
리포트