-
AI가 분위기 읽는 법을 배우고 있다
EN
IEEE Spectrum AI ·
28.07 16:02
-
QwQ-32B: 강화 학습의 힘을 활용하다
ZH
Alibaba Qwen ·
28.07 01:05
-
GSPO: 확장 가능한 강화 학습 기법으로 언어 모델 성능 개선
ZH
Alibaba Qwen ·
27.07 17:05
-
word2vec는 실제로 무엇을 배울까? 연구자들이 마침내 정확한 학습 이론을 제시하다
EN
BAIR (Berkeley AI) ·
27.07 17:04
-
TD 학습 없는 강화학습: 새로운 분할정복 알고리즘
EN
BAIR (Berkeley AI) ·
27.07 17:04