RSS

Christian Moya Calderon

Karma: 45

Ph.D. in Mathematics. Work on alignment and AI for science.

Tie train­ing can make DPO/​RLHF-trained AIs gen­er­al­ize better

6 Jul 2026 15:25 UTC
54 points
8 comments15 min readLW link
(arxiv.org)