7 ms·Models self-report difference between RLHF trained responses and base cognition2 points by daniel-navarro 5mo agodaniel-navarro 5mo ago[dead]