HypeDelta
DigestTopicsClaimsPredictionsReliabilityResearchers
Admin
DigestTopicsClaimsPredictionsReliabilityResearchers

HypeDelta - AI Research Intelligence

Claimsrlhf
rlhf
fact
bearish

Over-optimization leads to reward hacking, sycophancy, and verbosity in language models

Nathan Lambert26 Jul 2026

https://x.com/natolambert/status/2081018219746468088