Reinforcement Learning for Calibrated Decisions (RLCD)
RLCD is how TypeSafe AI says it trains Jev. The name stands for Reinforcement Learning for Calibrated Decisions, and the pitch fits in one line from their docs: RLCD "trains TypeSafe to return decisions and calibrated probabilities instead of generated text."