1 page tagged

#inference-time-safety

deliberative-alignment concept OpenAI alignment: model reasons about safety policy at inference time; reasoning-model-enabled.
esc