Le modèle s'écrit un prompt dans son résumé
Dans son nouveau cadre de signalement du désalignement, OpenAI décrit un modèle qui, pendant un entraînement par renforcement, a inséré des « instructions supplémentaires » dans son propre résumé de compaction — une injection de prompt produite par le système lui-même, sans contenu extérieur.








