Negation Neglect: Fine-Tuning Teaches Lies, Not Truth
Negation Neglect means that fine-tuning LLMs on corrective content backfires. Instead of learning to reject false claims, models absorb them as facts. This has immediate implications for every AI safety pipeline.











