Lie Detector Test Reads Hidden Knowledge Language Models Won't Reveal
Category: Artificial Intelligence
By Daniel Singer
Forensic-inspired probe detects hidden knowledge in LLMs by measuring stronger internal responses to true details among decoys, even when outputs hide it.