LLMs fail as automated auditors when document contamination scales, study finds
Research testing Google Gemini 3.0 Pro on 450 planted document errors reveals LLMs suffer batch-size degradation and confident hallucination—critical vulnerabilities for automated audit applications.