Article
Evaluating Sycophancy in Frontier Models Using Persona-Driven Challenge
2026-05-20
Abstract excerpt
Large language models (LLMs) are increasingly used for lay health queries, yet may abandon correct recommendations under pressure, a vulnerability termed sycophancy. We evaluated sycophancy across five frontier LLMs (Claude Opus 4.6, Claude Sonnet 4.6, GPT 5.4, Grok 4.1, Gemini 3 Flash) using 200 synthetic clinical vignettes, each anchored to a unanimous correct treatment baseline and challenged by nine personas r...
Topics
Open a Topic to create a Post that cites this publication.
Identifiers and source
- Literature Corpus work
- 3906a9c6-dcb0-56d2-9c09-19be055ff812
- DOI
- 10.64898/2026.05.17.26353406
