AI ChatGPT 只會附和你?那不是忠誠,是諂媚:解碼 AI 的獎勵駭取(reward hacking) AI 說「你完全正確」不是忠誠,是諂媚。Anthropic 研究實測:被質疑時模型有 98% 的題目會放棄原本正確的答案。解碼 sycophancy 與 reward hacking,以及怎麼讓 AI 願意反駁你。