Aivora

#decision-models

Decision Models

1 篇文章

語言中的隱形陷阱:自然脈絡如何輕易誘騙 AI 決策模型
arXivAI 安全

語言中的隱形陷阱:自然脈絡如何輕易誘騙 AI 決策模型

The Invisible Trap: How Natural Context Can Easily Flip AI Decision Models

本研究揭示了 AI 決策模型的脆弱性:在不改變問題與選項的前提下,僅加入看似自然且無關的短脈絡,就能使原本正確的決策模型(如 Jev)轉而以高信心度做出錯誤選擇。

2 分鐘閱讀