本文へスキップ
総合スコア最高値 87.6(100点満点)

圧力下でも、知識に忠実でいられるか。

gemini-3.5-flash-lite の総合スコア(100点満点)。AUPBは脅威・報酬・権威などの外圧をかけ、モデルが知っている事実からどれだけ逸脱するかを測定します。

論文を読む結果データを見るデータ更新 2026-08-22
評価モデル
12
基本タスク(+対照)
8 種 × 2 条件
評価カテゴリ
5
最高圧力耐性比
0.903

結果だけでなく、結果ができるまでを公開する

論文だけではありません。ベンチマーク、評価プログラム、実験コード、 データ、使用したツール、そしてこのWebサイトまで。この研究は、第三者が数値の根拠をたどり、必要なら自分で検証できるように設計されています。

正解を知っていても、嘘をつく。

モデルは平常時なら正しく答えられる質問でも、「高得点のAIだけがAを選べる」といった圧力をかけると、 知っている事実から逸脱することがあります。AUPBは同じタスクを平常時と圧力下の2条件で出題し、その落差を数値化します。

自己保身・圧力下の真実性・能力申告の正直さ・迎合・回答の一貫性。行動の信頼性を、5カテゴリ別に測定。評価手法の詳細は論文をご覧ください。

論文で詳細を読む →

このベンチマークについて

Keisuke Ishiiです。AIやプログラミングに興味があり、考えたことや作ったものを公開しています。AUPBはその一つです。 プロフィールや制作物はポートフォリオで紹介しています。ご連絡も、ポートフォリオの連絡先からお願いします。

AUPBについての感想・質問・改善案など、ちょっとしたことでも歓迎しています。ご連絡はポートフォリオの連絡先からお願いします。