本文へ移動
kkoki's blog
ホーム記事タグ

Tag

#AI安全性

1件の記事

2026年9月28日

「Just Ask Jev」解説――AIの失敗を見抜く確率と、判定に使える確率は違う

Jevを44のベンチマークで評価したRLCDAlignBenchを解説。質問設計、文脈、確率の較正、ラベル監査を通じて、AUROC 0.886と約63分の1の評価コストが示す範囲を整理します。

AI
  • #LLM
  • #LLM-as-a-Judge
  • #AI安全性
  • #論文解説

© 2020–2026 koki

GitHub ↗