AI arXiv論文:LLM審査AIの判定層をモデル内部から特定
米研究者が、要約評価に使われるLLM審査モデルThemisとPrometheusの内部を分析しました。層15を境に誤り検出と採点統合が分かれ、最終判定は26層目前後で固まると判明しました。評価パイプラインの信頼性を考える手がかりになります。
AI
AI
AI
AI
AI
AI
AI
AI
AI
AI