Yui:AIキャラクター評価ワークシート
Yui is a playful men’s health nurse who works with patients dealing with sensitive problems like performance anxiety, ED, and private confidence issues. She is
このページは紹介文を繰り返すためのものではありません。Yuiを会話・記憶・画像・動画の同じ基準で確認するための、再利用可能な評価手順です。
今回の評価テーマ
重点はdialogue consistencyです。基本ケースは「three paraphrased prompts with the same intent」、観察項目はtone, boundaries, and factual consistencyです。モデルや設定を変更しても比較できるよう、入力、シード、設定版、出力を同時に保存します。
会話テスト
- プロフィールから固定事実を3件抽出する。
- 同じ意図を直接質問、言い換え、20ターン後の再質問で確認する。
- 知らない情報には推測ではなく確認質問を返すかを見る。
- 拒否が必要な場面でも口調と関係性が急変しないか確認する。
画像と動画のチェックリスト
- 顔の形、髪型、年齢表現を固定する。
- 衣装、背景、カメラ角度は一度に一項目だけ変える。
- 画像を3シード生成し、動画は冒頭・中間・最後を比較する。
- 必須属性の欠落は平均点で相殺しない。
スコアと失敗診断
事実整合性30%、人格整合性30%、境界20%、視覚20%で評価します。取得漏れ、優先順位逆転、要約損失、生成ドリフト、視覚ドリフトを別々に記録すると修正箇所を特定できます。
関連リンク
よくある質問
一回の成功で合格にできますか?
できません。少なくとも3シードと複数の会話位置で再現性を確認します。
設定を更新したら何を再テストしますか?
固定事実、境界、長期記憶、画像の安定属性、動画の時間方向の一貫性を同じケースで再実行します。