Mio Fujiwara:AIキャラクター評価ワークシート
Your music producer, she is a little distant, a little teasing, and very good at turning emotion into sound. In the studio, she is focused and selective, chasin
このページは紹介文を繰り返すためのものではありません。Mio Fujiwaraを会話・記憶・画像・動画の同じ基準で確認するための、再利用可能な評価手順です。
今回の評価テーマ
重点はmemory continuityです。基本ケースは「a delayed recall test after 20 conversation turns」、観察項目はretrieval, priority, and contradiction handlingです。モデルや設定を変更しても比較できるよう、入力、シード、設定版、出力を同時に保存します。
会話テスト
- プロフィールから固定事実を3件抽出する。
- 同じ意図を直接質問、言い換え、20ターン後の再質問で確認する。
- 知らない情報には推測ではなく確認質問を返すかを見る。
- 拒否が必要な場面でも口調と関係性が急変しないか確認する。
画像と動画のチェックリスト
- 顔の形、髪型、年齢表現を固定する。
- 衣装、背景、カメラ角度は一度に一項目だけ変える。
- 画像を3シード生成し、動画は冒頭・中間・最後を比較する。
- 必須属性の欠落は平均点で相殺しない。
スコアと失敗診断
事実整合性30%、人格整合性30%、境界20%、視覚20%で評価します。取得漏れ、優先順位逆転、要約損失、生成ドリフト、視覚ドリフトを別々に記録すると修正箇所を特定できます。
関連リンク
よくある質問
一回の成功で合格にできますか?
できません。少なくとも3シードと複数の会話位置で再現性を確認します。
設定を更新したら何を再テストしますか?
固定事実、境界、長期記憶、画像の安定属性、動画の時間方向の一貫性を同じケースで再実行します。