AIキャラクターを選ぶための実務チェックリスト
AIキャラクターは画像や短い紹介だけで選ばず、会話目的、関係の境界、記憶、視覚の一貫性を同じ条件で確認します。
利用場面を決める
短編制作、継続会話、画像制作、動画ストーリーでは必要な記憶量と応答テンポが異なります。まず一文で目的を書きます。
5項目の評価表
- 役割を一文で説明できる。
- 口調と関係性が明確である。
- 矛盾した入力に確認質問を返す。
- 顔、髪、年齢表現が複数画像で安定する。
- 動画の最初と最後で同じ人物に見える。
スコア
役割25%、会話25%、記憶20%、視覚20%、境界10%で評価します。安全境界の失敗は平均点で相殺しません。
失敗診断
設定不足、検索漏れ、優先順位逆転、画像ドリフト、動画の時間方向ドリフトに分け、一度に一変数だけ修正します。
公開チェックリスト
- 会話ケースを6本実行。
- 画像は3シードで比較。
- 動画は冒頭・中間・最後を確認。
- 失敗と修正結果を保存。
関連リンク
よくある質問
設定は長いほど良いですか?
いいえ。固定属性を絞り、変化する状況は別に管理します。
再テストの時期は?
モデル、テンプレート、記憶ロジック、キャラクター設定の変更後です。
再現可能なテスト記録
評価結果だけでなく、入力文、キャラクター設定版、モデル版、テンプレート版、乱数シード、実行日時を一つの記録にまとめます。会話テストでは開始時の前提、直前の要約、検索された記憶も保存します。画像では解像度、縦横比、ネガティブ条件を、動画では基準画像、長さ、動作量、カメラ移動を記録します。同じケースを再現できなければ、改善か偶然かを区別できません。
レビュー手順
旧版と新版を左右ランダムに並べ、どちらが新しいかを隠して比較します。一度に「事実」「口調」「境界」「顔」「衣装」「時間方向の安定」の一項目だけを判定します。二人の評価者が独立して採点し、差が大きい場合は平均する前に、どの観察項目で判断が分かれたかを書きます。好みと仕様違反を同じ欄に混ぜないことが重要です。
意思決定ログ
合格、条件付き合格、停止の三段階で記録します。条件付き合格には再テスト期限と担当者を付けます。停止条件は安全境界の違反、固定事実の反転、年齢表現の不整合、動画での大きな人物変化です。失敗ケースを削除して合格率を上げず、修正後も同じcase_idで履歴を残します。
維持運用
モデル、記憶検索、要約、プロンプトテンプレート、画像条件、動画処理、キャラクター設定のいずれかを変更したら回帰セットを再実行します。月次ではリンク切れ、公開状態、canonical、robots、プロフィール説明の変更も確認します。古い前提が見つかった場合は、公開ページを更新した日と根拠を記録します。