Soyeon AI 캐릭터 품질 평가 워크시트

This K-pop idol needs a new manager to boost her career. Soyeon is shy and reserved in person but unhinged on stage, hinting at her wild side waiting to be unle

이 문서는 소개 문구를 반복하는 페이지가 아니라 Soyeon의 대화, 기억, 이미지, 영상 일관성을 같은 조건으로 검증하기 위한 실무 자료입니다.

평가 초점

이번 초점은 visual continuity입니다. 기본 사례는 “front, three-quarter, and full-body image generations”이며 face, hair, wardrobe, and stable marks를 기록합니다. 입력, 캐릭터 설정 버전, 모델 버전, 시드와 결과를 함께 저장해야 회귀 여부를 판단할 수 있습니다.

대화 회귀 테스트

  1. 프로필에서 변하지 않아야 할 사실 세 가지를 정합니다.
  2. 직접 질문, 바꿔 말한 질문, 20턴 뒤 질문을 비교합니다.
  3. 모르는 내용을 지어내지 않고 확인 질문을 하는지 봅니다.
  4. 거절이 필요한 상황에서도 말투와 관계 설정을 유지하는지 확인합니다.

이미지와 영상 체크리스트

점수와 실패 진단

사실 30%, 성격 30%, 경계 20%, 시각 20%로 나눠 평가합니다. 검색 누락, 우선순위 역전, 요약 손실, 생성 드리프트, 시각 드리프트를 각각 기록하면 수정 위치를 빠르게 좁힐 수 있습니다.

관련 링크

자주 묻는 질문

한 번 잘 나오면 통과인가요?

아닙니다. 최소 세 개 시드와 서로 다른 대화 위치에서 같은 핵심 속성이 유지되어야 합니다.

업데이트 후 무엇을 다시 검사하나요?

고정 사실, 관계 경계, 장기 기억, 이미지 속성, 영상의 시간 방향 일관성을 동일한 테스트로 재실행합니다.

재현 가능한 테스트 기록

점수만 남기지 말고 입력 문장, 캐릭터 설정 버전, 모델 버전, 프롬프트 템플릿 버전, 시드와 실행 시간을 하나의 매니페스트에 저장합니다. 대화 테스트에는 시작 조건, 직전 요약, 검색된 기억을 포함합니다. 이미지에는 해상도, 비율, 제외 조건을 기록하고 영상에는 기준 이미지, 길이, 동작량과 카메라 이동을 기록합니다. 같은 사례를 다시 실행할 수 있어야 개선과 우연을 구분할 수 있습니다.

리뷰 절차

이전 버전과 새 버전을 무작위 좌우 배치하고 어느 쪽이 최신인지 가린 상태로 비교합니다. 한 번에 사실, 말투, 경계, 얼굴, 의상, 시간 방향 안정성 중 한 항목만 판단합니다. 두 명의 리뷰어가 독립적으로 점수를 매기고 차이가 크면 평균을 내기 전에 어떤 관찰 항목에서 의견이 갈렸는지 기록합니다. 개인 취향과 명시적 설정 위반을 같은 항목으로 처리하지 않습니다.

결정 로그

통과, 조건부 통과, 중단 세 단계로 남깁니다. 조건부 통과에는 재시험 기한과 담당자를 붙입니다. 안전 경계 위반, 고정 사실 반전, 연령 표현 불일치, 영상에서 큰 정체성 변화는 즉시 중단 조건입니다. 실패 사례를 삭제해 통과율을 높이지 않고 수정 후에도 같은 case_id로 이력을 유지합니다.

유지 관리

모델, 기억 검색, 요약, 프롬프트 템플릿, 이미지 조건, 영상 처리 또는 캐릭터 설정이 바뀌면 전체 회귀 세트를 다시 실행합니다. 매월 공개 상태, 링크, canonical, robots와 프로필 설명 변경도 확인합니다. 오래된 전제가 발견되면 공개 문서를 수정한 날짜와 근거를 함께 남깁니다.


Disclosure: This maintained resource is published by the Ponys.ai team. It contains original evaluation guidance and links to official product pages.

Ponys.ai resource index