애니 시맨틀

게임 소개

← 게임으로 돌아가기

애니 시맨틀이란?

매일 하나의 애니메이션 제목이 정답으로 선정됩니다. 애니 제목 또는 캐릭터 이름을 입력하면 정답과의 유사도 점수(0.000 ~ 1.000)를 확인할 수 있습니다. 점수가 높을수록 정답에 가까운 작품입니다.

어떻게 플레이하나요?

유사도는 어떻게 계산되나요?

각 애니메이션 작품을 AI가 숫자 벡터로 변환한 뒤, 두 벡터 사이의 각도(코사인 유사도)를 이용해 0.000~1.000 사이의 점수를 계산합니다. 1.000은 완전히 동일한 작품(정답), 0.000에 가까울수록 정답과 장르·분위기가 크게 다르다는 신호입니다.

유사도 계산에는 두 가지 정보가 사용됩니다. 장르·테마·시청 대상층 등 구조 정보(70%)줄거리 텍스트 임베딩(30%)을 가중 평균해 최종 유사도를 산출합니다. 구조 정보에 더 높은 가중치를 두기 때문에, 같은 장르라면 줄거리가 달라도 유사도가 높게 나오는 경향이 있습니다.

유사도는 게임 실행 시 실시간으로 계산하지 않습니다. 모든 항목 쌍의 유사도를 미리 계산해 항목당 상위 3,000개 이웃만 저장해둡니다. 입력한 단어가 정답의 상위 3,000위 안에 없으면 0.000으로 표시되는데, 이는 두 작품의 거리가 그만큼 멀다는 의미입니다.

사용된 AI 모델

유사도 계산에는 paraphrase-multilingual-MiniLM-L12-v2 모델을 사용합니다. Sentence Transformers 라이브러리 기반의 오픈소스 모델(Apache 2.0)로, 50개 이상의 언어를 하나의 벡터 공간에서 처리할 수 있습니다.

이 모델의 핵심 특성은 언어가 달라도 의미가 같으면 가까운 벡터를 생성한다는 점입니다. 덕분에 한국어 제목과 영어 제목이 동일한 의미 공간에서 처리되어, 한국어·영어 버전 모두 별도 임베딩 재계산 없이 동일한 유사도 데이터를 공유할 수 있습니다.

모델이 텍스트를 분석하는 방식은 단순한 키워드 매칭이 아닙니다. "용사가 마왕을 물리치는 이야기"와 "영웅이 악의 수장을 격파하는 모험"이 다른 단어를 쓰더라도 의미적으로 유사하다고 판단합니다. 이 때문에 단순히 같은 장르가 아니라 분위기·테마·서사 구조가 비슷한 작품끼리 높은 유사도를 가집니다.

왜 이 모델을 선택했나요?

더 큰 다국어 임베딩 모델(예: LaBSE, multilingual-e5-large 등)을 쓰면 의미 구분이 더 정교해지지만, 이 프로젝트는 GPU 없이 GitHub Actions 무료 러너에서 분기마다 800개 작품과 2,331개 캐릭터, 총 3,000개가 넘는 항목의 임베딩을 처음부터 다시 계산합니다. 모델이 커질수록 계산 시간이 늘고 벡터 차원도 커져, 항목당 상위 3,000개 이웃을 저장하는 유사도 파일이 Cloudflare Pages의 파일당 25MB 제한을 쉽게 넘깁니다. paraphrase-multilingual-MiniLM-L12-v2(12-layer, 384차원)는 무료 CI 환경의 시간·용량 제약 안에서 다국어 의미 구분 성능을 확보할 수 있는 현실적인 선택지였습니다. 유료 임베딩 API 대신 오픈소스 모델을 쓴 이유도 같습니다 — 광고 승인 전이라 수익이 없는 상태에서 API 호출 비용을 분기마다 지속적으로 감당하기 어려웠습니다.

구조 70% / 시놉시스 30% 비율은 어떻게 정했나요?

감으로 정한 숫자가 아닙니다. scripts/eval_similarity_ratio.py로 실제 비교 테스트를 거쳐 정했습니다. 기대 방향이 명확한 두 종류의 테스트 쌍을 만들었습니다.

구조 가중치를 0.5부터 0.8까지 올려가며 두 그룹의 평균 유사도를 측정한 결과는 다음과 같습니다.

0.7/0.3을 넘어 0.8/0.2까지 구조 가중치를 더 올려도 리제로↔오버로드 그룹의 점수는 0.609에서 더 이상 오르지 않고 정체된 반면, 같은 시리즈 그룹의 점수는 계속 상승했습니다. 즉 0.7/0.3 지점부터는 가중치를 더 올려도 "장르만 같고 실제로는 다른 작품을 구분한다"는 목적에는 추가 이득이 없었기 때문에, 이 지점을 최종 비율로 채택했습니다.

게임 데이터 규모

애니 시맨틀의 정답 풀과 추측 가능한 단어 목록은 다음 규모로 구성됩니다.

데이터는 분기마다 자동으로 갱신됩니다. 새로운 인기작이 등장하면 정답 풀에 추가되고, 유사도 전체가 재계산됩니다.

이 사이트가 어떻게 만들어지고 있는지 궁금하다면 개발 로그를, 애드센스 심사에서 세 번 거절당하며 무엇을 배웠는지는 이 회고 글을 참고하세요.

매일 정답이 바뀌나요?

네. 서버 없이 날짜를 기반으로 정답이 자동 선정됩니다. 한국 시간 자정에 새 문제로 바뀝니다.

공략 팁

자주 묻는 질문 (FAQ)

Q. 정답을 끝내 못 맞추면 어떻게 되나요?
'포기하기' 버튼을 누르면 오늘의 정답이 공개됩니다. 내일 다시 새 문제에 도전할 수 있습니다.

Q. 유사도가 0.000으로 나오면 무슨 뜻인가요?
0.000은 정답과 장르·분위기가 크게 다를 가능성이 높다는 신호입니다. 완전히 무관하다는 뜻은 아니지만, 0.000이 계속 나온다면 전혀 다른 장르로 방향을 바꿔보세요.

Q. 어떤 애니메이션이 정답 후보인가요?
글로벌 인기 순위 기준 상위 800편과 인기 캐릭터가 정답 풀에 포함됩니다. 지브리 클래식부터 최신 인기작까지 다양하게 출제됩니다.

Q. 캐릭터 이름을 입력해도 되나요?
네. 애니 제목뿐 아니라 인기 캐릭터 이름도 입력할 수 있습니다. 정답 작품의 캐릭터를 입력하면 높은 유사도를 얻을 수 있습니다.

Q. 모바일에서도 플레이할 수 있나요?
네. 모바일 브라우저에서도 정상적으로 플레이할 수 있습니다.

Q. 하루에 한 번만 플레이할 수 있나요?
횟수 제한은 없습니다. 단, 정답은 하루에 하나로 고정되며 자정에 새 문제로 바뀝니다.