자카드 유사도 계산기
두 집합을 넣으면 교집합·합집합과 자카드 유사도(J = |교집합|/|합집합|)를 계산합니다.
쉼표·공백·줄바꿈으로 구분합니다. 중복은 자동으로 제거됩니다.
자카드 유사도
33.3%
교집합 2개 / 합집합 6개 · 거리 0.667
A (원소 4개){ apple, banana, cherry, date }
B (원소 4개){ banana, cherry, fig, grape }
교집합 A ∩ B (2개){ banana, cherry }
합집합 A ∪ B (6개){ apple, banana, cherry, date, fig, grape }
자카드 유사도 J(A,B)0.3333 (33.33%)
자카드 거리 (1−유사도)0.6667
순서·빈도가 아니라 «포함 여부»만 봅니다. J(A,B) = |교집합| / |합집합|. 같은 원소를 여러 번 넣어도 집합에서는 한 번만 세고, 두 집합이 모두 비어 있으면 관례상 완전히 같다(유사도 1)로 봅니다.
dev/cosine-similarity는 벡터의 방향(크기·성분 값)을 비교하고, text/similarity는 문장 두 개를 통째로 비교합니다(편집거리+단어 겹침). 이 계산기는 태그·카테고리·아이디처럼 «있다/없다»만 의미 있는 일반 집합의 겹침 비율을 직접 계산합니다.
사용 방법
- 1집합 A의 원소를 쉼표·공백·줄바꿈으로 구분해 입력합니다.
- 2집합 B의 원소도 같은 방식으로 입력합니다.
- 3교집합·합집합과 자카드 유사도·거리가 계산됩니다.
자주 묻는 질문
J(A,B) = |A∩B| / |A∪B| 로, 두 집합의 교집합 크기를 합집합 크기로 나눕니다. 완전히 같으면 1, 겹치는 원소가 하나도 없으면 0입니다.
1 − 유사도입니다. 유사도는 클수록 비슷하다는 뜻이고 거리는 클수록 다르다는 뜻이라 헷갈리기 쉬워 계산기에서 둘 다 보여줍니다.
cosine-similarity는 숫자 벡터의 방향(크기·성분 값)을 비교하는 다른 산식입니다. text/similarity는 문장 두 개를 편집거리와 단어 겹침으로 통째로 비교하는 도구입니다. 이 계산기는 태그·카테고리·아이디처럼 순서나 빈도 없이 «포함 여부»만 의미 있는 일반 집합의 겹침 비율을 직접 계산합니다.
집합은 중복을 허용하지 않으므로 자동으로 한 번만 셉니다. "a, a, b"는 { a, b } 두 원소로 취급합니다.
알아두면 좋은 점
- 두 집합이 모두 비어 있으면(0/0) 관례상 유사도를 1(완전히 같음)로 둡니다.
- 추천 시스템의 «함께 본 상품», 설문 응답 겹침, 태그 유사도 비교 등에 씁니다.
함께 보면 좋은 도구
코사인 유사도두 벡터의 코사인 유사도와 사이각을 구하고 유클리드·맨해튼 거리, 자카드 계수와 나란히 놓습니다.집합 연산두 집합의 원소를 입력하면 합집합·교집합·차집합·대칭차집합을 구하고 부분집합·서로소 관계를 판정합니다.gitignore 판정.gitignore 규칙과 경로를 넣으면 그 파일이 무시되는지, 어느 줄이 마지막으로 이겼는지 알려줍니다.울프람 규칙규칙 번호 0~255를 8비트로 풀어 세 칸 이웃에 대응시키고 세대를 쌓아 무늬를 그립니다.2-SAT「둘 중 하나는 참」인 조건을 여럿 넣으면 참·거짓 배정이 가능한지 판정하고 배정을 하나 찾아 줍니다.
마지막 검증: 2026년 9월 3일 · 결과는 참고용 추정치입니다.