Kalkulator Podobieństwa Embeddingu

Wprowadź oba teksty powyżej, aby obliczyć podobieństwo

Podobieństwo cosinusowe TF · słowa stop usunięte · działa w przeglądarce

Czym jest Kalkulator Podobieństwa Embeddingu

Kalkulator podobieństwa embeddingu oblicza, jak bardzo dwa teksty są do siebie semantycznie podobne, przekształcając je w wektory częstotliwości termów i mierząc cosinus kąta między nimi. Wynik 100% oznacza identyczne słownictwo; 0% oznacza brak wspólnych słów treści. Podejście to zbliżone jest do działania modeli embeddingowych, ale działa całkowicie w przeglądarce — bez klucza API ani usługi zewnętrznej.

Jak używać

  1. Wklej lub wpisz pierwszy tekst w pole Tekst A.
  2. Wklej lub wpisz drugi tekst w pole Tekst B.
  3. Odczytaj wynik podobieństwa pojawiający się natychmiast — 0% to brak pokrycia, 100% to identyczne słownictwo.
  4. Przejrzyj panel wspólnych terminów, aby zobaczyć, które słowa oba teksty mają wspólne.
  5. Porównaj panele unikalnych terminów, aby zrozumieć, co każdy tekst omawia inaczej.

Kiedy używać

Obawiasz się, że dwa opisy produktów brzmią zbyt podobnie przed publikacją? Wklej oba i może okazać się, że wynik podobieństwa wynosi 78% z listą wspólnych słów kluczowych. To wystarczy, żeby wiedzieć, który opis przepisać i uniknąć traktowania stron przez Google jako duplikatów.

Często zadawane pytania

Czym to się różni od prawdziwego modelu embeddingowego?

Prawdziwe modele embeddingowe wychwytują znaczenie semantyczne — wiedzą, że 'samochód' i 'pojazd' są podobne, nawet jeśli słowa się różnią. To narzędzie używa nakładania się częstotliwości termów, więc ocenia teksty jako podobne tylko wtedy, gdy mają wspólne słowa. Jest szybsze, bezpłatne i prywatne, ale mniej dokładne w wykrywaniu parafraz.

Co oznacza wynik podobieństwa?

Wynik to podobieństwo kosinusowe między dwoma wektorami TF, wyrażone w procentach. Powyżej 70% zazwyczaj wskazuje na bardzo podobną treść. Między 30–70% oznacza powiązane tematy. Poniżej 30% teksty mają różne słownictwo.

Czy stopwords są uwzględniane w obliczeniach?

Nie. Pospolite słowa funkcyjne są usuwane przed obliczaniem podobieństwa, aby tylko znaczące słowa treści wpływały na wynik.

Czy mój tekst jest wysyłany na serwer?

Nie. Całe przetwarzanie odbywa się w Twojej przeglądarce za pomocą JavaScript. Nic nie jest przesyłane ani przechowywane.

Czy mogę tego użyć do wykrywania plagiatów?

Narzędzie może wykrywać oczywiste pokrywanie się słów, ale przeoczy plagiat parafrazowany. Do poważnego wykrywania plagiatów używaj specjalistycznych narzędzi porównujących z dużymi bazami dokumentów.

Czy mogę udostępnić to narzędzie z wypełnionymi danymi?

Tak. Adres URL aktualizuje się automatycznie podczas wpisywania. Skopiuj link z paska adresu lub użyj przycisku Udostępnij — każdy kto go otworzy, zobaczy Twoje dane.

Powiązane narzędzia

Najnowsze artykuły