TanodTools
PL

Licznik częstości słów

Wklej tekst, aby zobaczyć, które słowa i frazy występują najczęściej, z liczbą wystąpień i procentami, i pomiń typowe stop words (słowa funkcyjne) swojego języka.

Działa w Twojej przeglądarce; nic, co wpiszesz, nie opuszcza urządzenia

Licz

Wklej tekst, aby zacząć.

Tekst do kilku milionów znaków. Słowa to ciągi liter i cyfr, przy czym apostrofy i łączniki wewnątrz słowa są zachowywane; frazy nigdy nie przechodzą przez koniec zdania ani nową linię. Listy stop words to krótkie listy najczęstszych słów funkcyjnych, a nie pełne słowniki, i są dostępne dla angielskiego, hiszpańskiego, francuskiego, niemieckiego, portugalskiego (Brazylia), włoskiego, indonezyjskiego, tureckiego, wietnamskiego, rosyjskiego, polskiego i hindi.

Jak policzyć częstość słów

  1. Wklej swój tekst.
  2. Wybierz pojedyncze słowa, frazy dwuwyrazowe lub trzywyrazowe oraz język stop words, jeśli chcesz pominąć słowa takie jak the, and czy of.
  3. Przeczytaj listę uporządkowaną według częstości z liczbą wystąpień i procentami, a potem skopiuj ją lub pobierz jako CSV.

Jak liczona jest częstość słów

Tekst jest dzielony na słowa, każde słowo jest zamieniane na małe litery, a narzędzie liczy, ile razy pojawia się każde z nich. Na liście najczęstsze są pierwsze, a remisy rozstrzyga kolejność alfabetyczna. Liczenie powtórzeń to szybki sposób, aby zobaczyć, o czym naprawdę jest tekst, sprawdzić, czy słowo kluczowe nie jest nadużywane, znaleźć terminy w wywiadzie lub zestawie odpowiedzi z ankiety albo wychwycić nawyk, na przykład ciągłe opieranie się na tym samym słowie w wypracowaniu.

Bez żadnego filtrowania na szczycie listy niemal zawsze są słowa funkcyjne, takie jak the, of i and. Wybór języka stop words usuwa je, a słowa niosące treść wędrują na górę. Listy obejmują najczęstsze rodzajniki, zaimki, przyimki, spójniki i czasowniki posiłkowe danego języka i służą do szybkiego rzutu oka, a nie do pracy językoznawczej.

Frazy są liczone jako ciągi dwóch lub trzech słów stojących obok siebie, w obrębie jednego zdania. Powtarzające się frazy często mówią więcej niż pojedyncze słowa: zdradzają nazwy produktów, hasła i utarte wyrażenia w tekście. Po włączeniu stop words frazy zaczynające się lub kończące stop wordem są odrzucane, więc te, które zostają, są bardziej znaczące.

Procent danego elementu to jego liczba podzielona przez łączną liczbę policzonych elementów. Ta suma zmienia się wraz z opcjami, ponieważ pominięte stop words i liczby nie są liczone. Pobierz CSV, aby zachować pełną listę lub zrobić z niej wykres w arkuszu kalkulacyjnym.

Wskazówki

Najczęstsze pytania

Co liczy się jako słowo?

Ciąg liter lub cyfr, który może zawierać apostrof lub łącznik między literami, więc don't i well-known to po jednym słowie. Wielkie i małe litery są traktowane jako to samo słowo. Znaki interpunkcyjne i spacje oddzielają słowa.

Jak liczone są frazy?

Fraza dwuwyrazowa to każda para słów stojących obok siebie, a fraza trzywyrazowa to każda taka trójka. Frazy nie przechodzą przez kropkę, znak zapytania, średnik ani koniec wiersza, więc ostatnie słowo jednego zdania nie łączy się z pierwszym słowem następnego.

Co robią opcje stop words?

Stop words to bardzo częste słowa funkcyjne, takie jak the, and, of, el, la, le, der czy и. W przypadku pojedynczych słów są pomijane na liście. W przypadku fraz odrzucana jest każda fraza, która zaczyna się lub kończy stop wordem, dzięki czemu widzisz frazy takie jak search engine zamiast of the search. Procenty liczone są od tego, co zostało.

Jak obliczany jest procent?

To liczba wystąpień elementu podzielona przez łączną liczbę policzonych słów (lub fraz), po pominięciu stop words i liczb, jeśli to wybrano.

Co zawiera plik CSV?

Całą uporządkowaną listę, a nie tylko część widoczną na ekranie, z kolumnami pozycja, słowo, liczba i procent. Plik jest w UTF-8 ze znacznikiem kolejności bajtów, aby arkusze kalkulacyjne poprawnie wyświetlały litery z akcentami.

Czy mój tekst jest przesyłany?

Nie. Tekst jest liczony w Twojej przeglądarce i nic nie opuszcza urządzenia.