TanodTools
TR

Kelime sıklığı sayacı

Hangi kelime ve öbeklerin en sık geçtiğini sayı ve yüzdeyle görmek için metni yapıştırın; dilinizdeki yaygın gereksiz sözcükleri (stop words) listeden çıkarın.

Tarayıcınızda çalışır; yazdığınız hiçbir şey cihazınızdan çıkmaz

Say

Başlamak için metni yapıştırın.

Birkaç milyon karaktere kadar metin. Kelimeler harf ve rakam dizileridir; kelime içindeki kesme işaretleri ve tireler korunur. Öbekler hiçbir zaman cümle sonunu veya yeni satırı aşmaz. Gereksiz sözcük listeleri en yaygın işlev sözcüklerinin kısa listeleridir, tam sözlük değildir; İngilizce, İspanyolca, Fransızca, Almanca, Portekizce (Brezilya), İtalyanca, Endonezce, Türkçe, Vietnamca, Rusça, Lehçe ve Hintçe için bulunur.

Kelime sıklığı nasıl sayılır

  1. Metninizi yapıştırın.
  2. Tek kelimeleri, iki kelimelik öbekleri veya üç kelimelik öbekleri seçin; the, and veya of gibi kelimeleri atlamak istiyorsanız bir gereksiz sözcük dili seçin.
  3. Sayı ve yüzdelerle sıralanmış listeyi okuyun, ardından kopyalayın veya CSV olarak indirin.

Kelime sıklığı nasıl sayılır

Metin kelimelere bölünür, her kelime küçük harfe çevrilir ve araç her birinin kaç kez geçtiğini sayar. Sıralı listede en sık geçenler başa gelir; eşitlikler alfabetik sıraya göre çözülür. Kelimelerin ne kadar tekrar ettiğini saymak, bir metnin gerçekte ne hakkında olduğunu görmenin, bir anahtar kelimenin fazla kullanılıp kullanılmadığını denetlemenin, bir röportajdaki veya anket yanıtlarındaki terimleri bulmanın ya da bir kompozisyonda hep aynı kelimeye yaslanmak gibi bir alışkanlığı fark etmenin hızlı bir yoludur.

Hiçbir süzgeç kullanılmazsa listenin başında neredeyse her zaman the, of ve and gibi işlev sözcükleri yer alır. Bir gereksiz sözcük dili seçmek bunları çıkarır ve içerik taşıyan kelimeler üste çıkar. Listeler dilin en yaygın artikellerini, zamirlerini, edatlarını, bağlaçlarını ve yardımcı fiillerini kapsar; hızlı bir bakış için tasarlanmıştır, dilbilimsel çalışma için değil.

Öbekler, tek bir cümle içinde yan yana duran iki veya üç kelimelik diziler olarak sayılır. Tekrar eden öbekler çoğu zaman tek kelimelerden daha çok şey söyler: bir metindeki ürün adlarını, sloganları ve kalıp ifadeleri ortaya çıkarır. Gereksiz sözcükler açıkken, gereksiz sözcükle başlayan veya biten öbekler atılır; geriye kalanlar daha anlamlıdır.

Bir öğenin yüzdesi, sayısının sayılan toplama bölünmesiyle bulunur. Bu toplam seçeneklerle değişir, çünkü çıkarılan gereksiz sözcükler ve sayılar sayılmaz. Listenin tamamını saklamak veya bir e-tabloda grafiğe dökmek için CSV dosyasını indirin.

İpuçları

Sık sorulan sorular

Neyin kelime sayıldığı nasıl belirleniyor?

Harfler arasında kesme işareti veya tire bulunabilen harf ya da rakam dizisi kelime sayılır; yani don't ve well-known birer kelimedir. Büyük ve küçük harf aynı kelime kabul edilir. Noktalama işaretleri ve boşluklar kelimeleri ayırır.

Öbekler nasıl sayılıyor?

İki kelimelik öbek, yan yana duran her kelime çiftidir; üç kelimelik öbek ise yan yana duran her üçlüdür. Öbekler nokta, soru işareti, noktalı virgül veya satır sonunu aşmaz; böylece bir cümlenin son kelimesi bir sonrakinin ilk kelimesiyle birleştirilmez.

Gereksiz sözcük seçenekleri ne işe yarar?

Gereksiz sözcükler (stop words), the, and, of, el, la, le, der veya и gibi çok yaygın işlev sözcükleridir. Tek kelimelerde listeden çıkarılırlar. Öbeklerde ise gereksiz sözcükle başlayan veya biten her öbek atlanır; böylece of the search yerine search engine gibi öbekleri görürsünüz. Yüzdeler kalan öğeler üzerinden hesaplanır.

Yüzde nasıl hesaplanıyor?

Öğenin sayısının, sayılan toplam kelime (veya öbek) sayısına bölünmesidir; bunu, seçtiyseniz gereksiz sözcükler ve sayılar çıkarıldıktan sonra yapar.

CSV dosyasında neler var?

Yalnızca ekrandaki kısım değil, sıralanmış listenin tamamı; sıra, kelime, sayı ve yüzde sütunlarıyla. Dosya, e-tablolar aksanlı harfleri doğru göstersin diye bayt sırası işaretli UTF-8 biçimindedir.

Metnim yükleniyor mu?

Hayır. Metin tarayıcınızda sayılır ve hiçbir şey cihazınızdan çıkmaz.