Lügat Mecmuası / Tetkik 01

Lügatin harf ve hece dökümü

560 Yayımlanmış sözlük maddesinde harf, kelime uzunluğu ve otomatik hece dağılımı. Kaynak, yöntem ve indirilebilir veriyle.

Bu kesitte en çok “a” harfi var

560 madde başında 3.635 harf sayıldı. “a” harfi 391 kez, yani bütün harflerin %10,76'inde yer alıyor. En kalabalık uzunluk grubu 112 maddeyle altı harfli sözler.

Bu sonuç bir sözlük örnekleminin yazılış yapısını gösterir. Konuşmada veya kitaplarda hangi harfin daha sık kullanıldığını göstermez.

Harflerin dökümü

Her madde başı bir kez sayıldı. Aynı sözde tekrar eden harfler ayrı ayrı hesaba katıldı.

560 madde başındaki 3.635 harf, sayıya göre azalan sırada
HarfAdetHarfler içindeki pay
a391%10,76
e317%8,72
i305%8,39
r267%7,35
l248%6,82
t215%5,91
k206%5,67
s175%4,81
n173%4,76
o156%4,29
m154%4,24
ı129%3,55
u106%2,92
d94%2,59
z90%2,48
y84%2,31
ü80%2,2
b76%2,09
p52%1,43
f42%1,16
h40%1,1
g39%1,07
c38%1,05
ş33%0,91
v32%0,88
ç31%0,85
ö30%0,83
ğ17%0,47
j15%0,41

Kelime uzunlukları

Harf sayısına göre madde sayısı
HarfMadde
25
323
452
5108
6112
789
894
934
1026
1113
122
131
151

Hecelerin dağılımı

KS-H1 ile yazımdan hesaplandı; kaynakta doğrulanmış söyleyiş ölçümü değildir.

Otomatik hece sayısına göre madde sayısı
HeceMadde
142
2205
3208
488
516
61

Hesaplama usulü ve sınırlar

  1. 5 Eylül 2026 tarihindeki yerel yayın kataloğundan etkin kaynaklı, yayımlanmış, indekslemeye açık, güvenlik denetimini geçmiş ve anlamı dolu 560 madde alındı. Bu, ziyaretçi veya arama kaydı değildir.
  2. Madde kimliği olarak kalıcı adres kullanıldı. Aynı yazıma sahip ayrı maddeler varsa ayrı gözlem sayılır. Kullanım sıklığına göre ağırlık verilmedi.
  3. Yazımlar Unicode NFC biçimine ve Türkçe küçük harfe çevrildi. Sayımda â, î ve û sırasıyla a, i ve u altında toplandı; özgün yazım indirilen tabloda korundu.
  4. Yalnız Türkçe alfabenin harflerinden oluşan tek sözcükler hesaba katıldı. Bu kesitte 0 madde dışarıda kaldı. Ünlü içermediği için hecelenemeyen madde sayısı: 0.
  5. Harf ve uzunluk sayımı KS-HARF-HECE-1, otomatik heceleme KS-H1 yöntemiyle yapıldı. Payların paydası harf tablosunda toplam harf sayısıdır. Yuvarlanan yüzdeler toplamda küçük fark gösterebilir.

Beta seçicisi ve kaynak kapsamı örneklemi belirler. Bu nedenle sonuçlardan “Türkçenin en sık harfi” veya tarihî İstanbul Türkçesinin yapısı hakkında genel hüküm çıkarılamaz. Yeni maddeler bu tarihli veriyi sessizce değiştirmez; sonraki kesit ayrı bir çalışma olur.

KS-H1 yöntemi ve veri kaynaklarını okuyunuz.

Kaynak, veri ve yeniden hesaplama

Başsözcükler Türkçe Vikisözlük katkıda bulunanlarının içeriklerinden, 1 Ağustos 2026 dökümünü kullanan Kelime Sözlüğü yayın kataloğundan alındı. Her satır kendi kalıcı kaynak revizyonuna bağlanır. Sayımlar ve tablo düzeni Kelime Sözlüğü tarafından üretildi.

Veri dosyaları CC BY-SA 4.0 koşullarıyla sunulur. Sütunlar: kelime, kalıcı adres parçası, kaynak revizyonu, kaynak sürümü, sayıma katılma durumu, harf sayısı ve otomatik hece sayısı.

Hesabı tekrarlamak için CSV'de sayıma katılma değeri 1 olan satırları alınız. Yukarıdaki yazım dönüşümlerinden sonra harfleri toplayınız; uzunluk ve hece sütunlarını gruplandırınız. JSON aynı satırlarla özet tabloları birlikte içerir.

Örneklem SHA-256: 9c6676f6a38dee7d939687091fb9bb46ab6e4c8f45db3a2c95aff54c768249df

Atıf önerisi: Kelime Sözlüğü. “Lügatin harf ve hece dökümü.” Lügat Mecmuası, 5 Eylül 2026 veri kesiti. Yöntem: KS-HARF-HECE-1.

Hesap veya kaynak hatası bildiriniz.