Yapay Zekâ Promptları İçin Token Sayacı
Promptunuzu veya metninizi yapıştırın; token sayacı tahmini token sayısını gerçekçi bir aralıkla gösterir. Değerler, seçilen metin dili için OpenAI tokenizer’larıyla yapılan ölçümlere dayanır. Metniniz tarayıcıda kalır.
Nasıl hesaplanır?
Token, bir dil modelinin metni böldüğü birimdir – tam kelimeler, kelime parçaları, noktalama işaretleri veya boşluklar. Ücretlendirme ve sınırlar (bağlam penceresi, en uzun yanıt) karakterle değil, tokenla ölçülür.
Token nasıl sayılır?
- Promptunuzu veya metninizi kutuya yapıştırın.
- Metnin dilini seçin – Türkçe veya Lehçe metinler İngilizce metinlerden belirgin şekilde daha fazla token gerektirir.
- Tahmini token sayısını aralığıyla birlikte, karakter ve kelime sayısıyla okuyun.
Örnek: 2.000 karakterlik bir Türkçe metin, token başına ortalama 2,72 karakterle yaklaşık 2.000 / 2,72 ≈ 735 token eder. Aynı uzunluktaki İngilizce bir metin (token başına 3,89 karakter) yaklaşık 2.000 / 3,89 ≈ 514 tokendir.
Pratik kural: token başına yaklaşık 4 karakter – ama İngilizcede
OpenAI, tiktoken tokenizer’ının token başına ortalama yaklaşık 4 bayt olduğunu söyler; Google da Gemini için token başına „yaklaşık 4 karakter” belirtir. İki değer de İngilizce metin içindir. Diğer diller daha fazla token gerektirir; çünkü tokenizer’lar ağırlıklı olarak İngilizce metinle eğitilmiştir ve Türkçe gibi eklemeli bir dilde „kütüphanelerimizden” gibi uzun kelimeler birkaç parçaya bölünür.
Rakamlar nereden geliyor?
OpenAI tokenizer’ları o200k_base (GPT-4o ve sonrası) ile cl100k_base (GPT-4, GPT-3.5) dil başına 39–56 metinle (27 Eylül 2026), Türkçe ve Lehçe için 128 ve 139 metinle (28 Eylül 2026) ölçüldü. Token başına ortalama karakter:
- İngilizce: 3,9 (aralık 3,3–4,5)
- Almanca: o200k ile 3,6, cl100k ile 3,1 (aralık 2,7–4,2)
- Fransızca: 3,7 ve 3,3 (aralık 2,9–4,2)
- İspanyolca: 3,7 ve 3,3 (aralık 2,9–4,2)
- Portekizce: 3,7 ve 3,2 (aralık 2,7–4,2)
- Türkçe: 3,0 ve 2,4 (aralık 2,3–3,3)
- Lehçe: 2,9 ve 2,6 (aralık 2,4–3,1)
Tahmin, karakter sayısını iki tokenizer’ın ortalamasına böler; aralık, tek tek metinlerin 10. ve 90. yüzdelik değerlerinden gelir. Program kodu, tablolar, çok sayıda rakam, emoji veya farklı yazı sistemli diller (Çince, Arapça…) belirgin şekilde sapabilir.
Neden kesin bir sayaç değil?
Kesin bir tokenizer tüm token tablosunu yüklemek zorunda kalır – o200k_base için yaklaşık 3,6 MB. Hızlı bir sayfa için bu orantısız olur. Ayrıca Claude, Gemini ve Llama kendi tokenizer’larını kullanır; kesin sayıyı yalnızca ilgili sağlayıcı verebilir (örneğin bir token sayma arayüzüyle).
Sıkça sorulan sorular
1.000 kelime kaç token eder?
İngilizcede yaklaşık 1.300–1.400 token (ölçülen ortalama: kelime başına 1,4 token). Türkçede belirgin şekilde daha fazladır: aynı karakter sayısı için İngilizceden yaklaşık %40 daha fazla token gerekir ve Türkçe kelimeler ekler nedeniyle genellikle daha uzundur. En güvenlisi metni yapıştırıp sonucu okumaktır.
ChatGPT için sonuç kesin mi?
Hayır, ChatGPT tokenizer’larıyla yapılan ölçümlere dayanan bir tahmindir. Test metinlerimizde gerçek değerlerin %80–90’ı gösterilen aralıktaydı; orta değer medyanda %6–12 sapıyordu.
Claude veya Gemini için de çalışır mı?
Kabaca evet, ancak her modelin kendi tokenizer’ı vardır. Google da Gemini için İngilizcede token başına yaklaşık 4 karakter belirtir. Kesin sayılar yalnızca sağlayıcıların kendi arayüzlerinden, örneğin OpenAI, Claude veya Gemini token sayma uç noktalarından alınır.
Metnim bir yere yükleniyor mu?
Hayır. Sayım yalnızca tarayıcınızda yapılır; metin gönderilmez, kaydedilmez ve adres çubuğuna yazılmaz.
Boşluklar ve satır sonları neden sayılıyor?
Tokenizer’lar boşlukları da işler: boşluk genellikle sonraki kelimeye eklenir, birden fazla boşluk veya satır sonu ise ayrı token olur. Bu yüzden tahmin tüm karakterlere dayanır.
Token nedir?
Token, ChatGPT gibi bir yapay zekâ modelinin işlediği metin parçasıdır – çoğu zaman bir kelimenin bir kısmı. Sık kullanılan İngilizce kelimeler genellikle tek tokendir; uzun veya nadir kelimeler birkaç parçaya bölünür.
Türkçe metin neden İngilizceden daha fazla token kullanır?
Tokenizer’lar ağırlıklı olarak İngilizce metinle oluşturulmuştur; Türkçe kelimeler ekleri ve ç, ğ, ı, ş gibi harfleriyle daha sık daha fazla parçaya bölünür. Ölçümlerimizde Türkçe token başına ortalama 2,72 karakter, İngilizce 3,89 karakter verdi.
Kaynaklar ve yasal dayanak
- OpenAI tiktoken (MIT) – “each token corresponds to about 4 bytes”; o200k_base / cl100k_base used for the measurement
- Google AI for Developers – Understand and count tokens (“about 4 characters”)
- Anthropic – Token counting (exact counts via the Claude API)
Güncelleme:
Benzer araçlar
- Karakter Sayacı ve Kelime SayacıOnline karakter sayacı: boşluklu ve boşluksuz karakter, kelime, cümle, paragraf ve okuma süresini anında sayın – X, Instagram, TikTok ve SMS sınırlarıyla.
- Şifre oluşturucuŞifre oluşturucu: güçlü rastgele şifreler ve akılda kalan parola cümleleri oluşturun, entropiyi bit olarak görün – tarayıcınızda, hiçbir şey gönderilmez.
- Şifre gücü testiŞifre gücü testi: şifreniz ne kadar güvenli? Bit cinsinden entropi, zayıf kalıplar ve kırılma süresi – yerel olarak tarayıcıda, şifre hiçbir yere gönderilmez.
- Büyük Harf Küçük Harf ÇevirmeBüyük harfi küçük harfe, küçük harfi büyük harfe çevirin: Türkçe İ/ı doğru, cümle düzeni, Title Case, camelCase, snake_case. Ücretsiz ve anında.
- Hashtag Sayacı ve Instagram Açıklama DüzenleyiciHashtag ve @etiketleri sayın, tekrar eden hashtagleri bulun ve açıklamanızı düzenleyin: hashtagleri sona taşıyın, paragrafları koruyun. Ücretsiz ve gizli.
- Lorem Ipsum OluşturucuÜcretsiz lorem ipsum oluşturucu: paragraf, cümle veya tam kelime sayısı, „Lorem ipsum dolor sit amet” başlangıcı, isteğe bağlı HTML ve tek tıkla kopyalama.