Yapay Zekâ Promptları İçin Token Sayacı

Promptunuzu veya metninizi yapıştırın; token sayacı tahmini token sayısını gerçekçi bir aralıkla gösterir. Değerler, seçilen metin dili için OpenAI tokenizer’larıyla yapılan ölçümlere dayanır. Metniniz tarayıcıda kalır.

Ctrl+V ile yapıştırın. Siz yazarken anlık sayılır.

Metniniz tarayıcınızda kalır – gönderilmez, kaydedilmez ve adres çubuğuna eklenmez.

Türkçe metin, aynı karakter sayısında İngilizceden yaklaşık %40 daha fazla token gerektirir.
Girdileriniz yalnızca bu tarayıcıda saklanır.

Sonuç

Tahmini token
≈ 99
Olağan aralık
82 ile 118 token arası
Karakter
270
Boşluksuz karakter
227
Kelime
43
Satır
3
Bu kesin bir sayım değil, tahmindir: her yapay zekâ modeli metni kendi tokenizer’ıyla böler. Aralık, test metinlerimizin %80–90’ını kapsadı (OpenAI o200k_base ve cl100k_base).

Nasıl hesaplanır?

Token, bir dil modelinin metni böldüğü birimdir – tam kelimeler, kelime parçaları, noktalama işaretleri veya boşluklar. Ücretlendirme ve sınırlar (bağlam penceresi, en uzun yanıt) karakterle değil, tokenla ölçülür.

Token nasıl sayılır?

  1. Promptunuzu veya metninizi kutuya yapıştırın.
  2. Metnin dilini seçin – Türkçe veya Lehçe metinler İngilizce metinlerden belirgin şekilde daha fazla token gerektirir.
  3. Tahmini token sayısını aralığıyla birlikte, karakter ve kelime sayısıyla okuyun.

Örnek: 2.000 karakterlik bir Türkçe metin, token başına ortalama 2,72 karakterle yaklaşık 2.000 / 2,72 ≈ 735 token eder. Aynı uzunluktaki İngilizce bir metin (token başına 3,89 karakter) yaklaşık 2.000 / 3,89 ≈ 514 tokendir.

Pratik kural: token başına yaklaşık 4 karakter – ama İngilizcede

OpenAI, tiktoken tokenizer’ının token başına ortalama yaklaşık 4 bayt olduğunu söyler; Google da Gemini için token başına „yaklaşık 4 karakter” belirtir. İki değer de İngilizce metin içindir. Diğer diller daha fazla token gerektirir; çünkü tokenizer’lar ağırlıklı olarak İngilizce metinle eğitilmiştir ve Türkçe gibi eklemeli bir dilde „kütüphanelerimizden” gibi uzun kelimeler birkaç parçaya bölünür.

Rakamlar nereden geliyor?

OpenAI tokenizer’ları o200k_base (GPT-4o ve sonrası) ile cl100k_base (GPT-4, GPT-3.5) dil başına 39–56 metinle (27 Eylül 2026), Türkçe ve Lehçe için 128 ve 139 metinle (28 Eylül 2026) ölçüldü. Token başına ortalama karakter:

Tahmin, karakter sayısını iki tokenizer’ın ortalamasına böler; aralık, tek tek metinlerin 10. ve 90. yüzdelik değerlerinden gelir. Program kodu, tablolar, çok sayıda rakam, emoji veya farklı yazı sistemli diller (Çince, Arapça…) belirgin şekilde sapabilir.

Neden kesin bir sayaç değil?

Kesin bir tokenizer tüm token tablosunu yüklemek zorunda kalır – o200k_base için yaklaşık 3,6 MB. Hızlı bir sayfa için bu orantısız olur. Ayrıca Claude, Gemini ve Llama kendi tokenizer’larını kullanır; kesin sayıyı yalnızca ilgili sağlayıcı verebilir (örneğin bir token sayma arayüzüyle).

Sıkça sorulan sorular

1.000 kelime kaç token eder?

İngilizcede yaklaşık 1.300–1.400 token (ölçülen ortalama: kelime başına 1,4 token). Türkçede belirgin şekilde daha fazladır: aynı karakter sayısı için İngilizceden yaklaşık %40 daha fazla token gerekir ve Türkçe kelimeler ekler nedeniyle genellikle daha uzundur. En güvenlisi metni yapıştırıp sonucu okumaktır.

ChatGPT için sonuç kesin mi?

Hayır, ChatGPT tokenizer’larıyla yapılan ölçümlere dayanan bir tahmindir. Test metinlerimizde gerçek değerlerin %80–90’ı gösterilen aralıktaydı; orta değer medyanda %6–12 sapıyordu.

Claude veya Gemini için de çalışır mı?

Kabaca evet, ancak her modelin kendi tokenizer’ı vardır. Google da Gemini için İngilizcede token başına yaklaşık 4 karakter belirtir. Kesin sayılar yalnızca sağlayıcıların kendi arayüzlerinden, örneğin OpenAI, Claude veya Gemini token sayma uç noktalarından alınır.

Metnim bir yere yükleniyor mu?

Hayır. Sayım yalnızca tarayıcınızda yapılır; metin gönderilmez, kaydedilmez ve adres çubuğuna yazılmaz.

Boşluklar ve satır sonları neden sayılıyor?

Tokenizer’lar boşlukları da işler: boşluk genellikle sonraki kelimeye eklenir, birden fazla boşluk veya satır sonu ise ayrı token olur. Bu yüzden tahmin tüm karakterlere dayanır.

Token nedir?

Token, ChatGPT gibi bir yapay zekâ modelinin işlediği metin parçasıdır – çoğu zaman bir kelimenin bir kısmı. Sık kullanılan İngilizce kelimeler genellikle tek tokendir; uzun veya nadir kelimeler birkaç parçaya bölünür.

Türkçe metin neden İngilizceden daha fazla token kullanır?

Tokenizer’lar ağırlıklı olarak İngilizce metinle oluşturulmuştur; Türkçe kelimeler ekleri ve ç, ğ, ı, ş gibi harfleriyle daha sık daha fazla parçaya bölünür. Ölçümlerimizde Türkçe token başına ortalama 2,72 karakter, İngilizce 3,89 karakter verdi.

Kaynaklar ve yasal dayanak

Güncelleme:

Benzer araçlar