Neden Türkçe sitelerde kritik?
Karakter kodlaması yanlış ayarlandığında Türkçe karakterler bozuk görünür:
Doğru: Güncelleme, İçerik, Şirket, Çözüm
Bozuk: Güncelleme, İçerik, Åirket, çözüm
Bu, hem kullanıcı deneyimini bozar hem içeriğin doğru anlaşılmasını engeller.
Doğru ayar
<meta charset="UTF-8">
Bu etiket <head> bölümünün en başında yer almalıdır. Ayrıca sunucu da doğru başlık göndermelidir:
Content-Type: text/html; charset=UTF-8
Nerelerde sorun çıkar?
| Alan | Belirti |
|---|---|
| Sayfa içeriği | Bozuk karakterler |
| Veritabanı | Kayıtlar bozuk saklanır |
| Form gönderimleri | Gelen veri bozuk |
| Dışa aktarım (CSV) | Excel'de bozuk açılır |
| E-posta | Bildirimlerde bozukluk |
| Meta etiketler | Arama sonucunda bozuk görünüm |
Tutarlılık gerekir: Veritabanı, uygulama ve sayfa aynı kodlamayı kullanmalıdır.
Adreslerde Türkçe karakter
Adreslerde Türkçe karakter kullanmak teknik olarak mümkündür ama önerilmez:
- Adres kodlanır ve okunaksız hâle gelir
- Paylaşımda ve kopyalamada sorun çıkar
- Bazı sistemlerde uyumsuzluk yaşanır
Doğru yaklaşım: Türkçe karakterleri dönüştürmek (ç→c, ğ→g, ı→i, İ→i, ö→o, ş→s, ü→u).
Büyük harf tuzağı
Türkçede i harfinin büyüğü İ, ı harfinin büyüğü I'dır. Birçok sistem bunu yanlış yapar:
Yanlış: istanbul → ISTANBUL
Doğru: istanbul → İSTANBUL
Bu, başlık ve menü metinlerinde bozuk görünüme yol açar. Türkçe dil ayarı doğru yapılandırılmalıdır.
Kontrol
Sayfayı açıp Türkçe karakter içeren bir metne bakın. Bozukluk varsa önce meta etiketi, sonra sunucu başlığını, sonra veritabanı kodlamasını kontrol edin.
Ne anlama gelir?
Karakter kodlaması (character encoding), bir web sayfasındaki metnin harflerinin bilgisayar tarafından nasıl temsil edileceğini belirleyen sistemdir. Modern web'in standardı UTF-8'dir; Türkçe karakterler (ç, ğ, ı, ö, ş, ü) dahil dünyadaki hemen tüm karakterleri doğru gösterebilir. Yanlış veya eksik kodlama, metnin bozuk (ör. "ç", "Å") görünmesine yol açar ve hem deneyimi hem SEO'yu bozar.
Neden önemli?
- Yanlış kodlama Türkçe karakterleri bozar (okunmaz metin)
- Bozuk metin kullanıcıyı ve arama motorunu yanıltır
- UTF-8, Türkçe içerik için doğru ve güvenli standarttır
Nasıl doğru yapılır?
Doğru karakter kodlaması için sayfanın UTF-8 kullandığını hem HTML meta etiketiyle (charset=UTF-8) hem sunucu başlığıyla bildirmek gerekir. Ayrıca dosyaların da UTF-8 olarak kaydedilmesi önemlidir; kaynak dosya farklı bir kodlamadaysa, doğru meta etiketi bile metni kurtarmaz. Türkçe içerikli siteler için bu özellikle kritiktir; çünkü ç, ğ, ı gibi karakterler yanlış kodlamada en çok bozulanlardır. Baştan UTF-8 standardını benimsemek, bu sorunların tamamını önler.
Gerçek örnek
Türkçe bir sitede metinler "ç" gibi bozuk karakterlerle görünüyordu; sayfa ile dosya kodlaması uyuşmuyordu. Hem sayfa hem dosyalar UTF-8'e getirildiğinde, tüm Türkçe karakterler doğru göründü ve okunabilirlik sorunu çözüldü.
Özet
Karakter kodlaması, metin harflerinin nasıl temsil edileceğini belirler; modern standart UTF-8'dir ve Türkçe karakterleri doğru gösterir. Yanlış kodlama metni bozar. Sayfa, sunucu ve dosyaların hepsini UTF-8'e ayarlamak, özellikle Türkçe içerikte şarttır.