ASCII Metin Dönüştürücü

ASCII karakter kodlarını okunabilir metne dönüştür ve sınırlarını keşfet.

Bir metin kutusuna emoji ya da Türkçe karakter yapıştırdığında bazen bozuk sembollerle karşılaşırsın. Bu durum sistemdeki bir hata değil, ASCII standardının bu sembolleri taşımak için üretilmemiş olmasından kaynaklanır.

ASCII ile Unicode arasındaki ilişki

İnternetteki metinlerin temelini oluşturan modern Unicode standardı, ASCII ile geriye dönük uyumlu biçimde tasarlanmıştır. Unicode listesindeki ilk 128 karakter noktası, yani 0 ile 127 arası, orijinal ASCII tablosuyla tamamen örtüşür. Kod olarak 65 girdiğinde, hem ASCII hem de Unicode dünyasında elde edeceğin sonuç her zaman A harfidir.

Fakat bu tam uyum tam olarak 127 sınırında biter. Özel harfler, para birimi simgeleri ya da emojiler standart ASCII tablosunda yer almaz. Bu karakterleri kayıpsız temsil etmek için bir milyondan fazla kod noktasını kapsayan geniş Unicode alanına geçmek gerekir.

Karakterlerin bozulma sebebi ve ASCII kodlama

Günümüz metinlerini taşıyan UTF-8 kodlaması, 127 üzerindeki karakterleri tek bayt yerine iki, üç veya dört bayt kullanarak ifade eder. Gelen veriyi körlemesine tek baytlık ASCII gibi ele alan bir sistem, birden fazla bayttan oluşan karakteri parçalar ve her baytı bağımsız olarak çözmeye kalkar. Ekrana anlamsız semboller yansımasının asıl sebebi budur.

Örneğin sırıtan yüz emojisi (U+1F600), UTF-8 biçiminde tam dört bayt gerektirir. Bu dört baytı katı bir ASCII çözücüye tek tek verdiğinde, ortaya tek bir emoji yerine dört anlamsız kontrol karakteri çıkar.

ASCII kodlarını metne dönüştürme adımları

  1. Dönüştürmek istediğin sayısal kodları veya bayt dizilimini girdi alanına ekle.
  2. Dönüştürme butonuna tıkla ve güvenlik adımını tamamla.
  3. Sunucuda işlenen okunabilir metin sonucunu alandan kopyala.

En sık yaşanan ASCII uyumluluk sorunları

  • Sadece temel ASCII bekleyen sistemlere özel tırnak veya uzun tire içeren metinlerin aktarılması.
  • Yalnızca ASCII kabul eden veritabanlarına Müller gibi aksanlı isimlerin kaydedilmeye çalışılması.
  • Farklı bölgelerden dışa aktarılmış ve farklı kodlama varsayılan CSV belgelerinin açılması.
  • Hala 7-bit ASCII formatını şart koşan eski e-posta altyapıları ve miras API servisleri.
  • Görsel olarak benzeyen ama aslında ASCII aralığının dışında kalan kutu çizim karakterleri.

ASCII dönüştürme hakkında sorular

ASCII ile Unicode tamamen aynı şey midir?

Hayır, fakat Unicode standardının ilk 128 karakteri ASCII ile tamamen eşleşecek şekilde belirlenmiştir. ASCII bağımsız ve dar kapsamlı bir tabloyken, Unicode bu tabloyu da içine alan devasa bir standarttır.

Çözülen metinde neden anlamsız simgeler çıkıyor?

Kaynak metin çok baytlı UTF-8 karakterleri barındırdığında ve bu baytlar tek tek bağımsız ASCII karakteri gibi yorumlandığında beklenen harf yerine karmaşık simgeler oluşur.

ASCII tablosu emojileri destekler mi?

Hayır. ASCII tablosunda yalnızca 128 kod noktası yer alır ve bunlar yalnızca temel Latin harflerini, rakamları, noktalama işaretlerini ve kontrol kodlarını barındırır. Emojiler için Unicode gereklidir.

Karakter bozulmalarını önlemenin en güvenli yolu nedir?

Veriyi okurken, saklarken ve gösterirken baştan sona UTF-8 kullanmaktır. Hataların büyük çoğunluğu, zincirin tek bir halkasında ASCII varsayımının yapılmasından doğar.

Bu araç 127 üzerindeki kodları doğrudan çözebilir mi?

Araç 0 ile 127 arasındaki standart ASCII kodlarını net olarak dönüştürür. Bu sınırın üzerindeki değerler için çok baytlı Unicode kodlamasını dikkate alan bir yapı gerekir.

Cookie
Verilerinizi önemsiyoruz ve deneyiminizi geliştirmek için çerezleri kullanmayı çok isteriz.