Metin Dosyası Kodlama Dönüştürücü

Bir metin café yerine café ya da naïve yerine naïve gösteriyorsa karakterler yerinde demektir: yanlış okunan şey kodlamadır. Metni yapıştırın, dönüştürücüye onu hangi kodlamayla okuyacağını ve hangisiyle yazacağını söyleyin; UTF-8, UTF-16, ISO-8859-1 (Latin-1), Windows-1252 ve diğer yaygın kod sayfaları arasında temiz bir şekilde yeniden kodlar. Düzeltilen sonucu doğrudan düzenleyicinize, elektronik tablonuza veya veritabanınıza kopyalayın.

Metin kodlaması nasıl dönüştürülür

  1. 1

    Metninizi yapıştırın

    Bozuk görünen veya başka bir program için yeniden kodlamanız gereken herhangi bir metin.

  2. 2

    Algılamayı kontrol edin

    Alanın üstünde yaklaşık bir ipucu olası kodlamayı gösterir.

  3. 3

    Kaynak kodlamasını seçin

    Baytların nasıl okunacağına göre «Kaynak» değerini ayarlayın: UTF-8, Windows-1252, ISO-8859-1, SJIS ve daha fazlası.

  4. 4

    Hedef kodlamasını seçin

    UTF-8 modern standarttır; belirli bir program gerektirdiğinde UTF-16, Big5 veya GB2312 hazırdır.

  5. 5

    Dönüştürün ve kopyalayın

    Metin yeniden kodlanır ve tek tıkla sonuç panoya kopyalanır.

Kodlama uyuşmazlıkları nereden gelir

Kaynak Olası kodlama
Windows’ta Excel «CSV olarak kaydet» Windows-1252
Eski Windows uygulaması Windows-1252
Eski Unix aracı ISO-8859-1 (Latin-1)
Modern macOS/Linux düzenleyici UTF-8
Windows’ta Japonca metin Shift-JIS (SJIS)
Windows’ta Basitleştirilmiş Çince GB2312
Geleneksel Çince (Tayvan/Hong Kong) Big5

Klasik belirtiler

  • UTF-8 baytları Latin-1 olarak okunduğunda café, café olarak görünür. Baytları yeniden doğru yorumlamak için «Kaynak» değerini UTF-8 yapın.
  • Aynı nedenle ñ, ñ olur.
  • café gibi çift mojibake, metnin ilk yanlış okumadan sonra yeniden kaydedildiğini ve yanlış yorumun ikinci kez kodlandığını gösterir.
  • Baştaki , üç Latin-1 karakteri olarak okunmuş bir UTF-8 bayt sırası işaretidir.

Belirtiyi tanıdıktan sonra yol genellikle bellidir: metni gerçekte ne ise öyle okuyun (Latin-1, Windows-1252 veya hangisi geçerliyse) ve UTF-8 olarak geri yazın.

Bayt sırası işaretleri (BOM)

Bu dönüştürücü bir bayt sırası işaretini isteyerek eklemez veya kaldırmaz: davranış hedef kodlamaya bağlıdır. UTF-8 çıktısı BOM içermez. Düz UTF-16 çıktısı bir BOM ile başlar ve big-endian’dır; UTF-16BE ve UTF-16LE ise baytları BOM olmadan yazar. Belirli bir program UTF-16 istemedikçe UTF-8’i seçin.

Bir karakterin karşılığı olmadığında

Bazı baytlar seçtiğiniz kaynak kodlamada anlam taşımaz, bazı karakterler de hedef kodlamada gösterilemez. Böyle bir durumda dönüştürme, durmak yerine bir yer tutucu koyar. En önemlisi doğru kaynak kodlamasını seçmektir: yalnızca ASCII içeren bir dize her kodlamada geçerlidir, bu yüzden uyuşmazlık genellikle ancak aksanlı veya Latin dışı karakterler olduğunda ortaya çıkar.

Sık Sorulan Sorular

«Kaynak» ve «Hedef» listelerinin her ikisi de UTF-8, UTF-16, UTF-16BE, UTF-16LE, ISO-8859-1, ISO-8859-15, Windows-1252, ASCII, EUC-JP, SJIS (Shift-JIS), GB2312 ve Big5 sunar. Herhangi birinden herhangi bir diğerine dönüştürebilirsiniz.

Web, veritabanları ve neredeyse tüm modern işlemler için evet. İstisnalar: yalnızca Windows-1252 okuyan eski Windows uygulamaları, bazı eski ana bilgisayar araçları ve Shift-JIS bekleyen belirli Japonca yazılımlardır.

Bayt düzenine dayalı, UTF-8, UTF-16, ISO-8859-1, Windows-1252 ve ASCII arasından seçilen yaklaşık bir tahmindir. Kısa veya yalnızca ASCII içeren metinlerde yanılabilir; onu bir ipucu olarak görün ve daha iyi bildiğinizde «Kaynak» kodlamasını kendiniz ayarlayın.

Metin, dönüştürmeyi yapmak için sunucumuza gönderilir ve yanıt döndürüldükten sonra saklanmaz. Gizli materyaller için yerleşik kodlama dönüştürücüsü olan çevrimdışı bir düzenleyici tercih edilmelidir.

İlgili Araçlar

Araç diğer dillerde mevcuttur