Rumah > Java > javaTutorial > Bagaimana Mengendalikan Penanda BOM dalam Pembacaan Fail UTF-8?

Bagaimana Mengendalikan Penanda BOM dalam Pembacaan Fail UTF-8?

Mary-Kate Olsen
Lepaskan: 2024-11-26 10:59:12
asal
911 orang telah melayarinya

How to Handle BOM Markers in UTF-8 File Reading?

Mengendalikan Penanda BOM dalam Pembacaan Fail UTF-8

Apabila berurusan dengan fail teks berkod UTF-8 yang mungkin mengandungi Tanda Pesanan Bait ( BOM), adalah penting untuk mengendalikan BOM dengan betul untuk mengelakkan keluaran yang tidak dijangka. BOM ialah jujukan bait khas yang menunjukkan susunan bait fail. Dalam UTF-8, BOM ialah jujukan tiga bait EF BB BF.

Pertimbangkan kod berikut:

fr = new FileReader(file);
br = new BufferedReader(fr);
String tmp = null;
while ((tmp = br.readLine()) != null) {
    String text;    
    text = new String(tmp.getBytes(), "UTF-8");
    content += text + System.getProperty("line.separator");
}
Salin selepas log masuk

Dalam kod ini, BOM akan disertakan dalam rentetan output teks kerana kaedah getBytes() mendapatkan semula bait mentah rentetan, termasuk BOM. Untuk mengendalikan BOM dengan betul, anda boleh menggunakan teknik berikut:

Kaedah 1: Tentukan Set Aksara BOM

Anda boleh menentukan set aksara sebagai UTF-8 dengan BOM menggunakan kelas Charset:

Charset charset = Charset.forName("UTF-8");
String text = new String(tmp.getBytes(charset), charset);
Salin selepas log masuk

Kaedah 2: Baca dan Lepaskan BOM

Jika BOM tidak diperlukan, anda boleh membaca dan melepaskannya sebelum memproses fail yang lain:

char[] bom = new char[3];
int bytesRead = br.read(bom, 0, bom.length);
if (bytesRead == bom.length && new String(bom).equals("\uFEFF")) {
    // BOM exists, drop it
}
Salin selepas log masuk

Dengan melaksanakan salah satu daripada teknik ini, anda boleh memastikan bahawa BOM dikendalikan dengan betul dan rentetan output tidak termasuk penanda BOM.

Atas ialah kandungan terperinci Bagaimana Mengendalikan Penanda BOM dalam Pembacaan Fail UTF-8?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

sumber:php.cn
Kenyataan Laman Web ini
Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn
Artikel terbaru oleh pengarang
Tutorial Popular
Lagi>
Muat turun terkini
Lagi>
kesan web
Kod sumber laman web
Bahan laman web
Templat hujung hadapan