今天小編給大家分享的是java中GBK轉(zhuǎn)UTF-8亂碼如何解決,相信很多人都不太了解,為了讓大家更加了解GBK轉(zhuǎn)UTF-8亂碼的解決方法,所以給大家總結(jié)了以下內(nèi)容,一起往下看吧。一定會(huì)有所收獲的哦。
成都創(chuàng)新互聯(lián)堅(jiān)持“要么做到,要么別承諾”的工作理念,服務(wù)領(lǐng)域包括:成都網(wǎng)站設(shè)計(jì)、網(wǎng)站制作、企業(yè)官網(wǎng)、英文網(wǎng)站、手機(jī)端網(wǎng)站、網(wǎng)站推廣等服務(wù),滿足客戶于互聯(lián)網(wǎng)時(shí)代的祁陽網(wǎng)站設(shè)計(jì)、移動(dòng)媒體設(shè)計(jì)的需求,幫助企業(yè)找到有效的互聯(lián)網(wǎng)解決方案。努力成為您成熟可靠的網(wǎng)絡(luò)建設(shè)合作伙伴!
java中GBK轉(zhuǎn)UTF-8亂碼的解決方法
如果自己采用的是GBK編碼,對(duì)方采用得到是UTF-8編碼,發(fā)送數(shù)據(jù)時(shí)需要將GBK編碼數(shù)據(jù)轉(zhuǎn)換成UTF-8編碼數(shù)據(jù),這樣對(duì)方才不會(huì)亂碼。
問題出現(xiàn):GBK轉(zhuǎn)UTF-8時(shí),奇數(shù)個(gè)中文會(huì)亂碼,偶數(shù)個(gè)中文不會(huì)亂碼。
原因分析:
public static void analyze() throws UnsupportedEncodingException { String gbk = "我來了"; String utf8 = new String(gbk.getBytes("UTF-8")); for (byte b : gbk.getBytes("UTF-8")) { System.out.print(b + " "); } System.out.println(); for (byte b : utf8.getBytes()) { System.out.print(b + " "); } } /* -26 -120 -111 -26 -99 -91 -28 -70 -122 -26 -120 -111 -26 -99 -91 -28 -70 63 ! */
注意最后一個(gè)字節(jié)不同,上面一行才是正確的UTF-8編碼。那么為什么下面一行最后一個(gè)字節(jié)是63,而不是-122呢?這就是導(dǎo)致亂碼的原因所在。
GBK編碼是一個(gè)中文2個(gè)字節(jié),而UTF-8編碼是一個(gè)中文3個(gè)字節(jié),當(dāng)我們調(diào)用getBytes("UTF-8")方法時(shí),會(huì)通過計(jì)算來增加字節(jié),使得從GBK的2個(gè)字節(jié)變成UTF-8對(duì)應(yīng)的3個(gè)字節(jié)。因此,上例3個(gè)中文輸出了9個(gè)字節(jié)。
()
解決問題
保證字節(jié)正確才是硬道理。當(dāng)調(diào)用getBytes("UTF-8")轉(zhuǎn)換成字節(jié)數(shù)組后,創(chuàng)建ISO-8859-1編碼的字符串,ISO-8859-1編碼是一個(gè)字節(jié)對(duì)應(yīng)一個(gè)字符,因此不會(huì)使最后一個(gè)字節(jié)錯(cuò)誤。
public static void correctEncode() throws UnsupportedEncodingException { String gbk = "我來了"; String iso = new String(gbk.getBytes("UTF-8"),"ISO-8859-1"); for (byte b : iso.getBytes("ISO-8859-1")) { System.out.print(b + " "); } System.out.println(); //模擬UTF-8編碼的網(wǎng)站顯示 System.out.println(new String(iso.getBytes("ISO-8859-1"),"UTF-8")); } /* -26 -120 -111 -26 -99 -91 -28 -70 -122 我來了 */
關(guān)于java中GBK轉(zhuǎn)UTF-8亂碼如何解決就分享到這里了,希望以上內(nèi)容可以對(duì)大家有一定的參考價(jià)值,可以學(xué)以致用。如果喜歡本篇文章,不妨把它分享出去讓更多的人看到。