JAVA方法 字符串与unicode的相互转换
生活随笔
收集整理的這篇文章主要介紹了
JAVA方法 字符串与unicode的相互转换
小編覺得挺不錯的,現在分享給大家,幫大家做個參考.
unicode編碼簡而言之就是將每一個字符用16位2進制數標識。但是通常都用4位的16進制數標識。
例如:
1)中文字符串"你好"的unicode碼為:\u<?XML:NAMESPACE PREFIX = ST1 />4f60\u597d;
2)英文字符串"ab"的unicode碼為:\u0061\u0062;
其中\u是標識unicode碼用的,后面的4位16進制數則是對應字符的unicode碼。
unicode碼在J2EE項目中應用廣泛,java對unicode碼提供了很好的支持。例如國際化,則是unicode的經典運用。
那么unicode的編碼規則具體是什么,如何用程序實現?
1、unicode編碼規則
unicode碼對每一個字符用4位16進制數表示。具體規則是:將一個字符(char)的高8位與低8位分別取出,轉化為16進制數,
如果轉化的16進制數的長度不足2位,則在其后補0,然后將高、低8位轉成的16進制字符串拼接起來并在前面補上"\u" 即可。
2、轉碼程序
1)字符串轉unicode
/**
* 將字符串轉成unicode
* @param str 待轉字符串
* @return unicode字符串
*/
public String convert(String str)
{
str = (str == null ? "" : str);
String tmp;
StringBuffer sb = new StringBuffer(1000);
char c;
int i, j;
sb.setLength(0);
for (i = 0; i < str.length(); i++)
{
c = str.charAt(i);
sb.append("\\u");
j = (c >>>8); //取出高8位
tmp = Integer.toHexString(j);
if (tmp.length() == 1)
sb.append("0");
sb.append(tmp);
j = (c & 0xFF); //取出低8位
tmp = Integer.toHexString(j);
if (tmp.length() == 1)
sb.append("0");
sb.append(tmp);
}
return (new String(sb));
}
2)unicode轉成字符串,與上述過程反向操作即可
/**
* 將unicode 字符串
* @param str 待轉字符串
* @return 普通字符串
*/
public String revert(String str)
{
str = (str == null ? "" : str);
if (str.indexOf("\\u") == -1)//如果不是unicode碼則原樣返回
return str;
StringBuffer sb = new StringBuffer(1000);
for (int i = 0; i < str.length() - 6;)
{
String strTemp = str.substring(i, i + 6);
String value = strTemp.substring(2);
int c = 0;
for (int j = 0; j < value.length(); j++)
{
char tempChar = value.charAt(j);
int t = 0;
switch (tempChar)
{
case 'a':
t = 10;
break;
case 'b':
t = 11;
break;
case 'c':
t = 12;
break;
case 'd':
t = 13;
break;
case 'e':
t = 14;
break;
case 'f':
t = 15;
break;
default:
t = tempChar - 48;
break;
}
c += t * ((int) Math.pow(16, (value.length() - j - 1)));
}
sb.append((char) c);
i = i + 6;
}
return sb.toString();
}
例如:
1)中文字符串"你好"的unicode碼為:\u<?XML:NAMESPACE PREFIX = ST1 />4f60\u597d;
2)英文字符串"ab"的unicode碼為:\u0061\u0062;
其中\u是標識unicode碼用的,后面的4位16進制數則是對應字符的unicode碼。
unicode碼在J2EE項目中應用廣泛,java對unicode碼提供了很好的支持。例如國際化,則是unicode的經典運用。
那么unicode的編碼規則具體是什么,如何用程序實現?
1、unicode編碼規則
unicode碼對每一個字符用4位16進制數表示。具體規則是:將一個字符(char)的高8位與低8位分別取出,轉化為16進制數,
如果轉化的16進制數的長度不足2位,則在其后補0,然后將高、低8位轉成的16進制字符串拼接起來并在前面補上"\u" 即可。
2、轉碼程序
1)字符串轉unicode
/**
* 將字符串轉成unicode
* @param str 待轉字符串
* @return unicode字符串
*/
public String convert(String str)
{
str = (str == null ? "" : str);
String tmp;
StringBuffer sb = new StringBuffer(1000);
char c;
int i, j;
sb.setLength(0);
for (i = 0; i < str.length(); i++)
{
c = str.charAt(i);
sb.append("\\u");
j = (c >>>8); //取出高8位
tmp = Integer.toHexString(j);
if (tmp.length() == 1)
sb.append("0");
sb.append(tmp);
j = (c & 0xFF); //取出低8位
tmp = Integer.toHexString(j);
if (tmp.length() == 1)
sb.append("0");
sb.append(tmp);
}
return (new String(sb));
}
2)unicode轉成字符串,與上述過程反向操作即可
/**
* 將unicode 字符串
* @param str 待轉字符串
* @return 普通字符串
*/
public String revert(String str)
{
str = (str == null ? "" : str);
if (str.indexOf("\\u") == -1)//如果不是unicode碼則原樣返回
return str;
StringBuffer sb = new StringBuffer(1000);
for (int i = 0; i < str.length() - 6;)
{
String strTemp = str.substring(i, i + 6);
String value = strTemp.substring(2);
int c = 0;
for (int j = 0; j < value.length(); j++)
{
char tempChar = value.charAt(j);
int t = 0;
switch (tempChar)
{
case 'a':
t = 10;
break;
case 'b':
t = 11;
break;
case 'c':
t = 12;
break;
case 'd':
t = 13;
break;
case 'e':
t = 14;
break;
case 'f':
t = 15;
break;
default:
t = tempChar - 48;
break;
}
c += t * ((int) Math.pow(16, (value.length() - j - 1)));
}
sb.append((char) c);
i = i + 6;
}
return sb.toString();
}
轉載于:https://blog.51cto.com/zorro/689900
創作挑戰賽新人創作獎勵來咯,堅持創作打卡瓜分現金大獎總結
以上是生活随笔為你收集整理的JAVA方法 字符串与unicode的相互转换的全部內容,希望文章能夠幫你解決所遇到的問題。
- 上一篇: IDEA中自动导包快捷键
- 下一篇: solaris 10安装Oracle10