国际常见的字符集分类
- 1.常用字符集分类
-
ASCII及其扩展字符集
- 作用:英语及西欧语言。
- 位数:ASCII是用低7位(b7默认为0)表示,能表示128个字符;
- 扩展使用8位表示,表示256个字符。
- 范围:ASCII从00到7F,扩展从00到FF。
-
ISO-8859-1(1~16)字符集
- 作用:扩展ASCII,表示西欧、希腊语等。
- 位数:8位。
- 范围:从00到FF,兼容ASCII字符集。
-
GB2312字符集
- 作用:国家简体中文字符集,兼容ASCII。
- 位数:使用2个字节表示,能表示7445个符号,包括6763个汉字
- 涵盖所有常用汉字。
- 范围:高字节从A1到F7, 低字节从A1到FE。
- BIG5字符集
- 作用:统一繁体字编码。
- 位数:使用2个字节表示,总计13053个汉字。
- 范围:高字节从A1到F9,低字节从40到7E,A1到FE。
-
SJIS字符集
- 作用:日文字符编码。
- 位数:使用2个字节表示,总计7724个字符。
- 范围:高字节从81到9F, E0到FC,低字节从40到7E,80到FC。
-
EUC-KR字符集
- 作用:韩文字符编码。
- 位数:使用2个字节表示,总结17048个字符
- 范围:高字节从81到FD,低字节从40到7E,80到FE。
-
GBK字符集
- 作用:它是GB2312的扩展,加入对繁体字的支持,兼容GB2312。
- 位数:使用2个字节表示,可表示21886个字符。
- 范围:高字节从81到FE,低字节从40到FE (7F 除外)。
-
GB18030字符集
- 作用:它解决了中文、日文、朝鲜语等的编码,兼容GBK。
- 位数:它采用变字节表示(1 ASCII,2,4字节)。可表示27484个文字。
- 范围:1字节从00到7F; 2字节高字节从81到FE,低字节从40到7E和80到FE;4字节第一三字节从81到FE,第二四字节从30到39。
-
UCS字符集
- 作用:国际标准 ISO 10646 定义了通用字符集 (Universal Character Set)。它是与UNICODE同类的组织,UCS-2和UNICODE兼容。
- 位数:它有UCS-2和UCS-4两种格式,分别是2字节和4字节。
- 范围:目前,UCS-4只是在UCS-2前面加了0×0000。
-
UNICODE字符集
- 作用:为世界650种语言进行统一编码,兼容ISO-8859-1。
- 位数:UNICODE字符集有多个编码方式,分别是UTF-8,UTF-16和UTF-32。
- 范围:目前UNICODE支持所有语言的字符,所以也是应用最广泛的编码方式
-
ASCII及其扩展字符集
SAP中对字符集用CODEPAGE标识
-
SAP中使用函数模块:SCP_CODEPAGE_BY_EXTERNAL_NAME 获取字符集的CODEPAGE代码
- UTF-8
- GBK
- UTF-8
-
SAP中使用表:TCP00A 获取字符集的CODEPAGE代码
- UTF-8
- UTF-8