(,擴增二进式十进交換碼),为IBM於1963年-1964年间推出的字元编码表,根据早期打孔机式的**'即一种二进化十进数(BCD,Binary Coded Decimal)信息交换编码改进而成。是IBM迷尔級以上電腦的標準碼。
它的缺点是:英文字母不是连续地排列,中间出现多次断续,为撰写程式的人带来了一些困难。
字符对应
EBCDIC编码表,最初定义了(不计空白字符在内的)88个可打印字符,同时还定义了减去26个小写字母后的62个可打印字符的子集:
在处理ASCII可打印字符之时,将其[占位¢,其]占位!,其!占位(表示逻辑或的)|,而其^占位(表示逻辑非的)¬,并补充上所缺少的属于ASCII的6个标点符号,成为(不计空白字符在内的)94个可打印字符的编码表:
]]|208|style=background:#DDD}}
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|-
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|-
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|}
在后来代码页版本的EBCDIC中,定义了“不变子集”58个字符,即在62个可打印字符子集基础上再去掉4个被占用了字符,并且计空白字符而不计$在内,如下图灰色底所示。然后于各版本的编码表中,加入了其他字符,以符合各地使用者所需。
以下是其中两个版本的EBCDIC编码表:CP037(英语)及CP500(多语言#5)。CP037为ASCII的[、]和^重新指定了位置不再占用EBCDIC的¢、!和¬,将其!认同为原来EBCDIC的!。CP500为被占用的EBCDIC的¢、|和¬重新指定了位置,将EBCDIC的!认同为占用了其位置的!。
於编码表中,0x00 - 0x3F及0xFF为控制字元,0x40为空格,0x41为不换行空格(no-break space),0xCA为选择性连字号(soft hyphen)。
参见
*ASCII
*Unicode
外部链接
*[http://publib.boulder.ibm.com/cgi-bin/bookmgr/BOOKS/QB3AQ501/F.0 F.0 Appendix F. Code Pages] from [http://publib.boulder.ibm.com/cgi-bin/bookmgr/BOOKS/QB3AQ501/CCONTENTS AS/400 International Application Development V4R2]
*[https://web.archive.org/web/20090210051329/http://icu-project.org/charts/charset/ ICU Character Mapping Tables] 包含EBCDIC与Unicode的对应表
*[https://web.archive.org/web/20041208161204/http://www.legacyj.com/cobol/ebcdic.html LegacyJ- EBCDIC Table]
*[https://web.archive.org/web/20031021033105/http://www.geocities.com/mikes_javascript/hex_table_ascii.html Computer Character Set Table]
*[http://www.unicode.org/reports/tr16/#Table%201 Unicode Technical Report #16: UTF-EBCDIC]I
评论 (0)