中日韓統一表意文字擴展區B()是一個Unicode區段,在Unicode版本3.1被引入。
來源
擴展B區包含有42,711個新的漢字,位置在 U+20000–U+2A6DD。根據[http://www.cse.cuhk.edu.hk/~irg/irg/N777_CJK_B_CoverNote.pdf IRG N777號文件],這四萬多個漢字分別從以下字典或字集中取得:
*《康熙字典》中出現的18,486個未收錄漢字(包括一個在補遺篇出現的漢字);
*《汉语大字典》中出現的28,914個未收錄漢字;
*《辭源》中出現的66個未收錄漢字;
*《辭海》中出現的247個未收錄漢字;
*《汉语大词典》中出現的553個未收錄漢字;
*《中国大百科全书》中出現的86個未收錄漢字;
*北大方正排版系统中出現的65個未收錄漢字;
*《四庫全書》中出現的522個未收錄漢字;
*香港增補字符集中出現的1,081個未收錄漢字;
*日本工業標準的JIS X 0213第3水準及第4水準的302個未收錄漢字;
*南韓 1998 中出現的166個未收錄漢字;
*北韓 KPS 9566-97 和 KPS 10721-2000 國家標準所收錄的5,642個漢字;
*台灣 CNS 11643 的第4至7和15平面所收錄的30,177個漢字;
*越南 TCVN、VHN 01:1998 和 VHN 02:1998 所收錄的4,232個喃字;
這些漢字中重複的漢字有不少,所以經過整理之後,實際總數只有42,711個漢字。
另外,在 U+2F800–U+2FA1D 的位置,放了542個來自台灣的兼容漢字。
重複收錄
因擴展B區在整理上有缺陷,收錄了以下9個本來應該與其他漢字統一的字:
*U+20457 = U+34A8
*U+2420E = U+3DB7
*U+27144 = U+8641
*U+27EAF = U+FA23
*U+23515 = U+204F2
*U+249E9 = U+249BC
*U+2A415 = U+24BD2
*U+26866 = U+26842
*U+21018 = U+2103C
川幡太一在表意文字小組的N1155文件中,列出了152對可考慮統一的漢字。
字符列表
以下列表列出了在中日韩统一表意文字扩展区B中的所有文字:
- 中日韩统一表意文字扩展区B列表
為避免頁面過大,下列提供分段的中日韩统一表意文字扩展区B列表:
- 中日韩统一表意文字扩展区B列表 (20000–215FF)
- 中日韩统一表意文字扩展区B列表 (21600–230FF)
- 中日韩统一表意文字扩展区B列表 (23100–245FF)
- 中日韩统一表意文字扩展区B列表 (24600–260FF)
- 中日韩统一表意文字扩展区B列表 (26100–275FF)
- 中日韩统一表意文字扩展区B列表 (27600–290FF)
- 中日韩统一表意文字扩展区B列表 (29100–2A6DF)
参见
*中日韩统一表意文字
參考資料
引-{}-用
來源
- [https://web.archive.org/web/20150625054518/http://unicode.org/charts/PDF/U20000.pdf unicode定義的PDF文件](英语)
评论 (0)