区域指示符()是一组用以对ISO 3166-1二位字母代码标准的二字母國家地區代碼进行编码的26个Unicode字符。这种编码允许对于特定地区的符号进行特殊处理。
2010年10月,Unicode 6.0的发布为国家地区旗帜的繪文字表示提供了区域指示符,作为「对每一面旗帜都进行编码」的替代方案。除了作为拉丁字母显示外,这些符号的部分组合还可以在一些设备上渲染成符号对应的国家或地区的旗帜。[https://www.unicode.org/faq/ Unicode FAQ]表明,国家与地区的旗帜不会在Unicode中直接编码到单独的码位上去,而应当以此法编码。
在Unicode编码中,这些符号位于与之间,在第一辅助平面的帶圈字母數字補充区段。
绘文字旗帜列表
在一些系统中,旗帜的绘文字可能会显示为二位国家地区代码。
一组区域指示符称为一个「绘文字旗帜序列」,虽然其代码代表的是地区而非旗帜。
在所有的26 × 26 = 676个双字母组合中只有270个是合法的Unicode地区代码,包含了通用當地數據儲存庫(CLDR)的以下子集:
- CLDR中全部的256个常规的地区代码序列
- CLDR中的两个宏观区域(macroregion)的代码序列(EU与UN)
- CLDR中全部12个已弃用的地区代码序列(仅作向前兼容用)
Unicode区段
背景
在2007年,Unicode收到了一份对于广泛使用的绘文字编码提案,这份提案上的绘文字主要出自日本通讯公司NTT DOCOMO、KDDI和软银集团之手。提案中的符号包含了下列十面旗帜:(🇨🇳)、(🇩🇪)、(🇪🇸)、(🇫🇷)、(🇬🇧)、(🇮🇹)、(🇯🇵)、(🇰🇷)、(🇷🇺)和(🇺🇸)。有观点认为,仅仅对于这十面旗帜编码这一做法包含偏见。一个被驳回的编码提案是,在保留旗帜的情况下,称它们为「绘文字兼容字符-n」(EMOJI COMPATIBILITY SYMBOL-n)并以标准「EC n」显示,而不展示它们代表的旗帜;另一个被驳回的提案为676种双字母组合中每一种都分配了码位,以ISO 3166标准(如FR代表法国)或国家和地区顶级域(如EU代表欧盟)与旗帜对应。
最终被接受的方案添加了与拉丁字母相对应的26个字符以表示区域指示符,当其按照上文的序列出现时会呈现出对应的旗帜,同时为绘文字的扩充预留了空间以供后续添加。,此处特指以下十面国旗:🇨🇳、🇩🇪、🇪🇸、🇫🇷、🇬🇧、🇮🇹、🇯🇵、🇰🇷、🇷🇺和🇺🇸。
由于Unicode的区域指示符只提供地区代码、不提供旗帜,特定的系统可以采取不渲染字符的方式以避免引起非议。如在台湾问题中,对于实际统治台湾地区的台北政府,北京政府拒绝承认,因此在中国大陆的新闻媒体报道中,中华民国国旗会被作马赛克处理,而在大陆法律下的电子产品,「🇹🇼」也会显示为字符缺失或不作为旗帜显示。
参见
- 旗幟表情圖標排列次序
註釋
参考文献
评论 (0)