标签:#Unicode

共 45 篇文章

旗幟表情圖標排列次序

旗幟表情圖標排列次序,是Unicode對聯合國會旗、歐洲旗、南極洲洲旗和全球各國家、地區的國旗與區旗表情圖標之排序。此順序跟從外交上的傳統,按國際標準化組織(ISO)授予各國的ISO 3166碼英文字母之先後次序排名。 排列次序表 其他旗幟 此排序只將多數國家和地區的旗幟納入,排除了英格蘭國旗、蘇格蘭國旗、威爾斯國旗及德克薩斯州州旗(分別即🏴󠁧󠁢󠁥󠁮󠁧󠁿、🏴󠁧󠁢󠁳󠁣󠁴󠁿、🏴󠁧󠁢󠁷󠁬󠁳󠁿和🏴󠁵󠁳󠁴󠁸󠁿)。另外,除科索沃、巴勒斯坦、西撒哈拉…

字符值引用

字符值引用(numeric character reference, NCR)是在标记语言SGML以及派生的如HTML与XML中常见的一种转义序列结构,用来表示Unicode的通用字符集 (UCS)中的单个字符. NCR可以表示在一个特定文档中不能直接编码的字符,而该标记语言阅读器软件把每个NCR当作一个字符来处理。 例如,在ISO/IEC 8859-1编码的网页文件中使用了俄文字母或者希腊字母。由于该编码不支持这些字母,就需要用NCR…

预组字符

预组字符 (precomposed character,或者称composite character、decomposable character)是Unicode字符集中的实体,定义为一个或多字符序列。预组字符可以表示一个字母与一个附加符号, 例如é (小写拉丁字母e带一个尖音符). 技术上, é (U+00E9)是一个字符,可以分解为Unicode等效字符串e (U+0065)与尖音符(U+0301). 类似地, 二合字是它们的组成…

左至右符號

左至右符號(Left-to-right mark, LRM)是一種控制字符,或者說是不可見的排版符號。用于計算機的雙向文稿排版中。雙向文稿是指包含左至右的文字(如:英文或天城文),及右至左的文字(如:阿拉伯文或希伯來文)。 統一碼 左至右符號的統一碼字符是U+200E,亦可在HTML中表現為‎ ‎或者‎, UTF-8中則是E2 80 8E。其用法則描述於統一碼的雙向演算法。 參見 統一碼 右至左符號 双向文稿 外部連結 [http://…

零宽连字

零宽连字(zero-width joiner,ZWJ)是一个控制字符,放在某些需要复杂排版语言(如阿拉伯语、印地语)的两个字符之间,使得这两个本不会发生连字的字符产生了连字效果。零宽连字符的Unicode码位是U+200D (HTML: ‍ ‍)。 例子 参见 零宽不连字 参考文献 外部链接 [http://unicode.org/review/pr-37.pdf Proposal on Clarification and Consol…