Unicode控制字符
Unicode控制字符()是用于控制文本解释或者显示,而不可见或不占空间的Unicode字符。 ISO 6429控制字符(C0与C1) 控制字符U+0000‐U+001F 与U+007F来自ASCII。此外,ISO 8859字符集定义了U+0080‐U+009F。二者都定义在ISO 6429中,常被称为C0与C1控制字符。 大部分这些字符在Unicode文本处理中没有明确作用。字符、、、、常用于格式化字符。 Unicode引入的分隔符 …
共 4 篇文章
Unicode控制字符()是用于控制文本解释或者显示,而不可见或不占空间的Unicode字符。 ISO 6429控制字符(C0与C1) 控制字符U+0000‐U+001F 与U+007F来自ASCII。此外,ISO 8859字符集定义了U+0080‐U+009F。二者都定义在ISO 6429中,常被称为C0与C1控制字符。 大部分这些字符在Unicode文本处理中没有明确作用。字符、、、、常用于格式化字符。 Unicode引入的分隔符 …
和短音符組合成Ў.]] 組合字符()在字體排印學中是用來改變其它字符所用的字符。在拉丁字母中,最常見的組合字符為附加符號(包含重音號)。 統一碼也包含許多預組字符(Precomposed character),即事先將字符組好並賦予碼位。所以有可能同時使用組合字符和預組字符。這導致了若要比較兩個統一碼字串或設計編碼轉換器時,需要先執行Unicode正規化。 在統一碼中,用於歐洲語言和國際音標的組合用附加符號為〈U+0300–U+036F…
端序記號,或稱位元組順序記號(,BOM)是位於碼點U+FEFF的統一碼字符的名称。當以UTF-16或UTF-32來將UCS/統一碼字符所組成的字串編碼時,這個字符被用來標示其端序。它也被用來當做標示文件是以UTF-8、UTF-16或UTF-32編碼的記號。 端序記號通常有幾種涵義: 在16位元和32位元的情況下,文字流的端序。 表示文字流非常有可能是統一碼編碼。 使用的是哪一種統一碼字元編碼。 端序記號的使用是選擇性的。它的存在會干擾那…
自由变体选择符(FVS, Free Variant Selector)是Unicode蒙古文区段中的用于选择该码块内文字自由变体的字符。 蒙古文码段内的一些字符具有多种字形变体,具体显示为哪种变体,一些情况下可以依靠算法自动判断,但不能自动判断的场合就需要使用FVS来选择变体。 FVS的使用方法是追加于需要指定变体类型的字符之后。 参考资料