特殊字符是Unicode的一个简短的区段,分配在基本多文种平面的最末端,位于U+FFF0-FFFF。在这16个码位中,有5个是从Unicode 3.0开始分配的。
- U+FFF9 行间注解锚,标志着注解文本的开始。
- U+FFFA 行间注解分隔符,标记注解字符的开始。
- U+FFFB 行间注解終止符,标志着注解块的结束。
- U+FFFC  OBJECT REPLACEMENT CHARACTER,在文本中为另一个未指定的对象提供占位符,例如在一个复合文件中。
- U+FFFD � REPLACEMENT CHARACTER(替换字符),用于替换一个未知的、不被认可的或无法表示的字符。
- U+FFFE 不是一个字符。
- U+FFFF 不是一个字符。
FFFE和FFFF不是通常意义上的未分配字符,但不是Unicode字符。它们可以用来猜测一个文本的编码方案,因为根据定义,任何包含这些的文本都不是一个正确编码的Unicode文本。Unicode的U+FEFF BYTE ORDER MARK(記號;}-)可以插在Unicode文本的开头,以表示它的字节性:一个程序在阅读这样的文本并遇到0xFFFE时,就会知道它应该为后面的所有字符转换字节顺序。
它在Unicode 1.0中的区段名是特殊。
歷史
以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程:
參考資料
评论 (0)