半形及全形字符 (Unicode區段)
半形及全形字符是 Unicode 基本多文种平面内的最后第二个区段,范围包括 U+FF00..U+FFEF。本区段包含全形和半形字符以便可以无损从旧编码系统转换至 Unicode。该区段于 Unicode 1.0 的旧称为 半形及全形变体(Halfwidth and Fullwidth Variants)。 U+FF01..U+FF5E 编码了 ASCII 内 21 至 7E 的全形版本。U+FF00 未对应 ASCII 20 (空格)…
共 14 篇文章
半形及全形字符是 Unicode 基本多文种平面内的最后第二个区段,范围包括 U+FF00..U+FFEF。本区段包含全形和半形字符以便可以无损从旧编码系统转换至 Unicode。该区段于 Unicode 1.0 的旧称为 半形及全形变体(Halfwidth and Fullwidth Variants)。 U+FF01..U+FF5E 编码了 ASCII 内 21 至 7E 的全形版本。U+FF00 未对应 ASCII 20 (空格)…
基本拉丁字母(),又稱C0控制字符及基本拉丁字母(),是Unicode標準下的首個Unicode區段,亦是唯一一個在UTF-8下,以單一字節編碼的區段。此區段包含ASCII編碼下所有與控制字符。該區段的範圍為(共128個字元),包含C0控制字符、ASCII标点符号與規約符號、ASCII數字、英文字母中的大寫與小寫字母,以及一個控制字元。 基本拉丁字母區段內的字元Unicode標準的1.0版本起一直沿用至今,多年來未曾對此作出任何增減。該…
拉丁字母補充-1(),又稱C1控制字符及拉丁字母補充-1(),是Unicode標準下的第二個Unicode區段。該區段將ISO 8859-1中的上部區段80~FF()予以編碼,唯C1控制字符並非可見字元。該區段的碼位範圍為,共有128個字元,當中包括C1控制字符、拉丁字母-1標點與規約符號、30組帶附加符号的大寫及小寫拉丁字母,及2個數學運算子。 C1控制字符及拉丁字母補充-1區段內的字元自Unicode標準的1.0版本起一直沿用至今,…
拉丁字母擴展-B是Unicode標準的第四個區塊。本區塊自1.0版本起成為Unicode標準的一部分,當時它的碼位範圍僅為,包含113個字符。在1.1版本與ISO 10646統一的過程中,本區塊的範圍被擴展了80個碼位,並被另外分配了35個字符。在3.0及以後的版本中,最後的60個可用碼位被分配完畢。 本區塊在1.0版本的名稱為擴展拉丁字母()。 區塊 歷史 以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程: 另見 Unic…
拉丁字母擴展-A是Unicode標準下的第二個Unicode區塊。它包含了ISO/IEC 8859標準中的拉丁字母字符(但已編碼於拉丁字母補充-1區塊的Latin-1除外),以及標準中遺留的拉丁字母字符。 自1.0版本起,拉丁字母擴展-A區塊就已存於Unicode標準中。在1.1版本與ISO 10646統一的過程中,被加入本區塊。本區塊在1.0版本的名稱為歐洲拉丁字母()。 字符表 下表列出拉丁字母擴展-A包含的所有字符: |} 子標題…
Unicode中的拉丁字母和变体: Basic Latin 0000–007F: 與ASCII等同 (0000–001F, 007F 為控制字符,0020–003F 為標點符號和阿拉伯數字) Latin-1 Supplement 0080–00FF: 與ISO/IEC 8859-1等同 (0080–009F 為控制字符,00A0–00BF 為貨幣符號、標點和數字) Latin Extended-A 0100–017F Latin Ext…
拉丁字母擴展-D是一個位於基本多文種平面的Unicode區塊,包含了用於音標、與中世紀轉寫和註釋系統的拉丁字母字符。本區塊中的89個字符是由提議的中世紀字符,其中有許多字符是中世紀手抄本文本中使用的的代表。 區塊 歷史 以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程: 另見 Unicode中的拉丁字母 Unicode中的音標符號 參考資料
上標和下標是一個位於基本多文種平面的Unicode區塊,包含了上標和下標數字、數學運算符以及數學和語音學中使用的字母。使用本區塊中的下標和上標可以使任何多項式、化學方程式和某些其他方程式在純文本中得到表示,而不需要使用任何形式的標記語言,如HTML或TeX。其他的上標字母可以在佔位修飾符號、音標擴展和音標擴展補充區塊中找到,而自ISO 8859-1繼承而來的上標數字1、2和3則位於拉丁字母補充-1區塊中。 區塊 歷史 以下Unicode…
拉丁字母擴展-C是一個位於基本多文種平面的Unicode區塊,收錄了新維文、、紹納語舊正字法、克勞狄字母和瑞典語方言字母中的使用的一些拉丁字母字符。 區塊 歷史 以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程: 另見 Unicode中的拉丁字母 Unicode中的音標符號 參考資料
拉丁字母擴展-E是一個位於基本多文種平面的Unicode區塊,包含了用於,薩哈語舊正字法,,漢語語言學與蘇格蘭語方言學的拉丁字母字符。 區塊 歷史 以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程: 另見 Unicode中的拉丁字母 Unicode中的音標符號 * 參考資料
拉丁字母擴展-F是一個位於第一輔助平面的Unicode區塊,包含了音质符号、國際音標和國際音標擴展的修饰字母。 拉丁字母擴展-F和拉丁字母擴展-G是第一批編碼於基本多文種平面之外的拉丁字母字符。 區塊 歷史 以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程: 另見 Unicode中的拉丁字母 Unicode中的音標符號 * 參考資料
拉丁字母擴展-G是一個位於第一輔助平面的Unicode區塊,包含了用於標音的拉丁字母字符。拉丁字母擴展-F和拉丁字母擴展-G是第一批編碼於基本多文種平面之外的拉丁字母字符。 區塊 歷史 以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程: 另見 Unicode中的拉丁字母 Unicode中的音標符號 參考資料
拉丁字母擴展附加是一個位於基本多文種平面的Unicode區塊,包含了256個拉丁字母字符。本區塊中的字符大多是拉丁字母與一個或多個附加符号的組合,其中有90個用於越南語國語字,還有一些中世紀字符。另外,大寫的ß()亦編碼於本區塊。 區塊 歷史 下列與Unicode相關的文檔記錄了在本區塊中定義特定字符的目的和过程: 另見 *Unicode中的拉丁字母 參考資料
國際音標擴展是一個位於基本多文種平面的Unicode區塊,主要收錄了不在基本拉丁字母、拉丁字母補充-1、拉丁字母擴展-A、拉丁字母擴展-B的國際音標(IPA)字符,其中包括正在使用中的、已棄用的、曾提議使用的國際音標(IPA)符號,還有數個非IPA的語音符號。同樣用於語音學的其他字符,如腭音化符號「」,則被收錄在音標擴展()和音標擴展補充()。變音符號可以在佔位修飾符號()和組合附加符號()等區塊找到。 隨著Unicode能夠完整地標示…