諺文音節

諺文音節是一個位於基本多文種平面的Unicode區塊,包含了現代標準語中使用的預組諺文音節。這些音節可以通過算法直接映射到諺文字母區塊中的兩個或三個字符的序列:

*位於的字符:19個現代諺文的初聲輔音字母;
*位於的字符:21個現代諺文的元音字母;
*無,或位於的字符:27個現代諺文的終聲輔音字母。
本區塊是根據2個或3個諺文字母(上述每個諺文字母子範圍中的一個)组成的每一個音节的規範順序編碼的。

區塊
歷史
碼位的移動使在Unicode中編碼諺文音節一事變得複雜了起來:
*版本1.0.0時,在編碼了2350個來自KS C 5601-1987的現代諺文音節。而碼位現在是中日韓統一表意文字擴展區A的一部分。
*版本1.1時,在編碼了額外1930個來自KS C 5657-1991的現代諺文音節,在編碼了6個來自GB 12052-89的現代諺文音節,在編碼了2370個不在以上標準的的現代諺文音節。這些字符的碼位範圍涵蓋了中日韓統一表意文字擴展區A的剩餘部分及易經六爻符號的全部。
**另外,版本1.1尚有3處錯誤:
*** U+384E:삤在Unicode字符數據庫中,但삣在ISO/IEC 10646-1:1993碼表和源標準的映射中。
*** U+40BC:삣在Unicode字符數據庫中,但삤在ISO/IEC 10646-1:1993碼表和源標準的映射中。
*** U+436C:콫在Unicode字符數據庫中,但콪在ISO/IEC 10646-1:1993碼表和源標準的映射中。
*版本2.0增加了KS C 5601-1992中剩餘的4516個可能的音節,並將所有已編碼的音節重新排列到目前的碼位範圍內,這樣就可以通過算法將諺文音節分解為單個的諺文字母。

解釋說,這一重大的不兼容變化是在假設不存在使用Unicode的諺文數據或軟件的情況下做出的:

隨後,Unicode採用了一項編碼穩定性政策,即“一旦一个字符被編碼,它將不會被移動或刪除”。

以下Unicode文檔記錄了定義本區塊中特定字符的目的與過程:

另見

  • 諺文字母列表
  • 諺文字母 (Unicode區段)
  • 諺文字母擴展-A
  • 諺文字母擴展-B
  • 諺文兼容字母

參考資料

评论 (0)

  • 还没有评论,来抢沙发吧。