Unicode中的音标符号

Unicode通过已有的书写系统和添加带音标字符的额外的区段支持一些音标文字和标记法。这些语音学符号产生于已有的文字,通常是拉丁文、希腊文或西里尔文。Unicode中没有专门的“国际音标字符”。除官方标准的国际音标外,这些区段还包括了已被现今标准规范废除的国际音标符号、、过去使用的汉语音调符号等。

音标字符
国际音标利用来自其他书写系统最常用的标音字母。国际音标常使用拉丁字母、希腊字母和西里尔字母,组合用变音符号还补充语音文本的意义。最后,这些标音字母利用为表达语言学含义特别修订的字母。一个“修饰字母”不是作为独立的字母,但作为前面字符的修饰产生有区别的字素,尤其是在国际音标中。例如,ʰ不是用来表达它本身,但修饰了前面的符号。因此,是单独的区别于的国际音标符号。然而,这些“修饰字母”的一部分也用于全音素文字。例如,ʿ 用来转写闪米特语的ayin或夏威夷语okina,或者 ˚ 转写阿布哈兹语 ә。

从国际音标到Unicode
辅音
下表包含了国际音标用的音位的Unicode码点。加粗的码点表示Unicode图标提供应用程序注释,如用于“浊卷舌边音”。粗斜体表示字符名称本身标示了发音,如

元音
下表描述了元音及其Unicode / UCS码点。表格中成对的元音分别地表示不圆唇和圆唇的变化。另外,带Unicode名称的字符以粗体标出。带有额外应用程序注释的字符以粗斜体标出。直接借用其他文字(拉丁字母、希腊字母或西里尔字母)的以斜体标出。

Unicode区段
不同于标准拉丁字母或希腊字母如m和ɛ,这些符号放在特定的语音学用区段:

  • 國際音標擴展(0250–02AF)
  • 占位修飾符號 (02B0–02FF)
  • 音標擴展(1D00–1D7F)
  • 音標擴展補充(1D80–1DBF)
  • 聲調修飾符號(A700–A71F)
  • 上標及下標(2070–209F)

从Unicode区段到文字
语音学用的字符放在六个Unicode区段中。

国际音标扩展(U+0250–02AF)
占位修饰符号(U+02B0–02FF)
占位修饰符号区段里面的字符用来和前面的字母组成一个单元(即“修饰”)。如字符不是简单的表示上标h(h),但是作为送气音符号放在字母后面表示送气,像是。这个区段包含了:
*拉丁上标修饰符号(U+02B0–U+02B8): ʰ 送气 ʱ 呼气音 ʲ 腭音化 ʳ, ʴ, ʵ, ʶ 儿化或 r-offglides ʷ 唇化 ʸ 腭化,用(U+02B2)
*杂项语音学修饰符(U+02B9–U+02D7):ʹ ʺ ʻ ʼ ʽ ʾ ʿ ˀ ˁ ˂ ˃ ˄ ˅ ˆ ˇ ˈ ˉ ˊ ˋ ˌ ˍ ˎ ˏ ː ˑ ˒ ˓ ˔ ˕ ˖ ˗
*间隔用变音符号(U+02D8–U+02DD):˘ 抑扬符 ˙ 上点 ˚ 上圈; ˛ ogonek ˜ 腭化符; ˝ 双尖音符
*基于1989年国际音标附加的(U+02DE–U+02E4):˞ ˟ ˠ ˡ ˢ ˣ ˤ
*声调符号(U+02E5–U+02E9):˥ ˦ ˧ ˨ ˩
*扩展注音符号声调标记:,
*国际音标修饰字符:,不送气
*其他修饰符号:,用于涅涅茨语
*乌拉尔音标修饰符号(U+02EF–U+02FF):˯ ˰ ˱ ˲ ˳ ˴ ˵ ˶ ˷ ˸ ˹ ˺ ˻ ˼ ˽ ˾ ˿

音标扩展(U+1D00–1D7F)
这个区段和下面的音标扩展增补包括了:

  • 小型大写字母“ɢ ɪ ɴ ɶ ʀ ʏ ʙ ʜ ʟ”
  • 倒转的小写字母“ɐ ɥ ɯ ɹ ɺ ɻ ʇ ʌ ʍ ʎ ʞ ʮ ʯ”
  • 额外的小型大写字母“ʁ ʛ ᴀ ᴁ ᴃ ᴄ ᴅ ᴆ ᴇ ᴊ ᴋ ᴌ ᴍ ᴎ ᴏ ᴐ ᴘ ᴙ ᴚ ᴛ ᴜ ᴠ ᴡ ᴢ ᴣ ᴦ ᴧ ᴨ ᴩ ᴪ”
  • 带硬腭音钩的小写字母“ƫ ᶀ ᶁ ᶂ ᶃ ᶄ ᶅ ᶆ ᶇ ᶈ ᶉ ᶊ ᶋ ᶌ ᶍ ᶎ ᶪ ᶵ”
  • 带卷舌钩的小写字母“ᶏ ᶐ ᶒ ᶓ ᶔ ᶕ ᶖ ᶗ ᶘ ᶙ ᶚ ᶩ ᶯ ᶼ”

音标扩展增补(U+1D80–1DBF)
声调修饰符号(U+A700–A71F)

  • U+A700到U+A707的8个符号不是标准的国际音标符号。它们只是在早期被用于标示汉语的声调调类(不是调值,平上去入、各分阴阳,所以一共8个符号),标准国际音标规范中没有这8个符号。
  • U+A717到U+A71A不是标准的国际音标符号,它们用于记录奇南特克语的声调符号。
  • U+A71B到U+A71F不是标准的国际音标符号,它们用于记录非洲语言的声调

上标和下标(U+2070–209F)
参见
*Unicode符號
*Unicode字符列表
*Unicode中的拉丁字母
*国际音标
*組合附加符號

参考资料
外部链接

评论 (0)

  • 还没有评论,来抢沙发吧。