标签:#中日韩汉字

共 32 篇文章

Unihan數據庫

Unihan數據庫是統一碼聯盟在中日韓統一表意文字中維護的數據庫文件。 內容 數據庫中包括統一碼標準中全部經過編碼的統一漢字,具體有: 統一碼與各國家、地區標準及各工業標準的映射。 依據重要字典(如康熙字典)的排序索引。 經過編碼的異體字。 漢字在各種語言中的發音。 英文釋義。 實現 數據庫的發布方式有: 統一碼聯盟維護的網站版本。 可供下載的[http://www.unicode.org/Public/UNIDATA/Unihan.z…

縱書與橫書

縱書指文字由上而下排列,橫書則是文字各個左右並排。漢字沒有限定書寫方向,橫排、縱排甚至混用均可,是現代語言文字比較少見的現象,是方塊字語文的一種特色。 目前世界上絕大多數文字使用橫書,互聯網領域也優先支持橫書模式,傳統上即使用橫書的文字體系包括拉丁字母、希臘字母、西里爾字母、阿拉伯-波斯字母、希伯來字母及婆羅米文字,其中發源於中東的阿拉伯和希伯來字母從右到左書寫。 東亞的漢文化圈国家所用文字因其以音节为文字字符基本单位的特性,大部分既可…

中日韓統一表意文字擴展區B

中日韓統一表意文字擴展區B()是一個Unicode區段,在Unicode版本3.1被引入。 來源 擴展B區包含有42,711個新的漢字,位置在 U+20000–U+2A6DD。根據[http://www.cse.cuhk.edu.hk/~irg/irg/N777_CJK_B_CoverNote.pdf IRG N777號文件],這四萬多個漢字分別從以下字典或字集中取得: 《康熙字典》中出現的18,486個未收錄漢字(包括一個在補遺篇出現…

中日韩汉字

、越南文、粵文、簡體中文、繁體中文、日文、(北韓與南韓用的)韓文]] 中日韩汉字()是對中文、日文文字和韓文的統稱,這些語言全部含有汉字及其變體,某時亦會與其他文字混合使用。因為越南文曾經使用漢字,所以它有時候也與「中日韩」結合,統稱「中日韓越」()。概括來說,「中日韓越漢字」通常包括中文的漢字、日文文字的日本汉字及日語假名、韓文的朝鮮漢字及諺文和越南文的儒字和喃字。 歷史 標準普通話和廣東話幾乎可以全數使用漢字表達,基本識字需要300…

喃字

喃字(,),或称为「字喃」,是一種過去在越南通行,以汉字为素材,运用形聲、會意、假借等造字方式来表达越南语的文字,其在越南古代文字系統中的地位和作用與朝鮮諺文、日語假名相同,都被用來表示本民族固有詞彙,而漢字(儒字)則用來表示從古漢語中引入的漢字詞。 喃字是在汉字的基础上,在10世纪至20世纪初形成发展起来的。在這段時間裡,喃字是记录民族历史、文化的媒介。 京族人创造喃字,用来为越语、岱依語和瑶语记音,造成越喃字(喃字)、岱喃字、()。…

國際表意文字核心

國際表意文字核心(',簡稱'或易擴)是現時漢字編碼的最小標準。它總共記載了東亞地區的一萬個常用字,包括東亞地區各個國家及地區的第一常用字平面。這一萬字的組合如下: 中國大陸(6944字) 台灣(6608字) 香港(5139字) 澳門(4960字) 日本(4593字) 南韓(4759字) 朝鮮(4653字) 其他被收入Unicode的字(7772字) 這一萬個字所包含的,並不單單限於中日韓統一表意文字基本字面的漢字。當中有42個字位於擴展…

中日韓統一表意文字

中日韓統一表意文字(),又稱統漢碼、統一漢字集(),是指在ISO 10646與統一碼標準中經過「漢字等同」處理的漢字。漢字等同()是指將中文、日文、韓文、越南文、壮文、琉球文等書寫系統共通的中日韩汉字賦予相同編碼的做法;被合併編碼的漢字,往往起源相同、本義相通、形狀大同小異。 中日韓認同表意文字 中日韓統一漢字集 中日韓統合漢字 除了「漢字等同」,Han Unification 又譯為: 漢字認同 漢字統一 漢字統合 歷史 1978年,…

中日韓統一表意文字擴展區G

中日韓統一表意文字擴展區G是一個Unicode區段,草擬時曾用名 IRG Working Set 2015,在2020年3月發佈的 Unicode 13.0 中正式收錄進Unicode。 擴展G區共收錄4939個漢字,編碼範圍為30000至3134A,是首個位於第三輔助平面上的區塊。多筆畫罕用字「」和「」皆列於本區。 字表 歷史 以下的文件紀錄了本區塊字元的收錄過程和目的: 註釋 參見 中日韓統一表意文字 註釋 來源 [https://…

变体 (Unicode)

在Unicode中,字符变体指通过编码字符序列显示同一字符的不同字形。这种变体序列()由一个基本字符后紧跟一个变体选择符(variation selector)组成。 一个字符的变体通常与它的基本字符有非常相像的外观和涵义。这项技术旨在当一个字符的变体字形不可用时,仍显示其基本字符,却不改变文本本身的涵义。 Unicode定义了两种变体序列: 标准变体序列():由统一码字符数据库()文件StandardizedVariants.txt收…

表意文字描述字符

表意文字描述字符(,IDC)是一块收录描述表意文字(如汉字)结构的符号的Unicode區段,其中部分描述符号编码于其他区段。 目前大部份編碼包含Unicode,處理漢字編碼時大致是先搜集漢字,给予每个漢字一个數字編碼。然而,漢字數量龐大,字集往往不完全;再加上漢字本身是開放組合,漢字的使用者很可能自造新字,不可能有一个可以搜集到所有漢字的字集,所以用這些字符描述某「字」如何以較簡單的部件組合起來。 码表 表意文字描述序列 表意文字描述序…

未統一漢字列表

有些字只是同一字在不同地區的寫法,但因為原字集分離原則而只好分開編碼。由於南韓1998(U+F900-U+FA0B,268個字)、台灣Big5(U+FA0C-U+FA0D,2個字)、日本IBM 32(CP932變種;U+FA0E-U+FA2D,32個字)、南韓2004(U+FA2E-U+FA2F,2個字)、日本JIS X 0213(U+FA30-U+FA6A,59個字)、ARIB STD-B24(U+FA6B-U+FA6D,3個字)和北…

中日韓相容字元

中日韓相容字元是一個位於基本多文種平面的Unicode區塊,收錄了方塊符號(包括中日韓和拉丁字母數字),用於兼容東亞各字符集。本區塊在1.0版本中並不存在,其分為兩個區塊,即中日韓方塊詞語(,)與中日韓方塊縮寫(,)。 字符為日本年號符號平成(㍻)、昭和(㍼)、大正(㍽)與明治 (㍾)。當今的日本年號令和(㋿)因本區塊碼位已滿,而編碼於上一區塊中日韓圍繞字元及月份的最末端。 码表 意义 歷史 下列與Unicode相關的文檔記錄了在本區塊…

中日韓圍繞字元及月份

中日韓圍繞字元及月份()是一個Unicode區段,編碼位置在 3200–32FF,主要用於信件、電報中,內容包含了帶圓圈、括弧、括號的字元——包括漢字、朝鮮語諺文字母和片假名字元,電報十二個月的符號和來自21個數字較大的字符集。此外也包括因碼位滿座而無法放在中日韓相容字元區的日本年號「令和」(㋿)。Unicode中還有中日韓圍繞字元補充區。 區段字符表 繪文字 本區段中出現了兩個繪文字:U+3297 和 U+3299。。本區段中還有四個…

部首

部首,是依照漢字型態和偏旁所分的門類,而所有漢字勢必分類在某個部首中。 历史 部首的概念由東漢文字學家許慎於公元100年(永元12年)所著之《說文解字》所創,共立540個部首。從此字書一般使用部首作為漢字的檢字方式。 之後、許多字書模仿《說文解字》,以部首來分類漢字。如《玉篇》(542部首)、《類篇》(540部首)等,這些字書採用的字體已經是楷書,內容也不是解說文字的來源,而是說明字義為主。但使用的部首幾乎與《說文解字》相同,不易檢索的…

中日韓統一表意文字表 (一二三序)

中日韓統一表意文字表 (一二三序),簡稱“CJK字表 (YES序)”,是按 一二三排檢法排列的中日韩统一表意文字(CJK Unified Ideographs)列表。這是一種比傳統的部首排檢法(應用於Unicode CJK blocks)更爲簡捷的漢字排檢方法。 無需筆畫計數和分組,且不影響準確性。簡而言之,一二三排檢法按照筆順來排列漢字,並使用一個包含 30 個筆畫的「字母表」: ㇐ ㇕ ㇅ ㇎ ㇡ ㇋ ㇊ ㇍ ㇈ ㇆ ㇇ ㇌ ㇤ ㇀…

中日韓統一表意文字 (Unicode區段)

中日韓統一表意文字()是Unicode區段,收錄了現代漢語與日語最常用的漢字。也称「中日韓統一表意文字基本区」。 中日韓統一表意文字區段包含了20,992個漢字,編碼範圍為U+4E00–U+9FFF,Unicode 14.0起已完整填满。 此區段中的U+4E00–U+9FA5共20,902字,是在Unicode 1.0.1版本時初始制定的,亦常被稱爲「Unified Repertoire and Ordering」,簡稱「URO」。 在…

中日韓統一表意文字擴展區E

中日韩统一表意文字扩展区E()是一个Unicode區段,在2015年6月17日发布的Unicode 8.0中被引入。 扩展E区共收录5774个汉字,编码范围为 U+2B820-U+2CEAF。 扩展E区原定收录扩展D区未收录的10000多个汉字,但在2008年11月,中国大陆以“难以逐个找证据”为理由,撤销了3215个汉字,这些汉字主要用于地名、人名、姓氏,亦有数百个《中国大百科全书》中的文字。这是继台湾撤销6545字之后的又一次大规模…

中日韓相容表意文字

中日韓兼容表意文字區()收錄的,是指中日韓越統一表意文字中因為「原規格分離原則」未與正式字集(包括擴展A、B、C、D區)的字統一的中日韩汉字。 有些字只是同一字在不同地區的寫法,理應統一,但因為原規格分離原則而分開編碼。以下標準均有字形非常接近但編碼上分離的字,為實現與這些標準的互換性而創立此區。 南韓KS X 1001(U+F900-U+FA0B,268個字;多個字和正式字集區的字寫法相同,但因讀音不同而於原字集分開編碼) 台灣Big…

中日韓統一表意文字擴展區F

中日韓統一表意文字擴展區F()是一個Unicode區段,在2017年6月20日發佈的Unicode 10.0中被引入。 擴展F區共收錄7473個漢字,編碼範圍為U+2CEB0-U+2EBEF。 扩展F区的汉字主要来自: 中国大陆: G_CY:《辞源》122字 G_FC:《现代汉语规范词典》27字 G_IDC:公安部身份证用字1字 G_LGYJ:《壮族嘹歌研究》1字 G_OCD:《牛津英汉汉英词典》2字 G_PGLG:《壮族民歌文化丛书·…

笔画

笔画(也写作“笔划”)指漢字書寫時,不間斷地一次連續寫成的一條線條。日常使用時,一般都指楷書書寫和印刷字形(例如明體)的筆畫。包括本條目描述的內容也是如此。若要指篆籀古文字或草書的筆畫,多會另作說明。笔画是汉字的最小构成单位。笔画可分为基本筆畫和複合筆畫兩大類。 基本說明 傳統上,楷書和印刷字形的基本筆畫有八種,包括:橫()、豎()、撇()、捺()、點()、挑()、鈎()、彎()。現代還新增了曲()和圈()兩種。當中,前六種基本筆畫可以…