标签:#字符集

共 74 篇文章

统一码

Unicode,全稱為Unicode標準(The Unicode Standard),其官方機構Unicode聯盟所用的中文名称为統一-{}-碼,又译作萬國-{}-碼、統一字元碼、统一字符编码,是信息技术領域的一種字符编码標準,其整理了世界上大部分的文字系統,使得電腦能以通用劃一的字符集來字元編碼以及處理和顯示文字,不但減輕在不同字符編碼間切換和轉換的困擾,更提供了一種跨平臺的亂碼問題解決方案。Unicode由非營利機構Unicode聯…

倚天碼

倚天碼,或稱倚天擴充字集,是台灣倚天公司於1980年代開發的中文內碼,現已無人使用。 倚天碼是台灣1980年代「萬碼奔騰」時期產物之一,因其編碼修改自公會碼,故所收符號與字和Big5碼大致相同,但排列次序不同(同時期類似的還有通用碼、王安碼、IBM 5550碼等等),亦另外支援倚天字、日文假名、西里爾字母等字符。倚天碼好處是其首位元組(Lead Byte)避開DOS(半形)畫圖符號,使得可與之共存,不會產生亂碼。雖然有此優點,但其與Mi…

大五碼

大五碼(,又稱五大專案碼、五大碼)是繁体中文社群最常用的電腦漢字字符集標準,共收錄13060個漢字。 大五碼雖普及於台灣、香港、澳門等繁體中文區域,但長期以來並非當地的國家/地區標準或官方標準,而只是業界標準。倚天中文系統、Windows繁體中文版等主要作業系統的字符集都是以大五碼為基準,但廠商又各自增加不同的造字與造字區,衍生成多種版本。 2003年,大五碼收錄到CNS11643中文標準交換碼的附錄當中,取得正式地位。這最新版稱為Bi…

全形和半形

{{各地中文名 |name= |where=港澳臺 |other=全-{}-形 |zh-cn=全-{}-角 |where2=日韓 |other2=全-{}-角 }} {{各地中文名 |name= |where=港澳臺 |other=半-{}-形 |zh-cn=半-{}-角 |where2=日韓 |other2=半-{}-角 }} {{Redirect|全形|抽象代數的群論中的全-{}-形|全形 (數學)全-{}-形 (數學)|完整显示U…

摩尔斯电码

编码的摩尔斯电码声音]] 摩尔斯电码()是一种时通时断的信号代码,通过不同的排列顺序来表达不同的英文字母、数字和标点符号。其前身由美國發明家萨缪尔·摩尔斯及其助手艾爾菲德·維爾在1837年前後發明。另外,信號在1906年即已制訂,但英國的無線電操作員当时很少使用信號,他們更喜歡老式的遇難信號。而传闻则称鐵達尼號的無線電首席官員約翰·喬治·菲利普一直在發送遇難信號,直到下級無線電操作員哈羅德·布萊德建議他:「發送吧,這是新的呼叫信號,這也…

幽靈漢字

幽靈漢字(),又稱幽靈文字()是JIS基本漢字所收錄的出處不明漢字的總称。 概述 1978年,當時的通商產業省制定的JIS C 6226(後來的JIS X 0208)中規定了JIS第1、第2水準漢字6349字。該漢字集稱為「JIS基本漢字」。當時以下列4個漢字表為典據,採用了其中的漢字:。 標準碼用漢字表(試案)():情報處理學會漢字碼委員会(1971年) 國土行政區劃總覽():(1951年初版,经多次改版。1972年版已散佚) 日本生…

ISO/IEC 8859-1

ISO 8859-1,正式编号为ISO/IEC 8859-1:1998,又称Latin-1或“西欧语言”,是国际标准化组织内ISO/IEC 8859的第一个8位字符集。它以ASCII为基础,在空置的0xA0-0xFF的范围内,加入96个字母及符号,藉以供使用附加符号的拉丁字母语言使用。曾推出过 ISO 8859-1:1987 版。 ISO-8859-1的别名有: iso-ir-100、csISOLatin1、 latin1、 l1、 I…

ISO-IR-165

ISO-IR-165《通訊用中文多位元組字符集》(Codes of the Chinese graphic character set for communication)是中國大陸於1992年為国际电信联盟电信标准化部门(CCITT) 創製之中文多位元組通訊字符集。该编码在ISO 2022下注册的名称为 ISO-IR-165,可以使用 ISO-2022-CN-EXT 进行编码。 ISO-IR-165 整合 GB 2312(包括 GB/…

ISO/IEC 8859

ISO/IEC 8859,是国际标准化组织(ISO)及国际电工委员会(IEC)联合制定的一系列8位元字符集的标准。除了已废除的ISO/IEC 8859-12,现在该标准定义了15个字符集。目前负责制定 ISO/IEC 8859 的工作组已经解散,该标准已由ISO/IEC 10646(对应统一码/)取代。 引言 ASCII收录了空格及94个“可印刷字符”,足以给英语使用。但是,其他使用拉丁字母的语言(主要是欧洲国家的语言)都有一定数量的附…

Unicode字符列表

本條目以列表形式展示並介紹Unicode字符。如果字母顯示模糊,可將瀏覽器字型改為「Arial Unicode MS」等支援較完整的字型,或調高瀏覽器的放大比率。 若要依照編碼查詢Unicode字符,請參見Unicode一覽表。 控制代码 共有65个字符,包含删除命令但不含空格。 拉丁字母 Unicode标准(7.0版本)将1338个字符归为拉丁字母。 基本拉丁字母 共有95个字符,其中52个属于拉丁字母,剩下的43个属于基本字符。 有…

GB 2312

GB 2312,在计算机科学领域内通常簡稱GB(或简稱GB0),是指依据中华人民共和国推荐性国家标准《信息交换用汉字编码字符集·基本集》(GB/T 2312-1980)制定的简体中文字符集。 历史 该种编码由中国国家标准总局於1980年发布,1981年5月1日实施。该种编码通行于中国大陆;新加坡等地也采用此编码。中国大陆几乎所有的中文系统和国际化的软件都支持GB 2312编码。 GB 2312标准共收录6763个汉字,其中一级汉字375…

GB 13000

GB/T 13000(《信息技术 通用编码字符集(UCS)》)是中华人民共和国国家标准之一,由全国信息技术标准化技术委员会(SAC/TC28)提出并归口,修改采用(MOD)ISO/IEC 10646,属于采标。 历史 第一版GB 13000.1-93《信息技术 通用多八位编码字符集(UCS)第一部分:体系结构与基本多文种平面》等同采用ISO/IEC 10646-1:1993,等效于Unicode 1.1。 第二版GB 13000-201…

GB 12345

GB/T 12345,GB/T 12345–90 或 GB/T 12345–1990,全称《信息交换用汉字编码字符集 辅助集》(英文:Code of Chinese ideogram set for information interchange supplementary set),也就是「第一辅助集」,简称 GB1,是辅助GB/T 2312的编码字符集,也可以看作GB/T 2312的繁体版本。该编码集共收录6,866个汉字,是中华人…

越南資訊交換標準代碼

VSCII(Vietnamese Standard Code for Information Interchange,越南信息交换标准代码),是基于越南语的一套电脑编码系统。它是一个类似ISO/IEC 8859的单字节编码系统,但由於越南语附加符号有超过一百个,所以部分越南语字母,要佔用本来属於ASCII控制字符的位置。 ||~||style="background:#ffcccc;font-size:75%;"|DEL |- !8x …

中文电码

中文电码,又称中文商用电码、中文电报码或中文电报明码,原本是於电报之中传送中文信息的方法。它是第一个把汉字化作电子讯号的编码表。 自摩尔斯电码在1835年发明后,一直只能用来传送英语或以拉丁字母拼写的文字。1873年,法国驻华人员威基杰()参照《康熙字典》的部首排列方法,挑选了常用汉字6800多个,编成了第一部汉字电码本《电报新书》。后由任上海电报局首任总办的郑观应将其改编成为《中国电报新编》。 中文电码表采用了四位阿拉伯数字作代号,从…

Shift JIS

Shift_JIS是日本电脑系统常用的编码表,能容纳全形及半形拉丁字母、平假名、片假名、符号及日语汉字。 命名为Shift_JIS的原因,是在放置全形字符时,要避开原本在0xA1至0xDF放置的半角假名字符。 微软及IBM的日语电脑系统即使用了这编码表,称为CP932。 字节结构 以下字元在Shift_JIS用一字节表示。 :ASCII字符(0x20至0x7E),但“\”由“¥”取代 :ASCII控制字符(0x00至0x1F、0x7F)…

KPS 9566

KPS 9566()是朝鮮民主主義人民共和國(北韓)使用的韓語}-的字符編碼。它是北韓的國家規格,以2011年制定的KPS 9566-2011為最新。1993年制定的KPS 9566-93和1997年以後的標準規格有許多部分不同,所以完全沒有使用。 支援KPS 9566-2000的唯一字符編碼為EUC-KP,這是類似於EUC-KR、修改KS X 1001而來的。但因完全沒有支援KPS 9566的程式,反倒多為國際標準做為參考用。 KPS…

通用字符集

通用字符集()是由ISO制定的ISO 10646(或称ISO/IEC 10646)标准所定义的标准字符集。 通用字符集又称,中国大陆译为通用多八位编码-{字符}-集,台湾译为廣用多八位-{}-元-{}-組編碼-{字元}-集。 概要 通用字符集包括了其他所有字符集。它保证了与其他字符集的双向兼容,即,如果你将任何文本字符串翻译到UCS格式,然后再翻译回原编码,你不会丢失任何信息。 UCS包含了已知文字的所有字符。除了拉丁字母、希腊字母、西…

Dingbat

Dingbats,俗称杂锦字型,本来是印刷品之中使用的装饰及图形符号。在计算机被用来制作印刷刊物后,印刷业界便制造了各种杂锦字型,最著名的是Adobe的Zapf Dingbats字型。 微软于Windows 3.1操作系统之中,提供了Wingdings杂锦符号字型。而微软于1997年之后发行的操作系统,再加入了Webdings杂锦符号字型。 Unicode的U+2700至U+27BF[http://www.unicode.org/cha…

中日韓統一表意文字

中日韓統一表意文字(),又稱統漢碼、統一漢字集(),是指在ISO 10646與統一碼標準中經過「漢字等同」處理的漢字。漢字等同()是指將中文、日文、韓文、越南文、壮文、琉球文等書寫系統共通的中日韩汉字賦予相同編碼的做法;被合併編碼的漢字,往往起源相同、本義相通、形狀大同小異。 中日韓認同表意文字 中日韓統一漢字集 中日韓統合漢字 除了「漢字等同」,Han Unification 又譯為: 漢字認同 漢字統一 漢字統合 歷史 1978年,…