ids/32/807.txt

[3] 
[DFN[CJK統合漢字]]は、
[[Unicode]]
の[[漢字集合]]です。

* Unihan データベース

[10] 
[[UCD]] の [DFN[Unihan]] データベースには
[[Unicode]]
[[CJK統合漢字]]の情報が入っています。

[29] [CITE@en-us[UAX #38: Unicode Han Database (Unihan)]], [TIME[2022-09-12T17:16:37.000Z]], [TIME[2022-10-02T02:10:17.537Z]] <https://www.unicode.org/reports/tr38/>


[2] [CITE@en-us[UAX #44: Unicode Character Database]], [TIME[2020-03-06T22:23:11.000Z]], [TIME[2020-10-20T12:12:27.278Z]] <http://www.unicode.org/reports/tr44/#Unihan>


[FIG(short list)[ [8] [[Unihan]]
- [CODE[kRSAdobe_Japan1_6]]
- [CODE[kKoreanName]]
]FIG]

** Unihan の歴史

[11] [CITE[The Unicode Han Character Cross-Reference]], 
[TIME[2009-12-14T22:08:35.000Z]], [TIME[2022-10-02T01:50:07.995Z]] <https://www.unicode.org/Public/1.1-Update/CJKXREF.TXT>

[12] [[Unicode 1.1]] 時代の [[Unihan]] に相当するファイル (今とファイル形式が違う)。
[TIME[1994-03-14]]

- [13] [[GB]]
-- 0 : [[GB 2312-80]]
-- 1 : [[GB 12345-90]]
-- 3 : [[GB 7589-87]]
-- 5 : [[GB 7590-87]]
-- 7 : [[General Purpose Han Characters for Modern Chinese]]
-- 8 : [[GB 8565-89]]
- [14] [[Big 5]]
- [15] [[CNS 11643-1986]]
-- 1 : Primary
-- 2 : Less frequent characters
-- E : User characters
- [16] [[JIS]]
-- 0 : [[JIS X 0208-1990]]
-- 1 : [[JIS X 0212-1990]]
-- I : IBM extensions
- [17] KSC
-- 0 : [[KS C 5601-1987]]
-- 1 : [[KS C 5657-1991]]
-- 2 : IBM extensions
- [[ANSI Z39.64-1989]] ([[EACC]])
- [[CCCII]], level 1
- [[Xerox]]

[18] これより古い[TIME[1994-10-14]]版の前まで Fujitsu corporate character set
があったらしい。低品質のため削除されたとのこと。 [SRC[>>11]]

-*-*-

[19] 
[CITE[Unihan database]], 
[TIME[2001-02-27T08:42:03.000Z]], [TIME[2022-10-02T01:56:34.077Z]] <https://www.unicode.org/Public/2.0-Update/Unihan-1.txt>

[20] [[Unicode 2.0]]。 [[Unihan]] という名前のファイルの始まり?

kBigFive, kCNS1986, kGB0, kGB1, kGB3, kGB5, kGB7, kGB8, kJis0, kJis1, 
kKSC0, kKSC1, kPseudoGB1,
kCCCII, kCNS1992,
kEACC, kIBMJapan

[21] [CITE[Unihan database]], 
[TIME[2001-02-27T08:57:50.000Z]], [TIME[2022-10-02T01:59:50.804Z]] <https://www.unicode.org/Public/2.1-Update/Unihan-2.txt>

[22] [CITE[Unihan database]], 
[TIME[2001-02-27T09:25:50.000Z]], [TIME[2022-10-02T02:00:32.730Z]] <https://www.unicode.org/Public/3.0-Update/Unihan-3.txt>

kBigFive, kCNS1986, kGB0, kGB1, kGB3, kGB5, kGB7, kGB8, kJis0, kJis1, 
kKSC0, kKSC1, kPseudoGB1,
kCCCII, kCNS1992,
kEACC, kIBMJapan

- [23] [CODE[kIRG_GSource]]
-- G0 : [[GB 2312-80]]
-- G1 : [[GB 12345-90]] with 58 Hong Kong and 92 Korean "Idu" characters
-- G3 : [[GB 7589-87]] unsimplified forms
-- G5 : [[GB 7590-87]] unsimplified forms
-- G7 : [[General Purpose Hanzi List for Modern Chinese Language, and General List of Simplified Hanzi]]
-- GS : [[Singapore characters]]
-- G8 : [[GB 8685-88]]
-- GE : [[GB 16500-95]]
- [24] [CODE[kIRG_JSource]]
-- J0 : [[JIS X 0208-1990]]
-- J1 : [[JIS X 0212-1990]]
-- JA : [[Unified Japanese IT Vendors Contemporary Ideographs, 1993]]
- [25] [CODE[kIRG_KSource]]
-- K0 : [[KS C 5601-1987]]
-- K1 : [[KS C 5657-1991]]
-- K2 : [[PKS C 5700-1 1994]]
-- K3 : [[PKS C 5700-2 1994]]
- [26] [CODE[kIRG_TSource]]
-- T1 : [[CNS 11643-1992]], plane 1
-- T2 : [[CNS 11643-1992]], plane 2
-- T3 : [[CNS 11643-1992]], plane 3 (with some additional characters)
-- T4 : [[CNS 11643-1992]], plane 4
-- T5 : [[CNS 11643-1992]], plane 5
-- T6 : [[CNS 11643-1992]], plane 6
-- T7 : [[CNS 11643-1992]], plane 7
-- TF : [[CNS 11643-1992]], plane 15
- [27] [CODE[kIRG_VSource]]
-- V1 : [[TCVN 5773:1993]]
-- V2 : [[TCVN 6056:1995]]

[28] [CITE[[[UTR #38]]: A User’s Guide to the Unihan Database]], [TIME[2006-05-19T17:06:33.000Z]], [TIME[2022-10-02T02:07:44.980Z]] <https://www.unicode.org/reports/tr38/tr38-3.html>

[DFN[UTR #38]] の最古の公開案。

* レンダリング

[4] [[中華フォント問題]]

* 歴史

[FIG(quote)[
[FIGCAPTION[
[1] [CITE[コンピューターで全漢字使用可に 6万字コード化 | [[NHKニュース]]]]
([[日本放送協会]]著, [TIME[2017-12-24 19:27:13 +09:00]])
<https://www3.nhk.or.jp/news/html/20171224/k10011270111000.html?utm_int=all_side_ranking-access_004>
]FIGCAPTION]

> 日本語の漢字は、戸籍などに使われているものも含めると6万字あるのに対し、コンピューターは、実は1万字しか扱うことができません。これに対し、このほど15年越しの作業の末、6万字すべてが統一の規格にまとめられて、コンピューターがすべての漢字を扱えるようになり、ビッグデータの活用をはじめさまざまな効果が期待されています。

]FIG]





[5] [CITE[NS39012siba]], [TIME[2021-01-09T06:13:03.000Z]], [TIME[2000-09-03T22:05:47.352Z]] <http://web.archive.org/web/20000903220115/http://www.itscj.ipsj.or.jp/jp/ns39012.html>

[6] [TIME[2020-02-28T17:39:56.000Z]], [TIME[2021-01-11T03:48:26.090Z]] <https://standards.iso.org/iso-iec/10646/ed-6/en/CJKSrc.txt>

[7] [CITE@ja[情報学広場:情報処理学会電子図書館]], [[<情報処理学会>]], [TIME[2022-07-11T06:45:31.000Z]] <https://ipsj.ixsq.nii.ac.jp/ej/?action=pages_view_main&active_action=repository_view_main_item_detail&item_id=62547&item_no=1&page_id=13&block_id=8>




[9] [CITE@ja[[[漢字]]の国際提案の歴史を図にしてみた - 帰ってきた💫Unicode刑事〔デカ〕リターンズ]], [TIME[2022-09-30T01:28:34.000Z]] <https://moji-memo.hatenablog.jp/entry/20130808/1375949975>