http://blog.oasisfeng.com/2006/10/19/full-cjk-unicode-range/
因为FontRouter新版本开发的需要,在网上搜索了一下汉字的Unicode范围,普遍给出了“U+4E00..U+9FA5”。但事实上这个范围是不完整的,甚至连基本的全角(中文)标点也未包含在内。为此,我特地查询了Unicode官方的Code Charts数据库,并根据最新的Unicode 5.0版整理如下:
注:在绝大多数应用场合中,我们可以仅用(1)、(2)、(3)、(4)、(5)的集合作为CJK判断的依据。
1)标准CJK文字
Code point range | Block name | Release |
---|---|---|
U+3400..U+4DB5 | CJK Unified Ideographs Extension A | 3.0 |
U+4E00..U+9FA5 | CJK Unified Ideographs | 1.1 |
U+9FA6..U+9FBB | CJK Unified Ideographs | 4.1 |
U+F900..U+FA2D | CJK Compatibility Ideographs | 1.1 |
U+FA30..U+FA6A | CJK Compatibility Ideographs | 3.2 |
U+FA70..U+FAD9 | CJK Compatibility Ideographs | 4.1 |
U+20000..U+2A6D6 | CJK Unified Ideographs Extension B | 3.1 |
U+2F800..U+2FA1D | CJK Compatibility Supplement | 3.1 |
2)全角ASCII、全角中英文标点、半宽片假名、半宽平假名、半宽韩文字母:FF00-FFEF
3)CJK部首补充:2E80-2EFF
4)CJK标点符号:3000-303F
5)CJK笔划:31C0-31EF
6)康熙部首:2F00-2FDF
7)汉字结构描述字符:2FF0-2FFF
8)注音符号:3100-312F
9)注音符号(闽南语、客家语扩展):31A0-31BF
10)日文平假名:3040-309F
11)日文片假名:30A0-30FF
12)日文片假名拼音扩展:31F0-31FF
13)韩文拼音:AC00-D7AF
14)韩文字母:1100-11FF
15)韩文兼容字母:3130-318F
16)太玄经符号:1D300-1D35F
17)易经六十四卦象:4DC0-4DFF
18)彝文音节:A000-A48F
19)彝文部首:A490-A4CF
20)盲文符号:2800-28FF
21)CJK字母及月份:3200-32FF
22)CJK特殊符号(日期合并):3300-33FF
23)装饰符号(非CJK专用):2700-27BF
24)杂项符号(非CJK专用):2600-26FF
25)中文竖排标点:FE10-FE1F
26)CJK兼容符号(竖排变体、下划线、顿号):FE30-FE4F
以上翻译自Unicode官方网站,部分译法可能不够准确,还望大家予以指正!如有疏漏、错误之处也请一并指出,多谢!