常用字符集的引入及编码转换原理.doc

  1. 1、本文档共9页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
常用字符集的引入及编码转换原理

常用字符集介绍和编码转换原理 目录 TOC \o 1-3 \h \z \u HYPERLINK \l _Toc385404859 1. GB2312编码介绍 PAGEREF _Toc385404859 \h 1 HYPERLINK \l _Toc385404860 1.1 基本信息 PAGEREF _Toc385404860 \h 1 HYPERLINK \l _Toc385404861 1.2 GB标准 PAGEREF _Toc385404861 \h 1 HYPERLINK \l _Toc385404862 1.3 分区表示 PAGEREF _Toc385404862 \h 1 HYPERLINK \l _Toc385404863 1.4 字节结构 PAGEREF _Toc385404863 \h 1 HYPERLINK \l _Toc385404864 2. 通用字符集UCS PAGEREF _Toc385404864 \h 2 HYPERLINK \l _Toc385404865 2.1 定义 PAGEREF _Toc385404865 \h 2 HYPERLINK \l _Toc385404866 2.2 概要 PAGEREF _Toc385404866 \h 2 HYPERLINK \l _Toc385404867 2.3 实现级别 PAGEREF _Toc385404867 \h 2 HYPERLINK \l _Toc385404868 2.4 与UNICODE的兼容关系 PAGEREF _Toc385404868 \h 2 HYPERLINK \l _Toc385404869 3. unicode编码介绍 PAGEREF _Toc385404869 \h 3 HYPERLINK \l _Toc385404870 3.1 基本简介 PAGEREF _Toc385404870 \h 3 HYPERLINK \l _Toc385404871 3.2 编码实现 PAGEREF _Toc385404871 \h 3 HYPERLINK \l _Toc385404872 3.2.1 编码方式 PAGEREF _Toc385404872 \h 3 HYPERLINK \l _Toc385404873 3.2.2 实现方式 PAGEREF _Toc385404873 \h 4 HYPERLINK \l _Toc385404874 4. UTF-8介绍 PAGEREF _Toc385404874 \h 4 HYPERLINK \l _Toc385404875 4.1 基本介绍 PAGEREF _Toc385404875 \h 4 HYPERLINK \l _Toc385404876 4.2 编码原理 PAGEREF _Toc385404876 \h 4 HYPERLINK \l _Toc385404877 4. 转换原理 PAGEREF _Toc385404877 \h 6 1. GB2312编码介绍 1.1 基本信息 《信息交换用汉字 HYPERLINK /view/237708.htm \t _blank 编码字符集》是由我国国家标准总局1980年发布,1981年5月1日开始实施的一套国家 汉字编码字符集标准,标准号是 HYPERLINK /view/93250.htm \t _blank GB 2312—1980。它是计算机可以识别的 HYPERLINK /view/237708.htm \t _blank 编码,适用于汉字处理、汉字通信等系统之间的信息交换。基本集共收入汉字6763个和非汉字图形字符682个。整个字符集分成94个区,每区有94个位。每个区位上只有一个字符,因此可用所在的区和位来对汉字进行 HYPERLINK /view/237708.htm \t _blank 编码,称为 HYPERLINK /view/685605.htm \t _blank 区位码。 这个码是唯一的,不会有重码字。把换算成十六进制的 HYPERLINK /view/685605.htm \t _blank 区位码加上2020H,就得到 HYPERLINK /view/555716.htm \t _blank 国标码。国标码加上8080H,就得到常用的计算机机内码。 1995年又颁布了《汉字 HYPERLINK /view/237708.htm \t _blank 编码扩展规范》(GBK)。GBK与GB 2312—1980国家标准所对应的内码标准兼容,同时在字汇一级支持ISO/IEC10646—1和GB 13000

文档评论(0)

jgx3536 + 关注
实名认证
内容提供者

该用户很懒,什么也没介绍

版权声明书
用户编号:6111134150000003

1亿VIP精品文档

相关文档