社区
其它技术问题
帖子详情
GBK和unicode编码方式各是什么??具体一点,就这些分了,都给了
kent5566
2005-03-03 11:52:50
rt
...全文
581
10
打赏
收藏
GBK和unicode编码方式各是什么??具体一点,就这些分了,都给了
rt
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
10 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
Kelvin_Chen
2005-03-10
打赏
举报
回复
顶
kof_sdu
2005-03-04
打赏
举报
回复
如果是在作Web的时候 那么应当注意一下 各个页面的Content-page下的charset应该统一,否则容易出现乱码 ,特别是从数据库读取数据后在页面显示的时候。可以统一用GBK,也可以用UTF-8
另外 Unicode对应UTF-8
dongpy
2005-03-04
打赏
举报
回复
看看这个:http://www-900.ibm.com/developerworks/cn/linux/i18n/unicode/linuni/index.shtml
hxblvc
2005-03-04
打赏
举报
回复
UP
dongpy
2005-03-04
打赏
举报
回复
网上这方面资料很多的,找些看看,比这里得到的详细。
包含多国语言的软件都用unicode。
kaniggia
2005-03-04
打赏
举报
回复
由于每种语言都制定了自己的字符集,导致最后存在的各种字符集实在太多,在国际交流中要经常转换字符集非常不便。因此,产生了Unicode字符集,它固定使用16 bits(两个字节)来表示一个字符,共可以表示65536个字符
标准的Unicode称为UTF-16(UTF:UCS Transformation Format )。后来为了双字节的Unicode能够在现存的处理单字节的系统上正确传输,出现了UTF-8,使用类似MBCS的方式对Unicode进行编码。(Unicode字符集有多种编码形式)
kaniggia
2005-03-04
打赏
举报
回复
查找GBK字库的资料得知:GBK码表,共126个区,每区190个汉字。而且其第一字节的值在 81~FE 之间,第二字节在 40~FE,除去xx7F一线。也就是说,区码在81~FE之间,对每一区而言,位码在40~FE之间。
则汉字偏移量的计算如下:
假定:
区码:kQu
位码:kWei
每个汉字的字节数:n
则posit = (((U16)(kQu-0x81))*190 +(U16)(kWei-((kWei>0x7f)?0x41:0x40)))*n;
kaniggia
2005-03-04
打赏
举报
回复
GBK
该编码标准为双字节编码,GB2312-80的扩充,在码位上和GB2312-80兼容,共收录汉字21003个、符号883个,并提供1894个造字码位,简、繁体字融于一库。其第一字节的值在 16 进制的 81~FE 之间,第二字节在 40~FE,除去xx7F一线。共23940个码位。
agamem
2005-03-04
打赏
举报
回复
GBK的介绍:
http://www.haiyan.com/steelk/navigator/ref/gbk/gbindex.htm
UNICODE:
不用找GBK与Unicode的对应规律,他们是没有规律的,只是简单的根据码表对应!
little_paradise
2005-03-04
打赏
举报
回复
你可以google一下啊,网上很多资料d
【
GBK
、UTF-8、ISO8859-1、
Unicode
】四种
编码方式
的总结:
概述 在编程中字符编码绝对是个值得重视的问题,当读取一个文件或是得到一个输入流,你需要
分
析数据的
编码方式
、形态,以便能正确的处理、显示数据所表示的字符。 1) 在简体中文操作系统中,从键盘输入的原始字符采用的是
GBK
编码方式
,对应到其他操作系统,采用的应是系统默认的本地字符集。而在程序设计语言中,字符和字符串则通常是使用
Unicode
编码方式
。 2) 不仅是输入的原始字符采用
GBK
编码...
关于
Unicode
和
Gbk
的那些事~~
之前在工作上遇到了点问题,后来通过查阅才基本解决,但是还是没有找到根本的解决办法,就发到博客记录以后,说不定以后技术更牛了就能够解决了。 问题是关于
Unicode
和
Gbk
方面的,我们都知道现在Windows下的字体文件一般用的都是
Unicode
编码,常用的汉字编码一般是GB2312的标准,但是这个标准里面字只有6763个汉字,
Gbk
扩展到可以有2万多个汉字,
Unicode
中从0X4E0
ASCII码、ISO8859-1、
Unicode
、
GBK
和UTF-8 的区别
为什么需要编码?
彻底搞明白 GB2312、
GBK
和 GB18030
彻底搞明白 GB2312、
GBK
和 GB18030 程序员十三 公众号:Linux开发那些事儿 ,
分
享 Linux 干货 1 人赞同了该文章 日常工作的过程中,关于字符编码的问题经常让人头疼不已,这篇文章就来捋一捋关于 GB2312、
GBK
、GB18030 相关的知识 以及它们和
Unicode
的关系 简介 GB2312 1980 年,中国发布了第一个汉字编码标准,也即 GB2312 ,全称 《信息交换用汉字编码字符集·基本集》,通常简称 GB (“国标”汉语拼音首字母), 共收录了 676
GB2312,
GBK
,
Unicode
为了使我们的计算机能够显示文字或字符,首先要内存中可以存储文字或字符。要存储一个文字或者字符有多种方式: (1)我们可以把文字变为图片(点阵),直接保存起来,当需要显示的时候,把图片绘制出来。 (2)把文字或者字符变成矢量数据存储起来,需要显示的时候,再根据矢量规则绘制出来即可。 (3)把文字或者或者先编号,然后要问题显示样式
其它技术问题
3,881
社区成员
9,044
社区内容
发帖
与我相关
我的任务
其它技术问题
C/C++ 其它技术问题
复制链接
扫一扫
分享
社区描述
C/C++ 其它技术问题
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章