社区
C语言
帖子详情
汉字转换为unicode的具体算法与结构?
hdp4820
2004-12-21 09:11:06
如,我有一汉字"一".
它的unicode 为 4E00.
我想把它转换为字符串类型的--->"\x4e\x00".可以怎么样实现呢?请教...
...全文
274
5
打赏
收藏
汉字转换为unicode的具体算法与结构?
如,我有一汉字"一". 它的unicode 为 4E00. 我想把它转换为字符串类型的--->"\x4e\x00".可以怎么样实现呢?请教...
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
5 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
hdp4820
2004-12-23
打赏
举报
回复
谢谢了,可以哦,收藏!!!结帐!!~~
hdp4820
2004-12-23
打赏
举报
回复
偶试试看,谢谢了!!~~
Michael_555
2004-12-23
打赏
举报
回复
在Dev-C++上没问题。
dongyuanzhang
2004-12-22
打赏
举报
回复
上面的程序能在VC上编过吗?帮顶!
Michael_555
2004-12-22
打赏
举报
回复
引自:
http://blog.csdn.net/zky/archive/2004/07/18/44345.aspx
#include <stdio.h>
#include <locale.h>
#include <wchar.h>
int main(void)
{
char *temp;
char sim[32]="狗";
char tra[32];
wchar_t uni[32];
temp=setlocale(LC_ALL,".936");
puts(temp);
printf("%s\t%2x %2x\r\n",sim,(unsigned char)(sim[0]),(unsigned char)(sim[1]));
if(-1==mbstowcs(uni,sim,32))
{
perror("mbstowcs");
}
temp=setlocale(LC_ALL,".950");
if(-1==wcstombs(tra,uni,32))
{
perror("wcstombs");
}
printf("%s\t%2x %2x\r\n",tra,(unsigned char)(tra[0]),(unsigned char)(tra[1]));
system("PAUSE");
return 0;
}
探索基于
Unicode
的
汉字
转拼音创新
算法
Unicode
是一种旨在为世界上所有的字符提供唯一的数字表示的编码标准。它是现代信息技术中最为广泛使用的字符集,能够解决不同国家和地区字符编码标准不一致的问题。
Unicode
为每一个字符分配了一个唯一的码点,这些码点从0x0000到0x10FFFF,涵盖了几乎所有的书面语言。
基于
Unicode
的
汉字
拼音排序实现与文本处理实战
Unicode
官方文档中定义的 CJK 统一
汉字
区块起始于 U+4E00,终止于 U+9FFF,但并非所有码位都被赋予实际字符意义。国际标准化组织(ISO/IEC 10646)与
Unicode
联盟共同维护一份名为的公开数据文件,记录每个码位的属性信息。通过对该文件的解析,可以精确确定哪些码位对应有效
汉字
。例如,以下是中的部分条目:4E00;Lo;0;L;;;;N;;;;;4E01;Lo;0;L;;;;N;;;;;9FCB;Lo;0;L;;;;N;;;;;9FCC;Cc;0;
C语言实现中文BGK、
UNICODE
、UTF8之间的编码
转换
C语言实现中文编码
转换
一、GBK、
UNICODE
、UTF8之间编码的关系二、
UNICODE
、UTF8之间转化实现三、
UNICODE
、GBK之间的转化四、编码对照表五、完整代码 一、GBK、
UNICODE
、UTF8之间编码的关系 GBK:GBK全名为
汉字
内码扩展规范,英文名Chinese Internal Code Specification。GBK 采用双字节表示,总体编码范围为8140-FEFE,首字节在81-FE 之间,尾字节在40-FE 之间,剔除 xx7F一条线。总计23940 个码位,共收入218
汉字
编码
转换
详解与实践
GB2312是中国国家标准简体中文字符集,于1980年发布,全称为《信息交换用
汉字
编码字符集 基本集》。它使用了双字节的编码方式,支持6763个常用
汉字
,分为一级
汉字
和二级
汉字
两部分。一级
汉字
覆盖了国家语言文字工作委员会公布的最常用的6763个
汉字
,而二级
汉字
则是些不常用字,主要涉及少数民族地名等特殊字符。GB2312的编码范围从0x2121至0x777E。编码由区码和位码组成,区码和位码各自独立编码。区码编码从01至94,代表不同的区,共94个区;位码也编码从01至94,代表该区内每个字的位置。
实现
汉字
的凯撒密码(内容包括:去掉字符串中的转义字符、
汉字
的
unicode
转换
)
实验内容: 选择合适的秘钥,利用上述三个
算法
:熟悉恺撒密码、双重置换密码、一次一密密码
算法
。加密如下明文: 大风起兮云飞扬, 威加海内兮归故乡, 安得猛士兮守四方。 《大风歌》--刘邦 3.1.1凯撒密码 凯撒密码作为一种最为古老的对称加密体制,在古罗马的时候都已经很流行,他的基本思想是:通过把字母移动一定的位数来实现加密和解密。明文中的所有字母都在字母表上向后(或向前)按照一
C语言
70,038
社区成员
243,245
社区内容
发帖
与我相关
我的任务
C语言
C语言相关问题讨论
复制链接
扫一扫
分享
社区描述
C语言相关问题讨论
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章