社区
C#
帖子详情
字符串中包含了UTF-8和unicode 代码,怎么样转换成一种格式的代码?
cxx1997
2007-12-05 11:11:01
比如 我得到了一段文本:
asd888哈
我希望它应该是
asd888哈
请问该怎么处理?
谢谢
...全文
198
8
打赏
收藏
字符串中包含了UTF-8和unicode 代码,怎么样转换成一种格式的代码?
比如 我得到了一段文本: asd888哈 我希望它应该是 asd888哈 请问该怎么处理? 谢谢
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
8 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
boblaw
2007-12-05
打赏
举报
回复
使用System.Text.Encoding.Convert方法
就爱回力车
2007-12-05
打赏
举报
回复
截取字符串
glad_iator
2007-12-05
打赏
举报
回复
我给你调试了一个小时,这样是可以的
string str1 = "abcde哈";
string strResult= HttpUtility.HtmlDecode(str1);
结果是正确的,
你把这个串abcde哈 放到页面上直接浏览就是htmldecode解析的
zbjg
2007-12-05
打赏
举报
回复
尝试一下用System.Xml
把asd888哈 赋给XmlNode的innerXML,然后再取XmlNode的innerText。
cxx1997
2007-12-05
打赏
举报
回复
Server.HtmlDecode 就是 HttpUtility.HtmlDecode 吧
也不行啊
cxx1997
2007-12-05
打赏
举报
回复
谢谢上面的,HttpUtility.HtmlDecode 试过不行
再试 Server.HtmlDecode("asd888哈");
jinjazz
2007-12-05
打赏
举报
回复
Server.HtmlDecode("asd888哈");
Ivony
2007-12-05
打赏
举报
回复
HttpUtility.HtmlDecode
字符串
的
Unicode
编码 和
UTF-8
编码
在实际编程和数据处理
中
,**`
字符串
的
Unicode
编码提供了统一的字符表示方式,确保不同语言和字符集的数据能够被正确识别和处理`**。 而
UTF-8
编码因其高效性、兼容性和跨平台性,成为互联网上最广泛使用的
Unicode
编码
格式
。 **`许多现代编程语言、操作系统、数据库系统和文件
格式
默认支持或推荐使用
UTF-8
编码来存储和交换文本数据`**。
字符编码:
Unicode
和
UTF-8
之间的关系
Unicode
和
UTF-8
之间的关系 1. ASCII码 我们知道,在计算机内部,所有的信息最终都表示为一个二进制的
字符串
。每一个二进制位(bit)有0和1两种状态,因此八个二进制位就可以组合出256种状态,这被称为一个字节(byte)。也就是说,一个字节一共可以用来表示256种不同的状态,每一个状态对应一个符号,就是256个符号,从0000000到11111111。 上个世纪60年代,美国...
Unicode
标准-编码
格式
-
UTF-8
-16-32
该文章描述了
Unicode
标准的字符编码
格式
,包括
UTF-8
、UTF-16、UTF-32,它们的各自的特征与区别。计算机系统
中
的实际实现表示特定大小的特定
代码
单位的整数,通常为8位(=字节)、16位或32位。在
Unicode
字符编码模型
中
,精确定义的编码形式指定如何将
Unicode
字符的每个整数(码点)表示为一个或多个
代码
单元的序列。
Unicode
标准为
Unicode
字符提供了三种不同的编码形式,分别使用8位、16位和32位单位。它们分别命名为
UTF-8
、UTF-16和UTF-32。
unicode
和
utf-8
互转
世界上存在着多种编码方式, 同一个二进制数字可以被解释成不同的符号.因此, 要想打开一个文本文件, 就必须知道它的编码方式, 否则用错误的编码方式解读, 就会出现乱码.为什么电子邮件常常出现乱码?就是因为发信人和收信人使用的编码方式不一样.可以想象, 如果有
一种
编码, 将世界上所有的符号都纳入其
中
. 每一个符号都给予一个独一无二的编码, 那么乱码问题就会消失. 这就是
Unicode
, 就像它的名字都表示的, 这是
一种
所有符号的编码.
UTF-8
和
Unicode
转换
要说
utf-8
,就要先大概说一下它的大哥----“
unicode
"。基本的ASCII定义了128个字符,从0x00-0x7f,即使后面扩展的ASCII也只能表示256个字符,即0x00-0xff。这些字符表示英文是足够了,但是对于其他语言就显得捉襟见肘了,例如咱们的汉字。于是我们就用2个字符来表示汉字了。但后来2个字符也不够了,就慢慢拓展到3个字符。美国也意思到需要
一种
表示全世界字符的标准,于是,
unicode
就这么诞生了。
unicode
规定了全球所有字符统一在一个集合,集合里面的元素互不相同。
C#
111,129
社区成员
642,532
社区内容
发帖
与我相关
我的任务
C#
.NET技术 C#
复制链接
扫一扫
分享
社区描述
.NET技术 C#
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
让您成为最强悍的C#开发者
试试用AI创作助手写篇文章吧
+ 用AI写文章