转换多字节与UTF-8、Unicode之间的转换

unicode转换  时间:2021-04-12  阅读:()

多字节与UTF-8、 Unicode之间的转换

VC中Ansi、 Unicode、 UTF8字符串之间的转换和写入文本

An si字符串我们最熟悉英文占一个字节汉字2个字节 以一个\0结尾常用于txt文本文件

Unicode字符串每个字符(汉字、英文字母)都占2个字节 以2个连续的\0结尾 NT操作系统内核用的是这种字符串常被定义为typedef unsigned short wchar_t;所以我们有时常会见到什么char*无法转换为unsigned short*之类的错误其实就是unicode

UTF8是Unicode一种压缩形式英文A在unicode中表示为0x0041 老外觉得这种存储方式太浪费因为浪费了50%的空间于是就把英文压缩成1个字节成了u tf8编码但是汉字在u tf8中占3个字节显然用做中文不如a ns i合算这就是中国的网页用作a n s i编码而老外的网页常用utf8的原因。

UTF8在还游戏里运用的很广泛 比如WOW的lua脚本等

下面来说一下转换主要用代码来说明吧

写文件我用了CFi le类其实用FILE*之类的也是一样写文件和字符串什么类别没有关系硬件只关心数据和长度

Ansi转Unicode

介绍2种方法void CConvertDlg: :OnBnCl ickedButtonAnsiToUnicode()

{

//ansi to unicodechar*szAnsi="abcd1234你我他";

//预转换得到所需空间的大小int wcsLe n =: :MultiByteToWideChar(CP_ACP, NULL, szAnsi , strlen(szAnsi), NULL,

0);

//分配空间要给'\0'留个空间 MultiByteToWideChar不会给'\0'空间wchar_t*wszString=newwchar_t[wcsLen+1];

//转换

: :MultiByteToWideChar(CP_ACP,NULL,szAnsi ,strlen(szAnsi),wszSt ring,wcsLen);

//最后加上'\0'wszString[wcsLen]='\0';

//unicode版的MessageBoxAPI

: :MessageBoxW(GetSafeHwnd(),wszString,wszString,MB_OK);

//接下来写入文本

//写文本文件头2个字节0xfeff低位0xff写在前

CFi lecFi le;cFi le.Open(_T("1 .txt"),CFi le: :modeWrite|CFi le: :modeCreate);

//文件开头cFi le.SeekToBegin();cFi le.Write("\xff\xfe",2);

//写入内容cFi le.Write(wszString,wcsLen*sizeof(wchar_t));cFi le.Flush();cFi le.Close();delete[]wszString;wszSt ring=NULL;

//方法2

//设置当前地域信息不设置的话使用这种方法 中文不会正确显示

//需要#include<locale.h>setlocale(LC_CTYPE, "chs");wchar_t wcsStr[100];

//注意下面是大写S在unicode中代表后面是ansi字符串

//swprintf是sprintf的unicode版本

//格式的前面要加大写L代表是unicodeswprintf(wcsStr, L"%S",szAns i);

: :MessageBoxW(GetSafeHwnd(),wcsStr,wcsStr,MB_OK);

}

Unicode转Ansi

也是2种方法void CConvertDlg: :OnBnCl ickedButtonUnicodeToAnsi()

{

//unicode to ansiwchar_t*wszString=L"abcd1234你我他";

//预转换得到所需空间的大小这次用的函数和上面名字相反int ansiLen =: :WideCharToMultiByte(CP_ACP, NULL,wszString,wcslen(wszString),NULL,0,NULL,NULL);

//同上分配空间要给'\0'留个空间char*szAnsi=newchar[ansiLen+1];

//转换

//unicode版对应的strlen是wcslen

: :WideCharToMultiByte(CP_ACP, NULL, wszString, wcslen(wszSt ring), szAnsi ,ansiLen,NULL,NULL);

//最后加上'\0'szAnsi[ansiLen]='\0' ;

//Ansi版的MessageBoxAPI

: :MessageBoxA(GetSafeHwnd(),szAnsi ,szAnsi ,MB_OK);

//接下来写入文本

//写文本文件 ANSI文件没有BOM

CFi lecFi le;cFi le.Open(_T("1.txt"),CFi le: :modeWrite|CFi le: :modeCreate);

//文件开头cFi le.SeekToBegin();

//写入内容cFi le.Write(szAnsi ,ansiLen*sizeof(char));cFi le.Flush();cFi le.Close();delete[]szAnsi ;szAnsi=NULL;

//方法2

//和上面一样有另一种方法setlocale(LC_CTYPE, "chs");char szStr[100];

//注意下面是大写在ansi中代表后面是unicode字符串

//sprintfsprintf(szStr, "%S",wszSt ring);

: :MessageBoxA(GetSafeHwnd(),szStr,szStr,MB_OK);

}

Unicode转UTF8void CConvertDlg: :OnBnCl ickedButtonUnicodeToU8()

{

//unicode to UTF8wchar_t*wszString=L"abcd1234你我他";

//预转换得到所需空间的大小这次用的函数和上面名字相反int u 8Len =: :WideCharToMultiByte(CP_UTF8, NULL,wszSt ring,wcslen(wszString),NULL,0,NULL,NULL);

//同上分配空间要给'\0'留个空间

//UTF8虽然是Unicode的压缩形式但也是多字节字符串所以可以以char的形式保存char*szU8=new char[u8Len+1];

//转换

//unicode版对应的strlen是wcslen

: :WideCharToMultiByte(CP_UTF8,NULL,wszSt ring,wcslen(wszString), szU8, u8Len,NULL,NULL);

//最后加上'\0'szU8[u8Len]='\0' ;

//MessageBox不支持UTF8,所以只能写文件

//接下来写入文本

//写文本文件 UTF8的BOM是0xbfbbef

CFi lecFi le;cFi le.Open(_T("1 .txt"),CFi le: :modeWrite|CFi le: :modeCreate);

//文件开头cFi le.SeekToBegin();

//写BOM 同样低位写在前cFi le.Write("\xef\xbb\xbf",3);

//写入内容cFi le.Write(szU8, u8Len*sizeof(char));cFi le.Flush();cFi le.Close();delete[]szU8;szU8=NULL;

}

UTF8转UNICO DEvoid CConvertDlg: :OnBnCl ickedButtonU8ToUnicode()

{

//UTF8 to Unicode

//由于中文直接复制过来会成乱码编译器有时会报错故采用16进制形式char*szU8="abcd 1234\xe4\xbd\xa0\xe6\x88\x91\xe4\xbb\x96\x00";

//预转换得到所需空间的大小int wcsLen=: :MultiByteToWideChar(CP_UTF8,NULL,szU8,strlen(szU8),NULL,0);//分配空间要给'\0'留个空间 MultiByteToWideChar不会给'\0'空间wchar_t*wszString=newwchar_t[wcsLen+1];

//转换

: :MultiByteToWideChar(CP_UTF8,NULL,szU8,strlen(szU8),wszString,wcsLen);//最后加上'\0'wszString[wcsLen]='\0';

//unicode版的MessageBoxAPI

: :MessageBoxW(GetSafeHwnd(),wszString,wszString,MB_OK);

//写文本同ansi to unicode

}

An si转换utf8和utf8转换An si就是上面2个的结合把u n icod e作为中间量进行2次转换即可

#include<iostream>

#include<string>

#include<Windows.h>using namespace std;

void unicodeToUTF8(constwstring&src,string&result)

int n=WideCharToMultiByte(CP_UTF8,0,src.c_str(), -1 ,0,0,0,0);result.resize(n);

: :WideCharToMultiByte(CP_UTF8,0,src.c_str(), -1 , (char*)result.c_str(), result. length(),0,0);

void unicodeToGB2312(constwstring&wstr ,string&result)

int n=WideCharToMultiByte(CP_ACP, 0,wstr.c_str(), -1 ,0,0,0,0);result.resize(n);

: :WideCharToMultiByte(CP_ACP, 0,wstr.c_str(), -1 , (char*)result.c_str(), n,0,0);

void utf8ToUnicode(const string&src,wstring&result)

int n=MultiByteToWideChar(CP_UTF8,0,src.c_str(), -1 ,NULL,0);result.resize(n);

: :MultiByteToWideChar(CP_UTF8,0,src.c_str(), -1 , (LPWSTR)result.c_str(), result. len g th());

void gb2312ToUnicode(const string&src,wstring&result)

int n=MultiByteToWideChar(CP_ACP, 0,src.c_str(), -1 ,NULL,0);result.resize(n);

: :MultiByteToWideChar(CP_ACP, 0,src.c_str(), -1 , (LPWSTR)result.c_str(), result. length());

蓝速数据(58/年)秒杀服务器独立1核2G 1M

蓝速数据金秋上云季2G58/年怎么样?蓝速数据物理机拼团0元购劲爆?蓝速数据服务器秒杀爆产品好不好?蓝速数据是广州五联科技信息有限公司旗下品牌云计算平台、采用国内首选Zkeys公有云建设多种开通方式、具有IDC、ISP从业资格证IDC运营商新老用户值得信赖的商家。我司主要从事内地的枣庄、宿迁、深圳、绍兴、成都(市、县)。待开放地区:北京、广州、十堰、西安、镇江(市、县)。等地区数据中心业务,均KV...

香港服务器租用多少钱一个月?影响香港服务器租用价格因素

香港服务器租用多少钱一个月?香港服务器受到很多朋友的青睐,其中免备案成为其特色之一。很多用户想了解香港云服务器价格多少钱,也有同行询问香港服务器的租赁价格,一些实际用户想要了解香港服务器的市场。虽然价格是关注的焦点,但价格并不是香港服务器的全部选择。今天小编介绍了一些影响香港服务器租赁价格的因素,以及在香港租一个月的服务器要花多少钱。影响香港服务器租赁价格的因素:1.香港机房选择香港机房相当于选择...

阿里云金秋上云季,云服务器秒杀2C2G5M年付60元起

阿里云(aliyun)在这个月又推出了一个金秋上云季活动,到9月30日前,每天两场秒杀活动,包括轻量应用服务器、云服务器、云数据库、短信包、存储包、CDN流量包等等产品,其中Aliyun轻量云服务器最低60元/年起,还可以99元续费3次!活动针对新用户和没有购买过他们的产品的老用户均可参与,每人限购1件。关于阿里云不用多说了,国内首屈一指的云服务器商家,无论建站还是学习都是相当靠谱的。活动地址:h...

unicode转换为你推荐
wordpress模板我在wordpress模板下载了一套模板,做了www.xuanqianbao.com这个站,模板的原站是www.rrzdm.com.一样的模板,我在文件在插入图片,却不能在首页显示,他的网站却可以.直空间文章qq空间日志文章,要求经典access数据库修复Access数据库恢复,有些表被损坏或有些表的部分记录被损坏,求解啊iproute网关怎么设置?csamy免费代理加盟免费加盟代销怎么回事,能具体介绍下么网站后台密码破解如何破解网站后台密码团购程序团购的具体流程是什么?仿佛很简单便捷的样子?建站无忧前程无忧为何上市?邮件管理系统哪个邮件管理软件好?
国外vps主机 vps优惠码cnyvps 免费顶级域名 l5639 2014年感恩节 la域名 免备案cdn 谷歌香港 域名优惠码 lamp配置 警告本网站 web服务器架设软件 申请空间 国外免费全能空间 91vps tna官网 umax120 台湾谷歌 yundun 免费的asp空间 更多