linux下GBK->UTF-8文件编码批量转换脚本
find default -type d -exec mkdir -p utf/{} ;
find default -type f -exec iconv -f GBK -t UTF-8 {} -o utf/{} ;
这两行命令将default目录下的文件由GBK编码转换为UTF-8编码,目录结构不变,转码后的文件保存在utf/default目录下。
linux C gbk utf 8编码转换
用linux C 下的函数调用创建中文目录、文件等,字符串的编码格式要求是utf-8格式的。
比如想要使用 int mkdir(const char *pathname, mode_t mode); 创建一个中文的目录。那么pathname的编码格式要求是utf-8的,而不能是gb3212/gbk的,否则就是乱码。
那么如果linux C下如何进行gbk<---->utf-8编码转换的编码装换的?使用的是iconv函数簇。
#include
int code_convert(char *from_charset,char *to_charset,char *inbuf,int inlen,char *outbuf,int outlen)
{
iconv_t cd;
int rc;
char **pin = &inbuf;
char **pout = &outbuf;
cd = iconv_open(to_charset,from_charset);
if (cd==0)
return -1;
memset(outbuf,0,outlen);
if (iconv(cd,pin,&inlen,pout,&outlen) == -1)
return -1;
iconv_close(cd);
return 0;
}
int u2g(char *inbuf,int inlen,char *outbuf,int outlen)
{
return code_convert("utf-8","gb2312",inbuf,inlen,outbuf,outlen);
}
int g2u(char *inbuf,size_t inlen,char *outbuf,size_t outlen)
{
return code_convert("gb2312","utf-8",inbuf,inlen,outbuf,outlen);
}
其中
iconv函数族的头文件是iconv.h,使用前需包含之。
#include
iconv函数族有三个函数,原型如下:
(1) iconv_t iconv_open(const char *tocode, const char *fromcode);
此函数说明将要进行哪两种编码的转换,tocode是目标编码,fromcode是原编码,该函数返回一个转换句柄,供以下两个函数使用。
(2) size_t iconv(iconv_t cd,char **inbuf,size_t *inbytesleft,char **outbuf,size_t *outbytesleft);
此函数从inbuf中读取字符,转换后输出到outbuf中,inbytesleft用以记录还未转换的字符数,outbytesleft用以记录输出缓冲的剩余空间。
(3) int iconv_close(iconv_t cd);
此函数用于关闭转换句柄,释放资源。 ......
C编程:使用iconv把GB2312编码转换为UTF-8编码
C编程:使用iconv把GB2312编码转换为UTF-8编码
#include <stdio.h>
#include <string.h>
#include <iconv.h>
int gb2312_to_utf8(char *in, char *out, size_t size);
int main(int argc, char *argv[]) {
char *wc = "我";
char *str = "Beijing北京";
char out[100];
if (gb2312_to_utf8(wc, out, 100) != 0) {
printf("%s\n", out);
}
if (gb2312_to_utf8(str, out, 100) != 0) {
printf("%s\n", out);
}
return 0;
}
int gb2312_to_utf8(char *in, char *out, size_t size) {
//使用iconv转换GB2312为UTF-8编码
iconv_t cd;
cd = iconv_open("UTF-8", "GB2312");
if ( cd == (iconv_t)(-1) ) {
perror("iconv_open failed");
return 0;
}
size_t in_left = strlen(in) + 1;
char *out_ptr;
size_t res;
out_ptr = out;
res = iconv(cd, &in, &in_left, &out_ptr, &size);
if ( res == (size_t) (-1) ) {
perror("iconv failed");
return 0;
}
iconv_close(cd);
return 1;
}
|
阅读(1078) | 评论(0) | 转发(0) |