Chinaunix首页 | 论坛 | 博客
  • 博客访问: 91704
  • 博文数量: 66
  • 博客积分: 110
  • 博客等级: 民兵
  • 技术积分: 410
  • 用 户 组: 普通用户
  • 注册时间: 2012-06-18 09:34
文章分类
文章存档

2012年(66)

我的朋友

分类:

2012-07-26 11:14:29

原文地址:inux下GBK->UTF-8 作者:fly123456789

linux下GBK->UTF-8文件编码批量转换脚本


find default -type d -exec mkdir -p utf/{} ;
find default -type f -exec iconv -f GBK -t UTF-8 {} -o utf/{} ;
这两行命令将default目录下的文件由GBK编码转换为UTF-8编码,目录结构不变,转码后的文件保存在utf/default目录下。


linux C gbk utf 8编码转换


用linux C 下的函数调用创建中文目录、文件等,字符串的编码格式要求是utf-8格式的。
比如想要使用 int mkdir(const char *pathname, mode_t mode); 创建一个中文的目录。那么pathname的编码格式要求是utf-8的,而不能是gb3212/gbk的,否则就是乱码。
那么如果linux C下如何进行gbk<---->utf-8编码转换的编码装换的?使用的是iconv函数簇。
#include
int code_convert(char *from_charset,char *to_charset,char *inbuf,int inlen,char *outbuf,int outlen)
{
iconv_t cd;
int rc;
char **pin = &inbuf;
char **pout = &outbuf;
cd = iconv_open(to_charset,from_charset);
if (cd==0)
return -1;
memset(outbuf,0,outlen);
if (iconv(cd,pin,&inlen,pout,&outlen) == -1)
return -1;
iconv_close(cd);
return 0;
}
int u2g(char *inbuf,int inlen,char *outbuf,int outlen)
{
return code_convert("utf-8","gb2312",inbuf,inlen,outbuf,outlen);
}
int g2u(char *inbuf,size_t inlen,char *outbuf,size_t outlen)
{
return code_convert("gb2312","utf-8",inbuf,inlen,outbuf,outlen);
}

其中
iconv函数族的头文件是iconv.h,使用前需包含之。
#include
iconv函数族有三个函数,原型如下:
(1) iconv_t iconv_open(const char *tocode, const char *fromcode);
此函数说明将要进行哪两种编码的转换,tocode是目标编码,fromcode是原编码,该函数返回一个转换句柄,供以下两个函数使用。
(2) size_t iconv(iconv_t cd,char **inbuf,size_t *inbytesleft,char **outbuf,size_t *outbytesleft);
此函数从inbuf中读取字符,转换后输出到outbuf中,inbytesleft用以记录还未转换的字符数,outbytesleft用以记录输出缓冲的剩余空间。
(3) int iconv_close(iconv_t cd);
此函数用于关闭转换句柄,释放资源。 ......



C编程:使用iconv把GB2312编码转换为UTF-8编码


C编程:使用iconv把GB2312编码转换为UTF-8编码

#include <stdio.h>
    #include <string.h>
    #include <iconv.h>

    int gb2312_to_utf8(char *in, char *out, size_t size);

    int main(int argc, char *argv[]) {

        char *wc = "我";
        char *str = "Beijing北京";

        char out[100];

        if (gb2312_to_utf8(wc, out, 100) != 0) {
            printf("%s\n", out);
        }
        if (gb2312_to_utf8(str, out, 100) != 0) {
            printf("%s\n", out);
        }

        return 0;
    }

    int gb2312_to_utf8(char *in, char *out, size_t size) {

        //使用iconv转换GB2312为UTF-8编码

        iconv_t cd;
        cd = iconv_open("UTF-8", "GB2312");
        if ( cd == (iconv_t)(-1) ) {
            perror("iconv_open failed");
            return 0;
        }

        size_t in_left = strlen(in) + 1;
        char *out_ptr;
        size_t res;

        out_ptr = out;
        res = iconv(cd, &in, &in_left, &out_ptr, &size);
        if ( res == (size_t) (-1) ) {
            perror("iconv failed");
            return 0;
        }

        iconv_close(cd);
        return 1;
    }


阅读(437) | 评论(0) | 转发(0) |
给主人留下些什么吧!~~