c++ iconv 字符utf-8转换gb2312失败

extern size_t iconv (iconv_t __cd, char **__restrict __inbuf,

size_t *__restrict __inbytesleft,

char **__restrict __outbuf,

size_t *__restrict __outbytesleft);

在使用iconv函数时,没有注意到输出缓冲区和长度剩余的意义,他们都会被修改的。

所以在传参数时,要对原来的输出缓冲区的值和长度保存outbytes,且outbytesleft是移动后的位置,转换的数据长度是原来数据大小 outbytes-outbytesleft。

转换测试代码

cpp 复制代码
std::string Utils::utf8_to_gbk(const std::string& utf8_str)
{
    size_t inbytes = utf8_str.length();
    size_t outbytes = inbytes * 2; // 初始估计,可能不够大
    size_t outbytes2 = outbytes;
    char* outbuf = (char*)malloc(outbytes);
    char *outbuf1 = outbuf;
//    memset(outbuf,1,outbytes);
    if (outbuf == nullptr)
        return ""; // 内存分配失败处理

    iconv_t cd = iconv_open("GBK", "UTF-8");
    if (cd == (iconv_t)-1) {
        free(outbuf);
        return ""; // iconv打开失败处理
    }

    char* inbuf = const_cast<char*>(utf8_str.c_str());
    memset(outbuf, 0, outbytes);
    size_t result = iconv(cd, &inbuf, &inbytes, &outbuf, &outbytes);
    iconv_close(cd);

    if (result == (size_t)-1) {
        free(outbuf);
        return ""; // 转换失败处理
    }
    std::string gbk_str(outbuf1, outbytes2 - outbytes); // 注意这里可能需要调整,因为iconv可能不会在输出末尾添加null终止符
    free(outbuf1);
//    delete outbuf;
    return gbk_str;
}

之前错的代码是

std::string gbk_str(outbuf,outbytes);//这里就是空数据

free(outbuf);//这里就会挂

后来为了实现编码转换功能,使用的是qt的QTextCodec

测试代码,开发环境是linux的qt

QTextCodec::setCodecForLocale(QTextCodec::codecForName("UTF-8")); //设置本地编码是utf-8

QString tmp = "畅行·泉城";//qt中的是unicode编码

qDebug() << "latin " << tmp.toLocal8Bit().toHex(); //utf-8

qDebug() << "latin " << tmp.toUtf8().toHex();//utf-8

size_t c_len = tmp.length();

QByteArray bb = tmp.toUtf8();

// len = bb.length();

std::string aa = tmp.toStdString();//std::string则是utf-8

// 获取UTF-8编解码器

QTextCodec *utf8Codec = QTextCodec::codecForName("UTF-8");

// 获取GBK编解码器

QTextCodec *gbkCodec = QTextCodec::codecForName("GBK");

// 使用UTF-8编解码器将字符串从UTF-8解码为Unicode(QString)

QString unicodeString = utf8Codec->toUnicode(tmp.toUtf8());//这里其实不需要了,只要用下面的就行

// 然后使用GBK编解码器将Unicode字符串编码为GBK

QByteArray gbkByteArray = gbkCodec->fromUnicode(tmp);//qt中已经是unicode编码了

//QByteArray cc;

//cc.append(gbkByteArray);

qDebug() <<gbkByteArray <<"," <<gbkByteArray.toHex();

相关推荐
倒头就睡的小比特2 天前
算法竞赛C++常用的STL
c++·算法
weilx12342 天前
C++笔记-文件IO-<fcntl.h>
c++
小羊没烦恼!2 天前
初探性能优化——2个月到4小时的性能提升
java·开发语言·windows·算法·c#
伞伞悦读2 天前
【第38期】Python 模块与包详解:import、from、模块搜索路径、包结构和 __init__
开发语言·python
Smileyqp沛沛2 天前
前端?C++ ?较大差异基础罗列
c++·基础·前端转c++
C语言小火车2 天前
C/C++ 为什么需要编译器?
开发语言·c++
旖旎夜光2 天前
力控面试题 01.01: 判定字符是否唯一(位运算) —— 题解
c++·学习·算法·leetcode·力控
吞下星星的少年·-·2 天前
C++ 萌新语法入门篇
c++·算法比赛
霍霍的袁2 天前
【C++】map 和 set 的使用 | 从用法到底层
开发语言·c++·学习·visual studio
another heaven2 天前
【算法/C++ MD5算法能否逆解码?原理、C++实现与同类哈希算法对比】
c++·算法·哈希算法