llama.cpp 转化 huggingface 模型失败 解决路径

问题:

./main -m ./models/book_q4_K_M -n 128

报错:

terminate called after throwing an instance of 'std::out_of_range' what(): unordered_map::at

解决方案:

python convert.py models/llama3-8B/ --vocab-type bpe

报错:

Found vocab files: {'spm': None, 'bpe': PosixPath('models/llama3-8B/vocab.json'), 'hfft': PosixPath('models/llama3-8B/tokenizer.json')} Loading vocab file PosixPath('models/llama3-8B/vocab.json'), type 'bpe' Vocab info: <BpeVocab with 128000 base tokens and 256 added tokens> Special vocab info: <SpecialVocab with 280147 merges, special tokens {'bos': 128000, 'eos': 128009, 'pad': 128009}, add special tokens unset>

复制代码
 (py310) root@quin-ubuntu:~/code/llama.cpp# ls models/llama3-8B/
 config.json             LICENSE                           model-00003-of-00004.safetensors  README.md                tokenizer.json
 generation_config.json  model-00001-of-00004.safetensors  model-00004-of-00004.safetensors  special_tokens_map.json
 ggml-model-f16.gguf     model-00002-of-00004.safetensors  model.safetensors.index.json      tokenizer_config.json

发现没有 vocab.json 文件

复制 token.json 重命名为 vocab.json

vocab.json 和 tokenizer.json 都是与自然语言处理模型中的令牌器(tokenizer)相关的配置文件,但它们包含的信息和用途可能有所不同。

  1. vocab.json:

    • 这个文件通常包含了模型的词汇表(vocabulary),即模型能够理解和生成的所有单词或子词单元的列表。

    • 词汇表文件可能包括每个词汇条目的索引、词汇本身以及相关的统计信息(如频率)。

    • 在基于BPE(Byte Pair Encoding)或其他子词分割算法的令牌器中,vocab.json 文件可能包含了所有合并操作(merges)的列表,这些合并操作定义了如何将字符组合成子词单元。

  2. tokenizer.json:

    • 这个文件可能包含了令牌器的完整配置,包括词汇表、特殊令牌(如CLS、SEP、UNK等)、分割规则、预处理和后处理步骤等。

    • 在某些框架或模型中,tokenizer.json 可能是一个更全面的配置文件,它不仅包含了词汇表信息,还可能包括了如何将文本转换为模型输入的详细说明。

    • 这个文件可能用于保存和加载令牌器的配置,以便在不同的环境中重用相同的令牌化过程。

在实际应用中,vocab.json 和 tokenizer.json 的具体内容和格式可能取决于所使用的框架和模型。例如,在Hugging Face的Transformers库中,tokenizer.json 文件通常包含了令牌器的所有配置信息,而 vocab.json 可能只是词汇表的一部分。

如果你遇到需要使用这些文件的情况,你应该查阅相关模型或框架的文档,以确保你理解每个文件的确切用途和内容,并正确地使用它们。如果你的模型或脚本期望找到 vocab.json 文件,但你只有 tokenizer.json,你可能需要检查这两个文件是否可以互换,或者是否需要对脚本进行调整以适应现有的文件。

复制代码
 cp models/llama3-8B/tokenizer.json  models/llama3-8B/vocab.json

重新转换:

复制代码
 # 转换模型
 python convert.py models/llama3-8B/ --vocab-type bpe
 ​
 # 量化模型
 ./quantize models/llama3-8B/ggml-model-f32.gguf ./models/book-Q4_K_M.gguf Q4_K_M
 ​
 # 运行模型
 ./main -m ./models/book-Q4_K_M.gguf -n 128
相关推荐
程序猿编码6 天前
告别改源码适配模型:纯 C++ 可配置 LLM 推理引擎,全格式全结构兼容
c++·大模型·llm·推理引擎
论文复现现场6 天前
A100 跑 Qwen3.8-27B,FP8 还是 INT8?显存、速度、精度与微调兼容性怎么选
模型量化·vllm·a100·大模型部署·int8·fp8·qwen3.8
蔡俊锋6 天前
华为昇腾 960 超节点发布:4096 卡、5500 个光引擎替 4.8 万光模块——国产算力拐点到了吗?
大模型·模型部署·ai架构·国产算力·华为昇腾
O。O蛋黄酥啊6 天前
Claude Code 记忆机制全拆解:Auto Memory 与 CLAUDE.md 双轨解析
大模型·agent·memory·claude·codex·记忆
BlackStar_L6 天前
第二章 上下文工程
大模型·llm·agent
User_芊芊君子6 天前
让 Claude Code 换上国产大脑:蓝耘元生代上 GLM-5.2 / DeepSeek / Qwen 模型横评实测
人工智能·ai·大模型
寻道码路6 天前
大模型工程化实战(十二):RAG 数据工程底座——采集到入库流水线(离线+在线双链路)
大模型·知识库·rag·ai工程化·llmops`·数据工程底座·文档采集
Web3&Basketball6 天前
CRM Agent 后训练实战:3 倍更少错误
python·架构·大模型·agent·推理
蚁小二官方6 天前
AI 安全治理框架更新|大模型训练数据合规,企业实操落地思路
大模型·数据合规·ai安全
GPU实战笔记7 天前
本地跑不动 llama.cpp,临时租云 GPU 怎么搭?从启动服务到环境复用
java·服务器·网络·人工智能·深度学习·llama