decapoda-research/llama-7b-hf 的踩坑记录

使用transformers加载decapoda-research/llama-7b-hf的踩坑记录。

  1. ValueError: Tokenizer class LLaMATokenizer does not exist or is not currently imported.

    解决办法:

    https://github.com/huggingface/transformers/issues/22222

    将tokenizer_config.json中LLaMATokenizer改为LlamaTokenizer。

  2. RecursionError: maximum recursion depth exceeded while getting the str of an object.

    解决办法:

    https://github.com/huggingface/transformers/issues/22762

    使用tokenizer_config.json替换原本的tokenizer_config.json

相关推荐
福大大架构师每日一题1 天前
ollama v0.32.14正式发布:WebP 自动转码、Qwen 系统消息兼容升级与 llama.cpp、MLX 更新全解析
android·java·llama
zyl837211 天前
LLaMA‑Factory 使用条件 + 学习手册
llama
刻BITTER1 天前
让 Intel NPU 跑AI 大模型?一次 llama.cpp OpenVINO 后端的完整实测
人工智能·llama·openvino
微软技术分享2 天前
Windows 环境下 llama.cpp 编译运行指南
windows·llama
zhy295632 天前
【DNN】Llama 3.2 1B模型LORA微调与QAIRT部署
人工智能·dnn·llama
Flynt3 天前
花一下午把Qwen3.8-27B跑在本地,最坑的不是显存
开源·llm·llama
uncle_ll3 天前
Llama 3 私有化落地全栈实战:从 Ollama 极速部署到 LLaMA Factory LoRA 定制微调
llm·nlp·llama·ollama·大模型微调
DAVIED93 天前
llama.cpp 本地部署完全指南
windows·llama·wsl·llamacpp
zhy295633 天前
在 QAIRT Genie SDK 上部署 Llama 3.2 1B 模型:从环境准备到 C++ 推理
开发语言·c++·llama
goodlook01235 天前
LLaMa factory 大模型高效微调(二)
人工智能·深度学习·llama