llamafactory推理消除模型的随机性

llamafactory采用vllm推理时有一个do_sample参数,do_sample参数(是否采样)等于True(默认),为False为采用贪婪解码,即为不随机采样,生成将会更加稳定,自己测试了,结果是采用do_sample参数为False时效果有所提升。

参考链接:
https://github.com/vllm-project/vllm/blob/main/vllm/sampling_params.py#L117

temperature为0意味着采用贪婪策略

所以在LLaMA-Factory\src\llamafactory\api\protocol.py中:

将temperature: float | None = None改为temperature: Optionalfloat = 0,即为采用贪婪策略,生成的更加稳定

相关推荐
sulikey7 分钟前
Linux 粘滞位(Sticky Bit)完全指南:为什么共享目录需要“防删除“?
linux·服务器
mengge.cloud8 分钟前
网络技术基础小白教程
linux·服务器·网络·云计算
严谨的麻辣烫24 分钟前
2026 年静态 IP 为什么重新受到关注?从住宅代理安全问题看固定网络出口
运维·服务器·tcp/ip·网络安全
学代码的CJY26 分钟前
Linux 重定向、管道与环境变量
linux·spring boot·spring
treacle田1 小时前
达梦数据库-Linux DM数据守护主备集群缩改为单机-记录总结
linux·服务器·数据库·主备集群改单机
shengchanxian11 小时前
2026年9月服务器装配流水线厂家技术测评:对标国标的硬件评判逻辑
运维·服务器·服务器装配流水线厂家
kyrie_sakura2 小时前
python学习笔记11 -- 进程和线程
笔记·python·学习
IT大白鼠2 小时前
CentOS 7.9 自建 Yum 源服务器搭建指南
linux·服务器·centos
高亦真2 小时前
今天是学习嵌入式的第34天
linux·学习·算法
2501_931819702 小时前
桂柳方言标注公司错误标注溯源追踪体系搭建诉求落地 桂柳方言标注公司学习信实翻译全链路追踪技术
学习·语音识别