第八十四篇-V100-32G+Easyclaw+Ollama+Qwopus3.5-27B-V3

环境

bash 复制代码
系统:CentOS-7
CPU : E5-2680V4 14核28线程
内存:DDR4 2133 32G * 2
显卡:Tesla V100-32G【PG503】 (水冷)
驱动: 535
CUDA: 12.2

下载

https://modelscope.cn/models/Jackrong/Qwopus3.5-27B-v3-GGUF

Ollama配置MF

clike 复制代码
FROM /models/Qwopus3.5-27B/Qwopus3.5-27B-v3-Q4_K_M.gguf

# --------------------------------------------------------------------------
# 🎯 CHAT TEMPLATE (Qwen3.5 Compatible)
# --------------------------------------------------------------------------
TEMPLATE """{{- if .System }}<|im_start|>system
{{ .System }}<|im_end|>
{{ end }}{{- range .Messages }}
{{- if eq .Role "user" }}<|im_start|>user
{{ .Content }}<|im_end|>
{{- else if eq .Role "assistant" }}<|im_start|>assistant
{{ .Content }}<|im_end|>
{{- end }}
{{- end }}<|im_start|>assistant
"""

SYSTEM """You are Qwopus3.5-27B-v3, an advanced AI assistant optimized for NVIDIA V100 32GB.
- Provide accurate, concise, and well-structured responses
- Use chain-of-thought reasoning for complex tasks
- Support multilingual input but default to user's language
- Decline harmful requests politely but firmly"""

# --------------------------------------------------------------------------
# ⚙️ HARDWARE OPTIMIZATION (V100-32GB CRITICAL)
# --------------------------------------------------------------------------

# ✓ 修正: Context 设为 4096 (平衡速度与显存),可按需调整
PARAMETER num_ctx 64096

# ✓ 批处理大小: 提升推理吞吐量 (显存允许下尽量大)
PARAMETER num_batch 512

# ✓ GPU 层数: 99 层全卸载,若 OOM 则降至 85-90
PARAMETER num_gpu 99

# ✓ CPU 线程: 匹配物理核心数,避免超线程开销
PARAMETER num_thread 8

# ✓ 内存映射: 加速加载,允许 swap 缓冲
PARAMETER use_mmap true

# ✓ (可选) 低显存模式: 若频繁 OOM 可启用
# PARAMETER low_vram true

# --------------------------------------------------------------------------
# 🎲 SAMPLING PARAMETERS (Balanced Quality/Speed)
# --------------------------------------------------------------------------
PARAMETER temperature 0.7
PARAMETER top_p 0.9
PARAMETER top_k 40
PARAMETER min_p 0.05
PARAMETER repeat_penalty 1.1
PARAMETER typical_p 0.9
PARAMETER presence_penalty 0.0
PARAMETER frequency_penalty 0.0

# --------------------------------------------------------------------------
# 🛑 OUTPUT CONTROL & STOP SEQUENCES
# --------------------------------------------------------------------------
# 标准 Qwen3.5 stop tokens
PARAMETER stop "<|im_end|>"
PARAMETER stop "<|im_start|>"
PARAMETER stop "<|user|>"
PARAMETER stop "<|assistant|>"
PARAMETER stop "<|system|>"
PARAMETER stop "</s>"

# 对话连贯性控制
PARAMETER num_keep 512

运行

clike 复制代码
ollama create Qwopus3.5-27B-V3 -f Modelfile

验证模型

clike 复制代码
http://192.168.1.222:11434/v1/models

下载Easyclaw

clike 复制代码
https://easyclaw.cn/

安装

clike 复制代码
windows下正常下一步安装

启动

配置Ollama本地模型


开始使用

可以正常使用了,速度还可以

相关推荐
怪奇云呼军6 小时前
G.711、Opus 和重采样会拖慢识别吗?闪电智能VoiceAgent 的音频入口怎么选
java·人工智能·python·算法·云计算·音视频
chen_zn956 小时前
《VLA 系列》π0 | Flow Matching 动作专家 | 跨本体机器人策略 | 论文与源码解析
人工智能·具身智能·vla
观远数据6 小时前
先进制造业BI价值交付:三个车间数据场景与它们的ROI账本
大数据·人工智能
星辰_mya6 小时前
国内气象数据平台业务规则——自用
大数据·人工智能
jikemaoshiyanshi6 小时前
2026 AWS 中国峰会有哪些 AI Agent 专题演讲?按团队场景分层指南
大数据·人工智能
必须会一定会6 小时前
DeepSeek API 峰谷定价实战:计算 8 月 17 日后的 Agent 成本,并启动 Harness 预览版
人工智能·ai编程
搞科研的小刘选手6 小时前
【河南省科学院、河南工业大学主办 | 郑州举办】2026年计算机视觉与具身智能国际学术会议(CVEI 2026)
人工智能·计算机视觉·具身智能·学术会议·会议推荐
2601_950760796 小时前
H-2K(d)/IYSTVASSL流感HA四聚体:抗原特异性CD8+ T细胞检测的核心工具
人工智能·蛋白
烟雨江南7857 小时前
大型展会和行业活动如何做实时字幕?——灵声智库多会场流式 ASR、统一转写与内容沉淀实践
人工智能·语音识别·ai客服·企业agent
M-Robots echo7 小时前
驱动抽象层解析:标准化硬件接口,解决机器人硬件碎片化适配难题
人工智能·机器人·ros·开源社区·m-robots