使用ollama关联已部署的gguf格式的大模型
·
1、先检查是否安装ollama:命令行直接输入ollama,出现下图,则说明安装了ollama,如果没安装的话,自行安装,很简单。

2、创建modelfile,文件地址可以放在model的文件夹下面。
cat > Modelfile << EOF
FROM /mnt/sdb/data/liqianxi/models/Qwen3-14B-Q8/Qwen3-14B-128K-UD-Q8_K_XL.gguf
# 修正参数名称
PARAMETER temperature 0.7
PARAMETER top_p 0.9
# 替换max_tokens为num_predict
PARAMETER num_predict 8192
# 上下文窗口大小,与模型128K匹配
PARAMETER num_ctx 128000
# 模型元数据
TEMPLATE """{{ .Prompt }}"""
SYSTEM """你是一个智能助手,能够帮助用户解决各种问题。"""
EOF
modelfile这个需要,标明清楚模型的真实地址:/mnt/sdb/data/liqianxi/models/Qwen3-14B-Q8/Qwen3-14B-128K-UD-Q8_K_XL.gguf
3、然后运行:
ollama create qwen3-14b-128k -f Modelfile
4、检验是否成功,如下图,即可成功。

5、后续进行私有化部署dify,连接这个ollama部署的模型进行开发agent。
更多推荐



所有评论(0)