1、先检查是否安装ollama:命令行直接输入ollama,出现下图,则说明安装了ollama,如果没安装的话,自行安装,很简单。

2、创建modelfile,文件地址可以放在model的文件夹下面。

cat > Modelfile << EOF
FROM /mnt/sdb/data/liqianxi/models/Qwen3-14B-Q8/Qwen3-14B-128K-UD-Q8_K_XL.gguf

# 修正参数名称
PARAMETER temperature 0.7
PARAMETER top_p 0.9
# 替换max_tokens为num_predict
PARAMETER num_predict 8192
# 上下文窗口大小,与模型128K匹配
PARAMETER num_ctx 128000

# 模型元数据
TEMPLATE """{{ .Prompt }}"""
SYSTEM """你是一个智能助手,能够帮助用户解决各种问题。"""
EOF

modelfile这个需要,标明清楚模型的真实地址:/mnt/sdb/data/liqianxi/models/Qwen3-14B-Q8/Qwen3-14B-128K-UD-Q8_K_XL.gguf

3、然后运行:

ollama create qwen3-14b-128k -f Modelfile

4、检验是否成功,如下图,即可成功。

5、后续进行私有化部署dify,连接这个ollama部署的模型进行开发agent。

Logo

码道开发者社区,聚焦华为云码道 CodeArts 代码智能体,沉淀 Agent、Skill、鸿蒙开发实战内容,供开发者查阅资料、交流技术、分享工程实践

更多推荐