Ollama 自定义导入模型
·
使用 GGUF 文件导入模型到 Ollama
准备 GGUF 文件
将下载的 .gguf 文件移动到项目目录下的 1.从gguf直接导入/ 文件夹内(与 Modelfile 和 main.ipynb 同级)
├── 1.从gguf直接导入/
│ ├── main.ipynb
│ ├── Modelfile
│ └── Qwen2-0.5B.Q3_K_M.gguf
创建 Modelfile
在终端中切换到 1.从gguf直接导入/ 目录
cd C:\Users\XXX\Desktop\ollama\handy-ollama\notebook\C3\1.从GGUF直接导入
运行创建命令
ollama create mymodel -f Modelfile

启动模型
ollama run mymodel
这家伙像是个人工智障

Ollama 自定义在 GPU 中运行
检查
检查驱动程序
nvidia-smi
我的笔记本 可怜兮兮的GPU

NVIDIA GeForce MX250
检查CUDA
nvcc --version

去官网安装
-
访问 NVIDIA CUDA Toolkit 官网。
-
选择与系统(Windows 11/10)、GPU 驱动版本兼容的 CUDA 版本(例如 CUDA 12.7)。
-
安装时勾选 "CUDA Development Tools"(开发工具),确保 nvcc 被安装。
安装好以后再次输入
nvcc --version
显示:

验证一下,使用GPU加速成功

参考文章
https://github.com/datawhalechina/handy-ollama
https://github.com/datawhalechina/handy-ollama
魔乐社区(Modelers.cn) 是一个中立、公益的人工智能社区,提供人工智能工具、模型、数据的托管、展示与应用协同服务,为人工智能开发及爱好者搭建开放的学习交流平台。社区通过理事会方式运作,由全产业链共同建设、共同运营、共同享有,推动国产AI生态繁荣发展。
更多推荐


所有评论(0)