前置准备
Windows 11 22H2 及以上版本,开启 WSL2 / 直接本地 GPU 加速(N 卡优先,AMD/Intel 核显也支持)
NVIDIA 显卡:安装最新 NVIDIA Driver + CUDA(Ollama 自带简易 CUDA,不用单独装)
内存建议:
7B 模型 ≥8G 内存;13B ≥16G;34B/70B ≥32G;
显卡显存:7B 最少 4G 英伟达显卡显存,13B 8G 英伟达显卡显存,越大越流畅
一、Ollama Windows 通用安装步骤
官网下载安装包:https://ollama.com/download/windows
双击安装,一路下一步,自动配置环境,无需手动配 WSL
安装完成后,打开 Windows 终端 / PowerShell/CMD 即可直接使用 ollama 命令
验证安装:
bash
运行
ollama –version
输出版本号即安装成功。
二、主流经典模型部署操作(复制命令直接运行)
- 轻量日常对话:Llama 3 8B(通用首选,7B 级天花板)
部署命令
bash
运行
ollama pull llama3:8b
启动对话
bash
运行
ollama run llama3:8b
适用场景
日常问答、文案、代码、总结、翻译,低配电脑流畅运行;
占用:4~6G 显存,8G 内存机器可跑。
退出对话
输入 /bye 回车。 - 超强代码专用:CodeLlama 7B / CodeLlama 13B
7B 轻量版
bash
运行
ollama pull codellama:7b
ollama run codellama:7b
13B 专业代码版(写项目、排错更强)
bash
运行
ollama pull codellama:13b
ollama run codellama:13b
适用:Python/Java/Shell/ 前端、运维脚本、Bug 排查。 - 国产全能:Qwen 通义千问系列(阿里开源,中文最优)
轻量 7B
bash
运行
ollama pull qwen:7b
ollama run qwen:7b
超强 14B 中文
bash
运行
ollama pull qwen:14b
ollama run qwen:14b
优势:中文理解、写作、逻辑、知识库远超海外模型,国内使用首选。 - 极简小模型(老旧电脑 / 无独显):Mistral 7B
体积小、速度极快,低配笔记本专用
bash
运行
ollama pull mistral:7b
ollama run mistral:7b - 超大参数深度思考:Llama3 70B(高性能主机)
需要 32G 以上内存 + 16G 显存
bash
运行
ollama pull llama3:70b
ollama run llama3:70b
适合深度推理、长文档分析、复杂方案撰写。 - 图文多模态(能识别图片):LLaVA 视觉大模型
支持上传图片提问,图文问答
bash
运行
ollama pull llava:7b
ollama run llava:7b
使用示例:
plaintext
Comments