小白玩转 Ollama

2026-08-05 Ollama

一、Ollama是什么?

Ollama = 一键本地跑开源大模型工具
✅ 不用配置Python、CUDA环境
✅ 一行命令下载、运行大模型
✅ 完全离线、数据不会上传云端,隐私安全
✅ Windows/Mac/Linux全平台支持

硬件最低参考

  • 低配笔记本(8G内存):1B/3B小模型
  • 普通电脑(16G内存):7B模型(首选入门)
  • 有N卡独立显存 ≥6G:流畅跑7B;≥12G可以尝试34B模型

二、第一步:安装 Ollama

官网:https://ollama.com/

Windows

  1. 下载 OllamaSetup.exe
  2. 双击安装,勾选Add to PATH
  3. 安装完成,打开 CMD / PowerShell
ollama --version

输出版号=安装成功

服务默认后台自动启动,访问 http://localhost:11434 显示 Ollama is running 正常

Mac

方式1(推荐):下载dmg安装包
方式2:终端一键脚本

curl -fsSL https://ollama.com/install.sh | sh

Linux

curl -fsSL https://ollama.com/install.sh | sh

优化:修改模型保存位置(Windows)

模型默认安装在C盘!很容易爆满

  1. 管理员打开PowerShell执行,切换模型安装目录:
setx OLLAMA_MODELS "D:\AI\OllamaModels"
  1. 完全关闭Ollama重启,新下载模型会保存到D盘

三、首选模型清单

模型后缀 :q4_K_M 均衡速度与效果

中文优先推荐

  1. Qwen2.5:7b
ollama run qwen2.5:7b
  1. DeepSeek-R1:7b
ollama run deepseek-r1:7b
  1. Llama3.2:3b(超轻量,8G内存电脑可用)
ollama run llama3.2:3b

看图识图

ollama run llava:7b

代码专用

ollama run qwen2.5-coder:7b

四、核心常用命令

打开终端执行

# 1.下载+直接启动模型
ollama run qwen2.5:7b

# 2.只下载模型,不启动
ollama pull qwen2.5:7b

# 3.查看本地已经下载了哪些模型
ollama list

# 4.停止正在运行的模型
ollama stop qwen2.5:7b

# 5.删除模型
ollama rm qwen2.5:7b

# 6.退出对话窗口
/exit

聊天演示

执行 ollama run qwen2.5:7b
等待下载完成,出现 >>>
直接输入问题:
帮我写一份周末出游方案

五、API调用

Ollama自带接口,任何程序都能调用,本地地址:http://127.0.0.1:11434
简单curl示例:

curl http://localhost:11434/api/generate -d '{
  "model": "qwen2.5:7b",
  "prompt": "简单介绍Ollama"
}'

六、补充:可视化界面

命令行不好用,可以搭配 Open WebUI使用,拥有类似ChatGPT网页界面

前提:电脑安装Docker(新手推荐Docker Desktop)

执行这条一键启动:

docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main

启动成功后浏览器打开:
http://localhost:3000
首次注册管理员账号,自动连接本地Ollama
功能:切换模型、上传PDF文档问答、暗色模式、对话历史、图片识别

七、常见问题

1.下载模型很慢

  1. 更换网络;或者使用镜像加速

    关闭所有 ollama 程序(右下角托盘退出 Ollama),新开 PowerShell,先执行这两句设置环境变量,不要先 run/pull:
    ⚠️这个环境变量只对当前 PowerShell 窗口生效,关闭窗口就失效。

$env:OLLAMA_REGISTRY="https://registry.cn-hangzhou.aliyuncs.com/ollama"
ollama pull qwen3.5:9b
  1. 优先选择7B小模型,不要直接下34B/70B超大模型

2.电脑内存不足,卡顿

✅ 不要运行70B大模型
✅ 关闭其他软件释放内存
✅ 选择带 q4_K_M 量化版本,降低内存占用

3.提示无法连接Ollama

确认右下角小羊驼程序正在运行;
如闪退,手动启动Ollama,或者终端运行:

ollama serve

4.跨局域网访问Ollama

设置环境变量

OLLAMA_HOST=0.0.0.0

重启Ollama,同一局域网设备访问 你的电脑IP:11434