Ollama 入门指南:本地 AI 安装与第一次跑通
本文手把手教你安装 Ollama,跑通第一个本地 AI 模型,并了解基础用法,零基础友好。
准备工作:先了解 Ollama 是什么
Ollama 是一个让你在个人电脑上运行 AI 模型的免费工具。简单说,它把大模型(比如 Llama)打包成简单易用的程序,你只需敲几行命令就能让 AI 在本地工作,数据不会上传到云端。
开始前,请确认你的电脑满足基本条件:
- 操作系统:Windows 10 以上、macOS 11+ 或 Linux(Ubuntu 等)
- 硬件:建议 8GB 以上内存,有 NVIDIA 显卡(至少 4GB 显存)体验更佳,但纯 CPU 也能跑小模型
- 网络:下载安装包和模型需要联网
安装步骤:下载并设置 Ollama
- 打开官网 ollama.com,点击 Download,选择你的操作系统版本下载。
- Windows 用户运行安装程序,一路默认即可;Mac 用户直接拖到 Applications 文件夹;Linux 用户打开终端,执行
curl -fsSL https://ollama.com/install.sh | sh。 - 安装完成后,打开终端(Windows 用 PowerShell 或 CMD),输入
ollama --version,看到版本号说明安装成功。 - 在终端输入
ollama run llama3.2,系统会自动下载一个约 2GB 的小模型(Llama 3.2 1B)。下载时间视网速而定。 - 下载完成后,你会看到
>>>提示符,直接输入你的问题,比如“你好,你是谁?”,模型就会回答。 - 输入
/exit退出对话。 - 换模型:在 Ollama 模型库 浏览更多模型,比如
qwen2.5(通义千问)、mistral,用ollama run 模型名即可切换。 - 自定义参数:在命令后加
--temperature 0.7调整回答的随机性,数值越高越有创意。 - 集成到应用:Ollama 提供 API(默认
http://localhost:11434),你可以用 Python 等语言调用它,实现自动化任务。 - 注意资源占用:模型运行时会占用大量内存,如果电脑变卡,可以关闭其他程序或换用更小的模型。
常见坑提醒:Windows 用户如果遇到“无法加载文件”错误,请以管理员身份运行 PowerShell,再试一次。
第一次跑通:下载并运行模型
如果你有 NVIDIA 显卡,Ollama 会自动调用 GPU 加速;如果没有,它会自动降级到 CPU 运行(速度会慢一些)。
下一步可以做什么
内容来源
DEV Ollama
发布时间
2026-07-18 01:31