Ollama 入门教程:安装、运行本地 AI 模型,一步步上手
零基础学会安装 Ollama,下载并运行本地大语言模型,几分钟内让 AI 在你的电脑上跑起来。
什么是 Ollama?
Ollama 是一个让你在个人电脑上运行大语言模型(LLM)的工具。你只需安装它,输入一条命令,就能在本地启动一个 AI 模型,所有数据都留在你的电脑里,无需联网付费。
第一步:安装 Ollama
- macOS 和 Windows:前往 ollama.com 下载桌面应用,双击安装。
- Linux:打开终端,执行以下命令:
curl -fsSL https://ollama.com/install.sh | sh
第二步:运行第一个模型
- 打开终端(或命令提示符)。
- 输入命令:
ollama run llama3.2,然后按回车。 - 系统会自动下载模型(约 4GB),稍等片刻。
- 下载完成后,你会看到一个交互式提示符,直接输入问题即可与 AI 对话。
常见坑:模型名称后的冒号和标签(如 :70b)指定模型大小和精度。新手建议直接使用默认标签,不要加任何参数。
第三步:验证安装是否成功
打开浏览器,访问 http://localhost:11434。如果看到 Ollama 的 API 响应(比如 Ollama is running),说明安装成功。你也可以使用 Web UI 如 Open WebUI(需要额外安装)来获得图形界面。
下一步可以做什么?
- 尝试其他模型:如
ollama run qwen2.5或ollama run deepseek-r1。 - 在 Python 代码中调用 Ollama API,实现自动化任务。
- 调整模型参数(如温度、上下文长度),优化生成效果。
记住,模型大小需要与你的显存匹配:7B 模型约需 6GB 显存,14B 约需 12GB。如果模型太大,电脑会变慢。现在,开始你的本地 AI 之旅吧!
内容来源
DEV Ollama
发布时间
2026-07-14 01:32