极客前沿

2026 本地 AI 入门:装好 Ollama,免费跑通第一个模型

2026-07-15 01:47
DEV Ollama
查看原文

手把手教你下载 Ollama、安装、拉取模型并验证,零基础也能在电脑上跑通本地 AI。

准备环境:你需要什么

本地跑 AI 就是把模型下载到你自己的电脑上运行,不联网、不花钱。你需要:一台带 NVIDIA 显卡(NVIDIA 是一家做显卡的公司,它的显卡适合跑 AI)的电脑,显存至少 8GB(比如 RTX 4060)。如果没有独立显卡,纯靠 CPU 也能跑,但速度会慢很多。

安装步骤:用 Ollama 第一次跑通模型

  1. 打开浏览器,访问 Ollama(一个免费工具,帮你下载和运行 AI 模型)的官网 ollama.com。
  2. 点击下载按钮,选择你电脑对应的系统(Windows / macOS / Linux),安装包大约 500MB。
  3. 双击安装,一路点“下一步”,完成后 Ollama 会在后台自动启动,任务栏会出现一个小羊驼图标。
  4. 打开命令提示符(Windows 按 Win+R,输入 cmd 回车)或终端(macOS/Linux)。
  5. 输入以下命令并回车:ollama pull gemma4:12b。这条命令会下载 Google 的 Gemma 4 12B 模型(一个免费、开源的 AI 模型,适合日常写作、问答)。下载时间取决于你的网速,大约需要 10-20 分钟。
  6. 下载完成后,在终端输入 ollama run gemma4:12b 并回车,你就进入了一个聊天界面。输入“你好”试试,模型会回复你。

常见坑:如果下载失败,检查网络是否稳定,或者换个时间再试。如果运行时报错“out of memory”,说明你的显卡显存不足,可以改用更小的模型,比如 ollama pull phi3:3.8b

Tutorial Image

验证是否成功:和模型聊两句

在终端里,你可以直接打字提问。比如输入“用中文介绍一下你自己”,模型会回答。输入 /exit 退出聊天。如果一切顺利,恭喜你,你已经成功跑通了第一个本地 AI 模型!

下一步可以做什么

  • 试试其他模型:在终端输入 ollama pull deepseek-r1:7b 下载一个擅长编程的模型。
  • 安装 LM Studio(一个带图形界面的工具,适合不想打命令的用户),从官网 lmstudio.ai 下载,安装后图形化搜索和运行模型。
  • 把模型接入聊天软件或编辑器:Ollama 支持 API 调用,你可以用 Python 或 JavaScript 写代码调用它。

本地 AI 的好处是:数据不出门,永久免费,只需付一次硬件钱。2026 年的模型已经足够好,8GB 显存的显卡就能流畅运行 7B-13B 参数规模的模型,满足日常写作、编程辅助、文档问答完全够用。

内容来源

DEV Ollama

发布时间

2026-07-15 01:47

返回 AI技术