极客前沿

Ollama 入门指南:本地 AI 安装与第一次跑通

2026-07-18 01:31
DEV Ollama
查看原文

本文手把手教你安装 Ollama,跑通第一个本地 AI 模型,并了解基础用法,零基础友好。

准备工作:先了解 Ollama 是什么

Ollama 是一个让你在个人电脑上运行 AI 模型的免费工具。简单说,它把大模型(比如 Llama)打包成简单易用的程序,你只需敲几行命令就能让 AI 在本地工作,数据不会上传到云端。

Tutorial Image

开始前,请确认你的电脑满足基本条件:

Tutorial Image
  • 操作系统:Windows 10 以上、macOS 11+ 或 Linux(Ubuntu 等)
  • 硬件:建议 8GB 以上内存,有 NVIDIA 显卡(至少 4GB 显存)体验更佳,但纯 CPU 也能跑小模型
  • 网络:下载安装包和模型需要联网

安装步骤:下载并设置 Ollama

  1. 打开官网 ollama.com,点击 Download,选择你的操作系统版本下载。
  2. Windows 用户运行安装程序,一路默认即可;Mac 用户直接拖到 Applications 文件夹;Linux 用户打开终端,执行 curl -fsSL https://ollama.com/install.sh | sh
  3. 安装完成后,打开终端(Windows 用 PowerShell 或 CMD),输入 ollama --version,看到版本号说明安装成功。
  4. 常见坑提醒:Windows 用户如果遇到“无法加载文件”错误,请以管理员身份运行 PowerShell,再试一次。

    第一次跑通:下载并运行模型

    1. 在终端输入 ollama run llama3.2,系统会自动下载一个约 2GB 的小模型(Llama 3.2 1B)。下载时间视网速而定。
    2. 下载完成后,你会看到 >>> 提示符,直接输入你的问题,比如“你好,你是谁?”,模型就会回答。
    3. 输入 /exit 退出对话。

    如果你有 NVIDIA 显卡,Ollama 会自动调用 GPU 加速;如果没有,它会自动降级到 CPU 运行(速度会慢一些)。

    下一步可以做什么

    • 换模型:在 Ollama 模型库 浏览更多模型,比如 qwen2.5(通义千问)、mistral,用 ollama run 模型名 即可切换。
    • 自定义参数:在命令后加 --temperature 0.7 调整回答的随机性,数值越高越有创意。
    • 集成到应用:Ollama 提供 API(默认 http://localhost:11434),你可以用 Python 等语言调用它,实现自动化任务。
    • 注意资源占用:模型运行时会占用大量内存,如果电脑变卡,可以关闭其他程序或换用更小的模型。

内容来源

DEV Ollama

发布时间

2026-07-18 01:31

返回 AI技术