AI 入门:本地跑通大模型只需 20 分钟
零基础学会安装 Ollama,下载模型,并在本地运行第一个 AI 对话。
准备环境
你只需要一台能上网的电脑(Windows / macOS / Linux 都可以)。不需要显卡,Ollama 会尽可能利用你的 CPU 和内存。先确保系统有 8GB 以上内存,如果模型较大,建议 16GB。
安装 Ollama
- 打开浏览器,访问 Ollama(一个让你在本地运行大模型的工具,就像安装一个软件一样简单)的官网 ollama.com。
- 点击 Download,选择你的操作系统,下载安装包。
- 双击安装,一路默认即可(Windows 下可能需要允许管理员权限)。
- 安装完成后,打开终端(Windows 用 CMD 或 PowerShell,macOS/Linux 用 Terminal),输入
ollama --version,如果显示版本号,说明安装成功。
下载并运行你的第一个模型
- 在终端中输入
ollama run llama3.2。这行命令会自动下载一个叫 Llama 3.2 的模型(一种能理解并生成文字的 AI),然后启动对话。 - 第一次运行会下载几个 GB 的数据,根据网速等待几分钟。下载完成后,你会看到
>>>提示符。 - 输入你的问题,比如“你好!”,按回车,AI 就会回复你。按
/bye退出。
常见坑:如果下载卡住,检查网络是否稳定;如果提示内存不足,可以换更小的模型,比如 ollama run phi。
下一步可以做什么
- 试试其他模型:
ollama run qwen2.5(阿里通义千问的轻量版)或ollama run mistral。 - 用
ollama pull 模型名先下载模型,方便离线使用。 - 安装 Open WebUI(一个好看的网页聊天界面),让你像用 ChatGPT 一样用本地 AI。安装方法:
docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main(需要先装 Docker)。
内容来源
DEV Ollama
发布时间
2026-06-25 01:35