零成本跑AI:Ollama本地安装与上手教程
手把手教你安装Ollama,拉取模型,通过API在本地免费运行AI,无需API密钥,零成本入门。
什么是Ollama?为什么要用它?
Ollama是一个让你在自己电脑上运行AI模型的工具。简单说,它就像一个小型AI服务器,你安装后就能在本地调用AI,完全免费,不用联网,不怕隐私泄露。适合新手入门AI开发。
第一步:安装Ollama
- 打开浏览器,访问 ollama.com,点击“Download”按钮。
- 根据你的系统(Windows/macOS/Linux)下载对应安装包。
- 双击安装,一路默认选项即可。安装完成后,Ollama会在后台自动启动,任务栏或菜单栏会出现它的图标。
常见坑提醒:Windows用户安装后可能需要重启电脑,或手动打开终端运行 ollama serve 确保服务启动。
第二步:拉取并运行第一个模型
Ollama安装后,你需要下载一个模型才能使用。推荐新手从 llama3.2(8B参数)开始,它体积适中(约4.7GB),效果不错。
- 打开终端(Windows用CMD或PowerShell,Mac/Linux用终端)。
- 输入命令:
ollama pull llama3.2,回车。它会自动下载模型,进度条走完即可。 - 下载完成后,输入
ollama run llama3.2,回车。你就进入了对话模式,可以直接输入问题,AI会回复你。
常见坑提醒:下载模型需要稳定网络,如果中途失败,重新运行 ollama pull 即可断点续传。模型文件较大,确保硬盘有足够空间。
第三步:通过API调用本地模型(进阶)
Ollama启动后,默认在本地开启一个HTTP服务,地址是 http://localhost:11434。你可以像调用远程API一样调用它,但完全免费。
- 确保Ollama在运行(终端里运行
ollama serve)。 - 打开另一个终端,用curl测试:
curl -X POST http://localhost:11434/api/generate -d '{"model": "llama3.2", "prompt": "你好,请介绍一下自己"}'。 - 你会看到模型返回的JSON格式回复。恭喜,你已经成功在本地跑通AI了!
常见坑提醒:如果curl命令报错,检查Ollama是否启动(任务栏有图标)。Windows用户可能需要用 curl.exe 代替 curl。
下一步可以做什么?
- 用Python写个脚本调用本地API,实现自动写文案、翻译、总结等功能。
- 尝试其他模型,如
mistral、qwen2.5,用ollama pull 模型名下载。 - 探索Ollama的Web UI工具(如Open WebUI),让交互更图形化。
现在,你的AI运行在本地,完全免费,无限次数调用。动手试试吧!
内容来源
DEV Ollama
发布时间
2026-06-29 01:31