导航首页 » AI 教程 » 本地跑大模型:Ollama 十分钟上手
本地跑大模型:Ollama 十分钟上手

想在本地离线用大模型,Ollama 是最省事的方案:装好、拉模型、开会话,三步搞定。

准备工作

  • 内存建议 16G 起步,独显 8G 显存能舒服跑 7B-14B 量化模型。
  • 纯 CPU 也能跑小模型,但速度会明显慢。

三步跑起来

  1. 到官网下载安装包,安装后终端执行 ollama -v 确认成功。
  2. 拉模型:ollama run qwen2.5:7b(中文任务建议选通义或 DeepSeek 系列)。
  3. 直接对话;输入 /bye 退出。

常用命令

  • ollama list:看已下载模型
  • ollama pull <模型>:下载/更新
  • ollama rm <模型>:删除释放空间

想要图形界面

配 Open WebUI 或 LM Studio,就有类似 ChatGPT 的网页端;也可以把 Ollama 当本地 API 用,端口默认 11434,让脚本或其它工具调用。

注意

本地模型的知识面受训练数据限制,遇到「最新的、小圈子的事实」容易编。要查信息仍得用联网工具。

本文为编辑整理,命令以当前版本为准,升级后可能变化。