首页 > 软件下载
【2026最新】Ollama下载安装全流程图解:本地运行大模型免费搞定3分钟上手
Ollama 是一款让你在本地电脑上运行大语言模型(LLM)的开源工具,当前最流行的本地部署方案之一。它把模型下载、加载、推理的全部复杂流程封装成一条简单命令,让你无需联网、无需订阅 ChatGPT,即可在本机运行 Llama 3、Mistral、Gemma、Qwen、DeepSeek 等数百种开源大模型。Ollama软件中文版下载地址:Ollama安装包
借助 Ollama,你可以用大语言模型完成写代码、翻译、写文案等任务,也可以搭建完全离线的私有 AI 服务;开发者还能通过它提供的 API 接口,把本地模型接入 AnythingLLM、ChatBox、Open WebUI 等前端使用。
本文提供 Windows / macOS / Linux 三平台的最新版安装包和安装命令,它的主要优点如下:
- 一条命令即可运行模型,无需配置 Python 环境
- 支持 Llama、Mistral、Qwen、DeepSeek 等数百种开源模型
- 完全本地离线运行,聊天数据不出本机
- 自动调用 NVIDIA / AMD 显卡,也兼容纯 CPU 运行
- 提供兼容 OpenAI 的本地 API,可接入各类前端
下载Ollama
本文提供的是 Windows、macOS 平台 Ollama 2026 最新版的官方安装包,Linux 平台可使用下方安装部分给出的命令安装部署:Ollama软件中文版下载地址:https://pan.quark.cn/s/37e8912c532d
- OllamaSetup.exe:适配 Windows 系统的安装包
- Ollama.dmg:适配 iOS 系统的安装包
安装Ollama
Windows 平台
Ollama 软件本体和它下载使用的大模型都默认直接安装在 C 盘等系统盘,由于大模型体积都十分巨大,建议把它们都安装到 D 盘等非系统盘。1) 打开非系统盘安装目录(本文中为“D:\Programs”),新建文件夹,并命名为 Ollama:

2) 下载 Ollama 安装包,放置在任意文件夹内(如安装包下载在桌面,建议直接在桌面创建一个文件夹把安装包放进去):

3) 点击 Ollama 安装包所在文件夹左上角的“文件”,点击“打开 Windows Powershell”右边的小三角,选中“以管理员身份打开 Windows Powershell”:

4) Windows Powershell 中路径即为安装包所在路径。按下方命令说明和示例完善你的命令后,粘贴到 Powershell 界面中:
命令说明:
.\OllamaSetup.exe /DIR="你的安装路径"命令示例:
.\OllamaSetup.exe /DIR="D:\Programs\Ollama"

5) 按下回车,桌面弹出 Ollama 的安装界面,点击“Install”:

6) 等待安装完成:

7) 安装完毕后,Ollama 自动运行,并弹出启动界面:

8) 点击左侧的“Settings”:

9) 找到“Model location”一项,点击“Browse”,更改模型安装目录:

10) 选中安装目录下的 Ollama 文件夹,点击“新建文件夹”,并命名为“Models”,最后点击“确定”:

11) 完成后可以在设置界面查看更改后的目录:

macOS 平台
下载 Ollama.dmg,打开后将 Ollama 图标拖入“应用程序”文件夹即可完成安装。Linux 平台
在终端执行官方一键安装命令:curl -fsSL https://ollama.com/install.sh | sh
拉取并运行模型
1) 打开 Ollama 模型库网页(https://ollama.com/library,此页面国内可直接访问),选择你要部署的模型和对应的参数量:
2) 本文以 deepseek:1.5b 为例(体积小方便演示),滑动到最下方,找到 1.5b 参数量模型的部署命令:

3) 打开命令行(Windows 用 PowerShell 或 cmd,macOS / Linux 用终端),粘贴刚刚得到的部署命令,回车,等待下载部署:

4) 部署完毕:

5) 可以在命令窗口或 Ollama 界面使用了:

Ollama常见使用问题解答
1) 运行模型时报错“could not load library"或显存不足怎么办?这通常是因为模型太大、超出显卡显存。解决方法是换用更小的量化版本,例如用
ollama run llama3:8b-instruct-q4_K_M 这类 4-bit 量化模型;纯靠 CPU 跑也能用,只是速度更慢。也可以在启动时设置 OLLAMA_NUM_PARALLEL=1 降低并行度。2) 模型下载到一半断网了,能续传吗?
可以。重新执行
ollama pull 模型名 会自动从断点继续下载,已下载的分片不会重复拉取。3) Ollama 支持 AMD 显卡或核显吗?
支持。Ollama 会自动检测并调用可用的 GPU(NVIDIA / AMD / Apple Silicon)。若想强制走 CPU,可设置环境变量
OLLAMA_NO_CUDA=1(NVIDIA)或 OLLAMA_NO_ROCM=1(AMD)。4) 怎么在局域网其他设备上访问本机 Ollama?
默认只允许本机访问。如需局域网共享,可在设置中打开“Expose Ollama to the network”选项,其他设备用
http://你电脑的IP:11434 即可访问,注意做好防火墙与权限控制。
ICP备案:
公安联网备案: