Ollama 是一款开源工具,用于在本地电脑上运行开源大语言模型(如 Llama、Qwen、DeepSeek、Gemma 等)。它通过一条命令即可完成模型的下载与运行,数据全程保留在本地,无需调用云端 API。除本地使用外,Ollama 还提供云端模型访问服务,可在本地硬件不足以运行大模型时使用。
使用方法
访问网站,下载对应系统的安装包(Windows / macOS / Linux)。
安装后 Ollama 会自动在后台运行,命令行工具同步可用。
打开终端或命令提示符,运行
ollama run <模型名>(如ollama run llama3.2),即可自动下载并启动对话。
无需注册或登录即可使用本地模型功能。
价格体系
本地模型完全免费,开源,无使用限制。
Ollama 也提供云端服务,用于运行超出本地硬件能力的模型。云端方案如下:
免费版:每月赠送少量 starter 模型的调用额度。
Pro:$20/月,包含 $60 的月度使用额度。
Max:$100/月,包含 $300 的月度使用额度。
Team:$500/月,包含 $1,000 的共享月度额度,用户数不限。
云端服务按 token 计费,无服务费,额度用完后可按相同费率继续使用。具体价格以官网当前页面为准。
注意事项
本地运行需要一定的硬件条件:Windows 需 Windows 10 22H2 或更新版本,macOS 需 Sonoma (v14) 或更新版本。内存建议 8GB 以上,使用 GPU 可显著提升速度。
模型文件体积较大,通常从数十 GB 到上百 GB 不等,需预留足够磁盘空间。
本地使用无需联网,下载模型时需要网络连接。
云端服务的模型托管在美国、欧洲及新加坡,数据传输和存储涉及跨境场景。

![Ollama的使用截图[1]](http://duckwow.com/wp-content/uploads/2026/09/Ollama-本地运行开源大语言模型的开源工具.jpg)















