Ollama是开源AI模型运行平台,刚完成$88M融资,服务8.9M开发者。本地运行完全免费,云端提供免费轻量模型试用。Pro版$20/月享50倍用量+3并发,Max版$100/月享10并发。支持GLM、Nemotron、DeepSeek、Kimi、MiniMax等云端模型。
Ollama是一个开源的AI模型运行平台,核心理念是让任何人都能轻松地在自己的设备上运行大型语言模型。它的创始人Michael和Andrew曾在2015年创立Kitematic(Docker收购),随后又开发了Docker Desktop,服务超过1000万开发者。
Ollama的核心优势在于三个原则:
Ollama最核心的免费功能是在本地运行开源AI模型。只要你有一台电脑,就可以:
安装:
curl -fsSL https://ollama.com/install.sh | sh
使用:
ollama run llama3.2
ollama run qwen2.5
ollama run mistral
Windows用户可以直接下载安装包。所有公开模型完全免费,没有任何使用次数限制,不限制token数量,不限制对话轮数。
Ollama的云端服务为免费用户提供了轻量级模型的访问权限。
免费云端核心参数:
| 项目 | 免费层规格 |
|---|---|
| 费用 | $0/月,永久免费 |
| 并发模型数 | 1个 |
| 可用模型等级 | Level 1(轻量模型) |
| 会话限制 | 每5小时重置 |
| 周限制 | 每7天重置 |
| 计费方式 | 按GPU使用时间计算,非按token计数 |
免费云端可用模型包括gpt-oss:20b等Level 1轻量模型,适合日常对话、编码辅助和AI助手功能。
Pro计划 - $20/月(或$200/年):
| 功能 | Pro版 | 免费版 |
|---|---|---|
| 云端用量 | 免费层的50倍 | 基础轻量用量 |
| 并发模型数 | 3个 | 1个 |
| 模型等级 | 更大、更强力的云端模型 | 仅Level 1 |
| 私有模型 | 可上传和分享 | 不支持 |
Max计划 - $100/月:
| 功能 | Max版 | Pro版 |
|---|---|---|
| 云端用量 | Pro版的5倍(免费层的250倍) | 免费层的50倍 |
| 并发模型数 | 10个 | 3个 |
Ollama云端支持以下主要模型系列:
模型使用等级从Level 1(轻量)到Level 4(超重型)不等。Level 1模型在免费版中可用。
Ollama提供OpenAI兼容的API接口,本地运行后可以在localhost:11434访问:
curl http://localhost:11434/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"model": "llama3.2",
"messages": [{"role": "user", "content": "你好"}]
}'
Q1:Ollama免费版真的完全免费吗? A:是的。本地运行所有公开模型完全免费,无次数限制、无token限制、无时间限制。云端免费层提供Level 1轻量模型访问,也无需付费。
Q2:免费版有多少使用限制? A:免费版云端限制为:每次会话最长5小时(超时自动重置),每周有总量限制(7天重置),同时只能运行1个云端模型。本地运行无任何限制。
Q3:Ollama的云端模型支持工具调用吗? A:是的。所有经过测试的云端模型都支持工具调用(tool calling)。
Q4:什么时候会达到使用上限? A:你可以在Ollama设置页面随时查看用量。当达到计划的90%时,Ollama会发送电子邮件提醒。
Ollama是开源AI模型运行平台,刚完成$88M融资,服务8.9M开发者。本地运行完全免费,云端提供免费Level 1轻量模型。Pro版$20/月,Max版$100/月。
项目地址:ollama.com
数据截至2026年7月20日。免费政策可能调整。