
LLaMA-Factory
开源大模型微调框架,通过Web界面零代码完成100+模型的SFT、RLHF与QLoRA训练,支持云端算力调度。
在本地或云端运行开源大模型,提供与 OpenAI 兼容的 API,方便集成到各种开发工具和 Agent 中。
Ollama 是一个让开发者能在自己硬件上运行开源大模型的框架。它解决的痛点很直接:你想用 LLM 但又不想把数据交给第三方 API,或者受限于网络和费用。它把模型下载、管理、推理、API 服务全部封装成一套简单的命令行工具,支持 macOS、Windows 和 Linux。
上手比想象中简单。安装后终端里敲一句 `ollama run gemma4`,等模型下载完就能直接对话了。它内置了模型管理,不用自己去找权重文件、处理依赖。更实用的是它提供了一个与 OpenAI 兼容的 REST API,默认跑在 `http://localhost:11434`。这意味着任何原本调用 OpenAI API 的代码或工具,只需要改一下 `base_url` 就能切到本地模型,对想保护数据隐私的开发者来说,这个迁移成本几乎为零。
Ollama 走的是开源+云服务的双轨模式。本地跑模型完全免费,数据不出设备。同时也提供云推理服务,免费账号就能用,Pro 版 $20/月解锁更大的模型和更多的并发。目前已经有超过 900 万开发者在使用,社区生态也相当活跃,官方列出了 40,000 多个集成,从 Claude Code、OpenClaw 到 VS Code、n8n 都有。如果你在找一个兼顾隐私、成本和开发效率的本地 LLM 方案,Ollama 应该是目前最成熟的选择之一。
免费版包含:在自有硬件上无限运行模型、访问云端模型、CLI/API/桌面应用、40,000+ 社区集成、无限公共模型。价格可能随官方调整。
| 套餐 | 价格 | 包含内容 |
|---|---|---|
| Pro | $20/月 或 $200/年 | 免费版全部权益 访问更大、更强的云端模型 同时运行 3 个云端模型 50 倍于免费版的云端使用量 上传和分享私有模型 |
| Max | $100/月(新订阅暂停) | Pro 全部权益 同时运行 10 个云端模型 5 倍于 Pro 的使用量 |
| Team | $25/座/月(5 座起) | 美国及欧洲的云端模型访问 性能高达模型网关的 2 倍 零数据留存与日志 共享计费与管理 优先支持 即将支持:SSO、模型访问控制、Windows/macOS MDM 安装器 |
| Enterprise | 联系销售 | Team 全部权益 批量定价与定制条款 安全与采购支持 部署规划 |
| 对比维度 | Ollama(本工具) | LM Studio | llama.cpp | LocalAI | GPT4All |
|---|---|---|---|---|---|
| 定位 | 本地与云端结合的开源大模型运行框架,兼顾开发者体验与数据隐私 | 图形化界面的本地 LLM 运行工具 | C++ 实现的 LLM 推理引擎 | OpenAI API 兼容的本地推理服务器 | 面向普通用户的本地 LLM 桌面应用 |
| 核心优势 | OpenAI 兼容 API 让现有代码零成本迁移;40,000+ 集成生态覆盖主流开发工具和自动化平台;本地运行数据完全私有;云服务提供弹性扩展选项;CLI 和 SDK 覆盖从原型到生产的全流程 | 界面友好,适合非技术用户,支持多模型切换 | 轻量、高效、支持多种硬件加速 | 支持多种模型格式,API 兼容性好 | 安装简单,开箱即用,有图形界面 |
| 主要短板 | 本地运行依赖用户硬件性能;Max 计划新订阅暂停影响高频云用户;中文文档和社区支持相对有限 | 缺乏 API 服务和命令行自动化能力 | 需手动管理模型和配置,缺乏统一的 API 服务 | 配置相对复杂,生态不如 Ollama 活跃 | 模型选择有限,缺乏 API 和开发者生态 |
| 价格 | 本地使用免费 / 云服务免费版可用 / Pro $20/月 / Max $100/月(暂停新订) / Team $25/座/月 / Enterprise 联系销售 | 免费 | 开源免费 | 开源免费 | 免费 |
| 适合谁 | 需要在本地或自建环境中运行开源大模型的开发者、科研团队及对数据隐私有要求的企业 | 需要图形界面运行本地模型的普通用户 | 追求极致性能和轻量部署的技术专家 | 需要 OpenAI API 兼容层的自部署用户 | 想在本地试用 LLM 的普通用户 |







