选型要点
- 训练数据从哪里来,训练前如何审核。
- 可以微调哪些基础模型,用哪种方法(LoRA 还是全量)。
- 每训练 Token 的价格,以及微调后模型的推理成本。
- 微调后的模型如何进入生产环境——一个 API 端点,还是智能体本来就能选用的模型。
这 8 款工具
- 1.
2pm.space
我们的产品内置于收件箱的微调:为智能体的回复评分并修正,在 Llama、Qwen 和 Mistral 等开放权重模型上训练 LoRA 适配器,然后在任意智能体的模型列表中选用——从同一份额度中扣费。
- 最适合
- 用真实对话微调客服或销售智能体的团队
- 价格
- 所有功能免费——你只需为使用的 AI 付费,按模型提供商的原价计费
- 2.
Together AI
云服务,对 Llama、Qwen、Gemma 和 DeepSeek 等开放权重模型进行监督微调和偏好微调(DPO),按处理的 Token 计费,可部署到 Together 的推理平台。
- 最适合
- 通过 API 微调和托管开放权重模型的开发者
- 价格
- $0.34 /百万训练 Token 起
- 3.
Fireworks AI
在 Fireworks 推理云上对开放模型进行托管微调(LoRA 及全参数 SFT/DPO),另有按 GPU 小时计费的训练;微调后的模型按基础模型价格提供推理。
- 最适合
- 微调开放模型并大规模提供服务的团队
- 价格
- $0.50 /百万训练 Token 起
- 4.
Amazon Bedrock
AWS 服务,对 Amazon Nova、Titan、Llama、Cohere、gpt-oss 和 Qwen 等 Bedrock 模型进行监督微调、强化微调和持续预训练,按训练 Token 或小时计费。
- 最适合
- 在自己的 AWS 账户内定制基础模型的 AWS 团队
- 价格
- $0.0004 /千训练 Token 起 (Titan Text Lite)
- 5.
Google Gemini Enterprise Agent Platform (Vertex AI)
Google Cloud 为 Gemini 模型以及 Gemma、Llama 和 Qwen 等开放模型提供的监督、偏好和强化微调,现属于 Gemini Enterprise Agent Platform(原 Vertex AI)。
- 最适合
- 微调 Gemini 或开放模型的 Google Cloud 团队
- 价格
- $0.28 /百万训练 Token 起 (Llama 3.2 1B)
- 6.
Replicate
用于运行、微调和部署开源模型的 API 平台,按硬件使用秒数计费;微调以 FLUX 等图片模型为主。Replicate 于 2025 年 11 月加入 Cloudflare。
- 最适合
- 通过 API 微调 FLUX 等图片模型的开发者
- 价格
- $0.000225 /GPU 秒 起 (Nvidia T4)
- 7.
Unsloth
开源免费套餐开源框架(核心为 Apache-2.0,Studio 界面为 AGPL-3.0),让 LLM 微调和本地推理更快、更省显存,Pro 和 Enterprise 档位价格需询价。
- 最适合
- 在自己的 GPU 上微调开放模型的开发者
- 价格
- 开源,可免费自托管
- 8.
Axolotl
开源免费套餐免费、采用 Apache-2.0 许可证的开源框架,通过 YAML 配置对 LLM 进行微调和后训练(LoRA、QLoRA、全量微调、偏好和强化学习方法),在自有或租用的 GPU 上运行。
- 最适合
- 在自有基础设施上微调开放模型的机器学习工程师
- 价格
- 开源,可免费自托管
常见问题
像 Claude 这样的托管模型不支持客户进行 LoRA 微调。2pm.space 上的微调使用 Llama、Qwen、Mistral 和 gpt-oss 等开放权重基础模型。
在 2pm.space 上,来自你的收件箱:你点赞的回复,以及你用“改进”写下的修正。每个问答对都要等你纳入后才会被导出。
在 2pm.space 上不会——数据集训练出的适配器只属于你的工作区。训练本身在 Together AI 上运行,事先会清除手机号和邮箱。
我们如何核实
本页的每一段描述都来自厂商自己的公开网站,核实日期为 2026年10月4日。产品和价格会变化,请到各厂商网站查看最新版本——如果这里有内容已经过时,请告诉我们,我们会更正。
价格为各厂商公布的付费套餐起步标价,不含税费和附加项;部分为按年计费价格。请到厂商的价格页面查看你所需的套餐。
产品名称和商标归其各自所有者所有。2pm.space 与本页提及的公司没有关联,也未获得其背书。