本文根据 Baseten 官网定价页整理,资料核对于 2026-10-11。功能与价格以官网为准。
是什么
Baseten 是一家做模型推理基础设施的公司,定价页的口号是「不会拖垮你的产品、也不会拖垮你的预算的生产级推理」。它解决的问题是:把开源模型或自己训练的模型,稳定、快速地跑成线上服务,由平台负责 GPU、扩缩容和性能优化。
能做什么
定价页列出的产品:
- Model APIs:直接调用预先优化好的模型,这些模型运行在官方所说的 Baseten Inference Stack 上,不需要自己部署。
- Dedicated Deployments(专属部署):把自己的模型部署到独占的计算资源上,只为实际使用的计算付费,精确到分钟。
- Training(训练):按需提供的训练计算资源和配套开发工具。
- Truss:Baseten 的开源模型打包与服务标准,官方称适用于任意框架构建的模型。
导航里还有 Dedicated Inference、Model Labs 等条目,页面未展开说明。
怎么上手
- 在 baseten.co 注册账号,新账号会获得一笔试用额度。
- 最快的方式是先用 Model APIs:在控制台生成 API Key,挑一个现成的模型发请求。
- 要部署自己的模型,按官方文档用 Truss 打包,再推送到 Baseten,选择实例规格。
- 在控制台观察延迟、吞吐和费用,调整自动扩缩容设置。
打包与部署命令以官方文档为准。
免费与付费
定价页的说明(美元,2026-10 查询):
| 方案 | 月费 | 说明 |
|---|---|---|
| Basic | 0 美元/月,按量付费 | 入门方案 |
| Pro | 页面未标价 | 提供用量折扣 |
| Enterprise | 页面未标价 | 提供用量折扣,联系销售 |
- 专属部署按实例类型以分钟或小时计价;常见问题里说明只在模型占用计算资源时收费(包括部署和扩容过程),空闲时不计费。
- Model APIs 的各模型单价、GPU 实例单价见定价页,这里不逐项抄录。
适合谁 / 不适合谁
适合: 要把开源模型或自研模型做成线上功能、对延迟和稳定性有要求的产品团队;不想自建 GPU 集群和推理优化团队的创业公司。
不适合: 只是想体验一下模型的个人用户(聊天类产品或聚合平台更省事);主要调用闭源大模型 API 的应用;预算极低、只做离线小实验的场景。
注意事项
- 专属部署如果设置了最小副本数不为零,就会持续计费;缩到零又会带来冷启动。
- 自己部署的模型要遵守模型许可证,是否可商用需自行确认。
- 试用额度的金额和有效期页面没有写明,以注册后控制台显示为准。
0 条评论
还没有评论,来抢沙发~