本文根据 Together AI 官网与定价页整理,资料核对于 2026-10-11。模型与价格变化快,以官网为准。
是什么
Together AI 是一家做 AI 基础设施的公司,定位是「运行和定制 AI 模型的平台」。和 OpenAI、Anthropic 这类只卖自家模型的厂商不同,它主要托管开源模型和第三方模型:你不需要自己买显卡、部署服务,调一个 API 就能用上这些模型,按用量付费。
国内搜索它的人不少是在找工作或了解公司背景;如果你是开发者,更值得关心的是它能帮你省掉哪些运维工作。
提供什么
官网定价页把产品分成四类:
- Serverless Inference(无服务器推理):按用量调用现成模型,覆盖对话、视觉、图像、音频、视频、向量等类型;
- Dedicated Inference(专属推理):单租户的 GPU 端点,按 GPU 小时计费,适合流量稳定、要求延迟可控的业务;
- Fine-Tuning(微调):LoRA 微调和全量微调,按每百万 Token 计费;
- GPU Clusters(GPU 集群):按需或预留的 GPU 算力,按小时计费,用于自己训练模型。
怎么上手
- 在 together.ai 注册账号,进入控制台创建 API Key。
- 在模型库里选模型,先在 Playground 里试效果。
- 用官方 SDK 或 OpenAI SDK 调用——把 base_url 换成 Together 的接口地址、模型名换成模型库里的标识即可(具体地址以官方文档为准)。
- 用量稳定后,再评估是否换成专属端点。
免费与付费
无服务器推理的文本模型按每百万 Token(输入 / 输出)计价。定价页上的几个例子(美元,2026-10 查询):
| 模型 | 输入 | 输出 |
|---|---|---|
| MiniMax M3 | 0.30 | 1.20 |
| GLM-5.3-Flash | 0.15 | 0.50 |
| gpt-oss-120B | 0.15 | 0.60 |
页面有「Start for free」入口,但没有写明新账号的赠送额度,以注册后控制台显示为准。专属端点、微调和 GPU 集群各有单独的价目。
适合谁 / 不适合谁
适合:
- 想在产品里使用开源模型、又不想自己运维 GPU 的开发团队;
- 需要对开源模型做微调并直接托管上线的团队;
- 做模型对比评测、需要一个入口调用多种开源模型的研究者。
不适合:
- 只想聊天、不写代码的普通用户;
- 只用 GPT、Claude、Gemini 等闭源旗舰模型的团队,直接用原厂 API 即可;
- 要求数据必须留在中国境内的业务,应选择国内云厂商的模型服务。
注意事项
- 同名模型,不同平台表现可能不同:量化方式、上下文长度、是否支持工具调用,各托管平台不完全一致,上线前自己测。
- 模型会上下架:开源模型更新快,平台会淘汰旧模型,代码里不要把模型名写死在多处。
- 计费单位要看清:图像、视频、音频模型不是按 Token 计费。
- 访问与支付:需要能使用其服务的网络环境和支持的付款方式,以官网为准。
0 条评论
还没有评论,来抢沙发~