Together AI

Together AI

托管开源与开放权重模型,按 token 计费

提示工程AI 开发免费增值闭源

核心功能

Together AI 是专注开源与开放权重模型的推理平台,托管 Llama、Qwen、DeepSeek、GLM、Gemma、Mistral、Kimi 等,提供 Serverless、Batch 与专用三种部署。按 token 计费、无订阅,注册送 5 美元额度;也提供向量、重排、图像与视频生成。

功能亮点

开源模型库

Llama/Qwen/DeepSeek 等

Serverless

按需扩缩无需自备算力

Batch 降本

异步批量省最多五成

专用实例

预留隔离算力保低延迟

自定义模型 / 模型接入

开源模型推理

托管 Llama、Qwen、DeepSeek、GLM 等开源与开放权重模型,Serverless/Batch/专用三种部署,按 token 计费无订阅。

接入方式
  • REST API
  • Python SDK
  • OpenAI 兼容
支持模型
Llama 3.3 70BQwen3.7-MaxDeepSeek V4 ProGLM-5.2Gemma 4 31BKimi K3MistralNemotron 3 UltraMiniMax M3GPT-OSS 120B
bash
pip 装 together 后设 api_key,调用 chat.completions 即可

适用场景

• 开源模型生产推理
• 大规模数据集批处理
• 低成本替代闭源 API

安装配置

bash
pip install together 并设 TOGETHER_API_KEY,调用 together.chat.completions.create 即可;也兼容 OpenAI 客户端 base_url 指向 api.together.xyz/v1。

使用方法

bash
1) 在 together.ai 注册,领 5 美元免费额度并创建 API Key
2) pip install together,设 TOGETHER_API_KEY 环境变量
3) 调 together.chat.completions.create,model 填 "meta-llama/Llama-3.3-70B" 等开源模型
4) 大批量离线任务用 Batch 接口异步跑,成本最高降 50%
5) 延迟敏感场景建 Dedicated Endpoint 预留隔离算力

关键指标

尚未核验对标产品,此处只列本工具自身指标,不做对比结论。

指标Together AI
价格免费增值
开源
上手难度入门
Token 消耗

相关工具

优点

  • 开源模型选择广且可自托管思路
  • Serverless 免去运维
  • Batch 大幅降本
  • OpenAI 兼容易迁移

缺点

  • 闭源前沿模型需另接别家
  • 大上下文模型单价仍不低
  • 速率与可用性随用量
  • 企业批量折扣需谈销售