`gpt-oss-120b`is our most powerful open-weight model, which fits into a single H100 GPU (117B parameters with 5.1B active parameters).
| Provider | Input | Output | Since launch |
|---|---|---|---|
| DeepInfracheapest | $0.04 | $0.17 | ↓5% |
| OpenRoutercheapest | $0.04 | $0.17 | ↓5% |
| Cloudflare AI Gateway | $0.04 | $0.19 | — |
| Novita AI | $0.05 | $0.25 | — |
| Groq | $0.15 | $0.6 | — |
| SambaNova Cloud | $0.22 | $0.59 | — |
| Cerebras | $0.35 | $0.75 | — |
| Vercel AI Gateway | $0.35 | $0.75 | — |
| Model | Context | Max out | Pricing |
|---|---|---|---|
| OpenAI: gpt-oss-20b:free | — | — | |
| OpenRouter: openai/gpt-oss-120b:free | — | — | |
| OpenRouter: openai/gpt-oss-20b:free | — | — | |
| OpenAI: gpt-oss-20b | 131K | 131K | $0.03$0.14 |
| OpenRouter: openai/gpt-oss-20b | — | — | $0.03$0.14 |
| OpenAI: gpt-oss-120b | 131K | 131K | $0.04$0.19 |
| OpenRouter: openai/gpt-oss-120b | — | — | $0.04$0.19 |
| OpenAI: gpt-oss-120b:exacto | — | — | $0.05$0.24 |
| OpenRouter: openai/gpt-oss-120b:exacto | — | — | $0.05$0.24 |
| Google Vertex AI: openai/gpt-oss-20b-maas | — | — | $0.07$0.25 |
| Groq: openai/gpt-oss-20b | — | — | $0.08$0.3 |
| OpenAI: gpt-oss-safeguard-20b | — | — | $0.08$0.3 |
| OpenRouter: openai/gpt-oss-safeguard-20b | — | — | $0.08$0.3 |
| Google Vertex AI: openai/gpt-oss-120b-maas | — | — | $0.09$0.36 |
| Baseten: openai/gpt-oss-120b | — | — | $0.1$0.5 |
| Groq: openai/gpt-oss-120b | — | — | $0.15$0.6 |
| Cerebras: gpt-oss-120b | — | — | $0.25$0.69 |
| cerebras: gpt-oss-120b | — | — | $0.25$0.69 |
/v1/models/cloudflare-ai-gateway/openai/gpt-oss-120b`gpt-oss-120b`is our most powerful open-weight model, which fits into a single H100 GPU (117B parameters with 5.1B active parameters).