Announcing our Series D and $1B ARR

Model Library
/OpenAI/OpenAI gpt-oss-20b
OpenAi Logo MArk

OpenAI gpt-oss-20b

Ready
model path:accounts/fireworks/models/gpt-oss-20b

Welcome to the gpt-oss series, OpenAI's open-weight models designed for powerful reasoning, agentic tasks, and versatile developer use cases. gpt-oss-20b is used for lower latency, and local or specialized use-cases.

OpenAI gpt-oss-20b API Features

Serverless

Docs

OpenAI gpt-oss-20b is available via Fireworks' serverless API, where you pay per token. There are several ways to call the Fireworks API, including Fireworks' Python client, the REST API, or OpenAI's Python client.

On-demand Deployment

Docs

On-demand deployments allow you to use OpenAI gpt-oss-20b on dedicated GPUs with Fireworks' high-performance serving stack with high reliability and no rate limits.

Available Serverless

Run queries immediately, pay only for usage

$0.07 / $0.04 / $0.30
Per 1M Tokens (input/cached input/output)

gpt-oss-20b FAQs

Metadata

State
Ready
Created on
8/4/2025
Kind
Base model
Provider
OpenAI
Hugging Face
openai/gpt-oss-20b

Specification

Calibrated
No
Mixture-of-Experts
Yes
Parameters
20.9B

Supported Functionality

Fine-tuning
Not supported
Serverless
Supported
Context Length
131k tokens
Function Calling
Not supported
Embeddings
Not supported
Rerankers
Not supported
Support image input
Not supported