Providerfireworks-ai
Fireworks AI
npm install @ai-sdk/openai-compatible
13 Available ModelsOfficial Documentation ↗
Endpoint: https://api.fireworks.ai/inference/v1/
Hosted Models
| Model | Lab | Context | Input / 1M | Output / 1M | Action |
|---|---|---|---|---|---|
| Nvidia Nemotron 3 Ultra 550B accounts/fireworks/models/nemotron-3-ultra-nvfp4 | NVIDIA | 262,144 | $0.60 | $2.40 | Specs & Providers → |
| Kimi K3 accounts/fireworks/models/kimi-k3 | Moonshot AI | 1,048,576 | $3.00 | $15.00 | Specs & Providers → |
| Qwen3.8 2.4T A95B accounts/fireworks/models/qwen3p8-2p4t-a95b | Alibaba | 262,144 | $2.00 | $6.00 | Specs & Providers → |
| Ember-1 accounts/fireworks/models/ember-1 | Accounts | 1,048,576 | $3.00 | $15.00 | Specs & Providers → |
| DeepSeek V4.1 Flash accounts/fireworks/models/deepseek-v4p1-flash | DeepSeek | 1,000,000 | $0.30 | $1.20 | Specs & Providers → |
| GLM-5.3 accounts/fireworks/models/glm-5p3 | Zhipu AI | 1,048,573 | $1.40 | $4.40 | Specs & Providers → |
| Nvidia Nemotron 3.5 Lightning TEE accounts/fireworks/models/nemotron-lightning-3p5-30b-a3b | NVIDIA | 262,144 | $0.05 | $0.20 | Specs & Providers → |
| Inkling accounts/fireworks/models/inkling | Thinkingmachines | 1,048,576 | $1.00 | $4.05 | Specs & Providers → |
| MiniMax-M3 accounts/fireworks/models/minimax-m3 | Accounts | 512,000 | $0.30 | $1.20 | Specs & Providers → |
| GLM-5.3-Flash accounts/fireworks/models/glm-5p3-flash | Zhipu AI | 1,048,573 | $0.15 | $0.50 | Specs & Providers → |
| GPT OSS 120B accounts/fireworks/models/gpt-oss-120b | Accounts | 131,072 | $0.15 | $0.60 | Specs & Providers → |
| Qwen3.8 Max accounts/fireworks/models/qwen3p8-max | Alibaba | 262,144 | $2.00 | $6.00 | Specs & Providers → |
| MiniMax-M3 accounts/fireworks/routers/minimax-latest | MiniMax | 512,000 | $0.30 | $1.20 | Specs & Providers → |