RRaddar
Providerfireworks-ai

Fireworks AI

npm install @ai-sdk/openai-compatible

13 Available ModelsOfficial Documentation ↗
Endpoint: https://api.fireworks.ai/inference/v1/

Hosted Models

ModelLabContextInput / 1MOutput / 1MAction
Nvidia Nemotron 3 Ultra 550B

accounts/fireworks/models/nemotron-3-ultra-nvfp4

NVIDIA262,144$0.60$2.40Specs & Providers →
Kimi K3

accounts/fireworks/models/kimi-k3

Moonshot AI1,048,576$3.00$15.00Specs & Providers →
Qwen3.8 2.4T A95B

accounts/fireworks/models/qwen3p8-2p4t-a95b

Alibaba262,144$2.00$6.00Specs & Providers →
Ember-1

accounts/fireworks/models/ember-1

Accounts1,048,576$3.00$15.00Specs & Providers →
DeepSeek V4.1 Flash

accounts/fireworks/models/deepseek-v4p1-flash

DeepSeek1,000,000$0.30$1.20Specs & Providers →
GLM-5.3

accounts/fireworks/models/glm-5p3

Zhipu AI1,048,573$1.40$4.40Specs & Providers →
Nvidia Nemotron 3.5 Lightning TEE

accounts/fireworks/models/nemotron-lightning-3p5-30b-a3b

NVIDIA262,144$0.05$0.20Specs & Providers →
Inkling

accounts/fireworks/models/inkling

Thinkingmachines1,048,576$1.00$4.05Specs & Providers →
MiniMax-M3

accounts/fireworks/models/minimax-m3

Accounts512,000$0.30$1.20Specs & Providers →
GLM-5.3-Flash

accounts/fireworks/models/glm-5p3-flash

Zhipu AI1,048,573$0.15$0.50Specs & Providers →
GPT OSS 120B

accounts/fireworks/models/gpt-oss-120b

Accounts131,072$0.15$0.60Specs & Providers →
Qwen3.8 Max

accounts/fireworks/models/qwen3p8-max

Alibaba262,144$2.00$6.00Specs & Providers →
MiniMax-M3

accounts/fireworks/routers/minimax-latest

MiniMax512,000$0.30$1.20Specs & Providers →