vram.run Models Hardware Providers Cloud State of Inference
API provider data is live · Hardware & cloud pricing curated 2026-02-23

Fireworks

13 live models

Models

ModelTaskParams
DeepSeek-V4-Protext-generation862B
gpt-oss-120btext-generation120B
gpt-oss-20btext-generation21.5B
Kimi-K2.5image-text-to-text1059B
GLM-5.1text-generation754B
GLM-5.2text-generation753B
DeepSeek-V4-Flashtext-generation158B
Kimi-K2.6image-text-to-text1059B
MiniMax-M2.7text-generation229B
MiniMax-M3image-text-to-text427B
Kimi-K2.7-Codeimage-text-to-text1059B
NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4text-generation335B
GLM-5.1-FP8text-generation754B
Install CLI [email protected] Raw data · MIT · API data: live · HW/Cloud data: curated 2026-02-23 · v0.6.0