vram.run Models Hardware Providers Cloud State of Inference
API provider data is live · Hardware & cloud pricing curated 2026-02-23

Fireworks vs Together AI

13 vs 34 models, 10 shared

Shared models

ModelFireworks $/1M outFireworks tok/sTogether AI $/1M outTogether AI tok/s
MiniMax-M2.7166 tok/s155 tok/s
MiniMax-M395 tok/s19 tok/s
DeepSeek-V4-Pro47 tok/s57 tok/s
Kimi-K2.692 tok/s176 tok/s
Kimi-K2.7-Code120 tok/s54 tok/s
NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4138 tok/s149 tok/s
gpt-oss-120b182 tok/s107 tok/s
gpt-oss-20b83 tok/s143 tok/s
GLM-5.145 tok/s54 tok/s
GLM-5.251 tok/s111 tok/s
Install CLI [email protected] Raw data · MIT · API data: live · HW/Cloud data: curated 2026-02-23 · v0.6.0