vram.run Models Hardware Providers Cloud State of Inference
API provider data is live · Hardware & cloud pricing curated 2026-02-23

Together AI

34 live models

Models

ModelTaskParams
stable-diffusion-xl-base-1.0text-to-image
whisper-large-v3automatic-speech-recognition1.5B
FLUX.1-schnelltext-to-image
DeepSeek-V4-Protext-generation862B
gpt-oss-120btext-generation120B
gpt-oss-20btext-generation21.5B
Meta-Llama-3-8B-Instructtext-generation8.0B
gemma-4-31B-itimage-text-to-text32.7B
Llama-3.3-70B-Instructtext-generation70.6B
Qwen-Imagetext-to-image
GLM-5text-generation754B
FLUX.2-devimage-to-image
GLM-5.1text-generation754B
GLM-5.2text-generation753B
Qwen3.5-9Bimage-text-to-text9.7B
Qwen3.5-397B-A17Bimage-text-to-text403B
Kimi-K2.6image-text-to-text1059B
Qwen2.5-7B-Instructtext-generation7.6B
MiniMax-M2.7text-generation229B
MiniMax-M3image-text-to-text427B
Kimi-K2.7-Codeimage-text-to-text1059B
parakeet-tdt-0.6b-v3automatic-speech-recognition627M
gemma-3n-E4B-itimage-text-to-text7.8B
Qwen3-235B-A22B-Instruct-2507text-generation235B
Wan2.2-I2V-A14Bimage-to-video
multilingual-e5-large-instructfeature-extraction560M
nemotron-3.5-asr-streaming-0.6bautomatic-speech-recognition
Wan2.2-T2V-A14Btext-to-video
rnj-1-instructtext-generation8.3B
NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4text-generation335B
Llama-Guard-4-12Bimage-text-to-text12.0B
cogito-671b-v2.1text-generation671B
cogito-671b-v2.1-FP8text-generation671B
Gemma-4-31B-it-pearlimage-text-to-text31.3B
Install CLI [email protected] Raw data · MIT · API data: live · HW/Cloud data: curated 2026-02-23 · v0.6.0