Official site · 🇺🇸 United States
| Model | Intelligence | tok/s | $/M in | $/M out | $ / session | Cache |
|---|---|---|---|---|---|---|
| Muse Glimmer | 17.5 | 144.9 | $0.35 | $1.50 | — | — |
| Muse Spark 1.1 | 33.7 | — | $1.25 | $4.25 | — | — |
| Muse Spark 1.2 | 39.6 | — | $1.25 | $4.25 | — | — |
| Llama 4 Maverick | 10.0 | 78.5 | $0.19 | $0.65 | — | — |
| Llama 4 Scout | 8.1 | 104.7 | $0.10 | $0.30 | — | — |
| Muse Spark 1.3 | 48.1 | 157.5 | $1.25 | $4.25 | — | — |
3 endpoints, cheapest first. This is the view the model-by-model tables cannot give you: what one provider actually offers, and at what precision.
| Model | Quant | $/M in | $/M out | Context | Uptime 30m |
|---|---|---|---|---|---|
| Muse Spark 1.1 | unknown | $1.25 | $4.25 | 1,048,576 | — |
| Muse Spark 1.2 | unknown | $1.25 | $4.25 | 1,048,576 | 100.0% |
| Muse Spark 1.3 | unknown | $1.25 | $4.25 | 1,048,576 | 99.7% |
Everyone serving these models, cheapest first, with the numeric precision each one runs. The lab is often not the cheapest place to buy its own model.
| Model | Served by | Quant | $/M in | $/M out | Uptime 30m |
|---|---|---|---|---|---|
| Muse Glimmer | Phala | unknown | $0.30 | $1.10 | 100.0% |
| Muse Glimmer | DeepInfra | bf16 | $0.30 | $1.20 | 100.0% |
| Muse Glimmer | Together | unknown | $0.35 | $1.50 | 100.0% |
| Muse Spark 1.1 | Meta | unknown | $1.25 | $4.25 | — |
| Muse Spark 1.2 | Meta | unknown | $1.25 | $4.25 | 100.0% |
| Llama 4 Maverick | DigitalOcean | unknown | $0.19 | $0.65 | 99.9% |
| Llama 4 Maverick | Novita | fp8 | $0.27 | $0.85 | 98.9% |
| Llama 4 Maverick | Parasail | fp8 | $0.35 | $1.00 | 99.9% |
| Llama 4 Maverick | unknown | $0.35 | $1.15 | — | |
| Llama 4 Scout | DeepInfra | fp8 | $0.10 | $0.30 | 99.8% |
| Llama 4 Scout | Novita | bf16 | $0.18 | $0.59 | 99.9% |
| Llama 4 Scout | unknown | $0.25 | $0.70 | — | |
| Muse Spark 1.3 | Meta | unknown | $1.25 | $4.25 | 99.7% |