Model Spend Arena2ND ED.
inference-host · 2026-10-03

Scaleway Generative APIs

Official site ↗ · 🇫🇷 France

inference-host

Serves: open-weight, EU-sovereign — Llama, Mistral, Qwen3, gpt-oss, y DESDE 2026 deepseek-v4-flash-0731. Nuevos: qwen3.5-397b-a17b y gemma-4-26b-a4b-it.
Billing unit: tokens (per 1M, priced in EUR)
Converts to tokens: full
Verifiable pre-pay: yes
Pricing / discount: first 1M tokens free; Batch API -50%

France-based, Paris only: 'all models are hosted in secure data centers in France', y declaran que no leen ni reutilizan tus prompts. CORREGIDO 2026-09-13: la ficha decia 'DeepSeek R1 distills only, no DeepSeek V4' y ya no es cierto — sirve deepseek-v4-flash-0731 a 0,40 EUR de entrada y 0,80 de salida (0,08 cacheado). Precios en EUROS, asi que el coste normalizado a dolares flota con el cambio. Batch con 50% de descuento, literal. SIN CONFIRMAR si siguen Devstral 2, Mistral Large 3 y MiniMax-M2.5: no salen en la tabla de precios de hoy, pero tampoco consta que se hayan retirado. 2026-09-24: precios identicos, y aparecen dos que faltaban en esta ficha: Gemma 4 26B A4B (0,25/0,50 EUR) y Pixtral 12B (0,20). El millon de tokens gratis se confirma literal. Devstral 2, Mistral Large 3 y MiniMax-M2.5 siguen sin salir: segunda semana sin confirmar. Y el -50% de Batch ya NO sale con cifra, solo como 'descuento adicional', asi que deja de ser literal. 2026-10-02: vuelta atras de la nota pasada, el -50% de Batch VUELVE a estar literal: 'All requests performed using Batches API are priced with a -50% discount'. Los 16 modelos con precio, identicos. Faltan en esta ficha dos embeddings con precio: qwen3-embedding-8b y bge-multilingual-gemma2, los dos a 0,10 EUR con salida gratis. Devstral 2, Mistral Large 3 y MiniMax-M2.5 siguen fuera: tercera semana sin confirmar.

What it charges

List price per model (input / output per 1M tokens, EUR), for the models it actually serves — the detail the five-model comparison table cannot show. Prices as published by the host; re-verify before relying on them.

ModelPrice in / outQuant
GLM-5.2€1.80 / €5.50fp8
Qwen3 Coder 30B A3B€0.20 / €0.80fp8
Qwen3.6 35B A3B€0.25 / €1.50—
Qwen3 235B A22B€0.75 / €2.25—
Mistral Small 3.2 24B€0.15 / €0.35—
Mistral Medium 3.5€1.50 / €7.50—
Llama 3.3 70B€0.90—
gpt-oss-120b€0.15 / €0.60fp4
Qwen3.8 27B€0.60 / €3.30—
Gemma 4 26B A4B€0.25 / €0.50—
Pixtral 12B (2409)€0.20 / €0.20—