Model Spend Arena2ND ED.
inference-host · 2026-10-03

OVHcloud AI Endpoints

Official site ↗ · 🇫🇷 France

inference-host

Serves: open-weight, EU — Llama 3.3 70B, Qwen (3.8/3.6/3.5/2.5-VL) y gpt-oss. SIN DeepSeek V4, sin GLM y sin Kimi, y desde 2026 tampoco Mistral, Codestral, Devstral ni Qwen3 Coder.
Billing unit: tokens (per 1M, priced in EUR)
Converts to tokens: full
Verifiable pre-pay: yes
Pricing / discount: sign-up credit for new Public Cloud projects; some models free; discounted batch tier

France-based (OVHcloud, Roubaix), 'a leading European provider of sovereign cloud services since 1999', con ISO 27000, SOC y certificaciones sanitarias en la plataforma, retencion cero y el compromiso de no entrenar con tus datos. AVISO 2026-09-13: la ficha afirmaba 'GDPR / EU data residency, served from Gravelines' y ninguna de esas dos cosas aparece ya en la pagina; pasan a no confirmadas. El motivo para descartarlo en codigo se sostiene, pero ha cambiado: antes era que faltaba el SOTA abierto; ahora ademas han caido Mistral entero, Qwen3 Coder 30B y el distill de DeepSeek, asi que la unica opcion de codigo que queda es gpt-oss-120b. Precios en EUROS, el coste en dolares flota con el cambio. Batch con 50% de descuento. Incoherencia del propio OVH: su FAQ comercial sigue diciendo 'Llama, Qwen, Deepseek y mas de 40 modelos' mientras el catalogo ensena 20 y ningun DeepSeek. 2026-09-18: el catalogo con precio se queda en ocho modelos (Qwen3.8-27B, Qwen3.6-27B, Qwen3.5-397B, Qwen3.5-9B, gpt-oss-120b y 20b, Llama 3.3 70B, Qwen2.5-VL-72B); salen Qwen3 Coder 30B, Qwen3 32B y Mistral Small 3.2. 2026-09-24: catalogo en 20 entradas, los ocho de texto con el MISMO precio que la semana pasada. Nuevos: Qwen3-Embedding-8B a 0,1 EUR y dos guardas en beta gratis (Qwen3Guard-Gen-8B y 0.6B), lo que respalda el 'algunos modelos gratis'. Sigue sin DeepSeek, GLM, Kimi ni Mistral, y GDPR y Gravelines siguen sin aparecer: segunda semana sin confirmar.

What it charges

List price per model (input / output per 1M tokens, EUR), for the models it actually serves — the detail the five-model comparison table cannot show. Prices as published by the host; re-verify before relying on them.

ModelPrice in / outQuant
gpt-oss-120b€0.08 / €0.40—
gpt-oss-20b€0.04 / €0.15—
Llama 3.3 70B€0.67—
Qwen3.5 397B A17B€0.60 / €3.60—
Qwen3.8 27B€0.40 / €2.70—
Qwen3.6 27B€0.40 / €2.70—
Qwen3.5 9B€0.10 / €0.15—