| CometAPI | 🇭🇰 Hong Kong SAR | reseller | GPT-6.1 Sol, GPT-6 Sol y Luna, Claude Sonnet 5.5 / Fable 5.5 / Haiku 5.5 / Opus 5.5, Gemini 4 Argon, Grok 5, DeepSeek V4 Pro, Kimi K3, MiniMax M3.1 Flash, MiMo V2.6 (321 modelos) | tokens (official models) + per-image/clip for media | partial | partial | The most transparent of the resellers here: the 0.8x formula is stated outright, so the effective token price is checkable against the vendor's own list. Still a proxy of closed APIs, so the price is theirs minus 20%, not a first-party price, and no monthly plan. 2026-09-13: la formula sigue intacta. Catalogo ampliado con GPT-6 Astra, Gemini 4, Claude Fable 5.1, GLM 5.3 Flash y Qwen3.8. Contradiccion suya sin resolver: la portada dice '500+ AI Models' y la pagina de modelos dice '295+'. El '20-40% mas barato' de portada es marketing sin formula detras; lo verificable es el 0,8x. 2026-09-18: la pagina de modelos dice ya '298 models available'. DeepSeek V4 Flash a $0,176/$0,528 contra un 'precio oficial' suyo de $0,22/$0,66, que no es el de DeepSeek ($0,14/$0,28): el 0,8x se aplica sobre su propia cifra, no sobre la del laboratorio. Y deepseek-v4-flash-vision-exp sale MAS CARO que su oficial ($0,352/$1,056 contra $0,22/$0,66), en contra del 'at least 20% below'. Kimi K3 a $2,4/$12. 2026-09-24: 314 modelos en su pagina de modelos (la portada sigue diciendo 500+). Vende ya cuatro de los cinco lanzamientos del 21-22 con precio de ENTRADA y el 0,8x clavado: GPT-6 Sol $1,6, GPT-6 Luna $0,08, Claude Opus 5.5 $3,2 y MiMo V2.6 Pro $0,348; Grok 4.7 esta en catalogo sin precio. En Opus 5.5 su 'oficial' si coincide con el de Anthropic. Sus ref_prices NO se han podido reverificar hoy: la tabla rota y no incluye ninguno, la ficha de DeepSeek V4 Pro da 404 y su API pide clave. 2026-10-02: 321 modelos (la portada sigue diciendo 500+). Vende los dos lanzamientos de la semana al 0,8x clavado: GPT-6.1 Sol y Claude Sonnet 5.5 a $1,60/$8 contra el oficial $2/$10. DeepSeek V4 Flash baja a $0,12/$0,48 porque su 'oficial' baja a $0,15/$0,60. Dato que faltaba: 1.000 creditos = $1, y hay credito de prueba gratis sin tarjeta. Sus ref_prices de DeepSeek V4 Pro y GPT-5.6 Sol siguen SIN reverificar por segunda semana: esas fichas ya no existen y redirigen al listado del proveedor. Y publica dos erratas suyas: Fable 5.5 y Haiku 5.5 a $60 por millon contra un oficial de $75, y Kling 4.0 a $60 por millon cuando se cobra por segundo. |
| AIMLAPI | 🇪🇪 Estonia | reseller | 1000+ models. AHORA SI incluye Anthropic: Claude Sonnet 5, Opus 5, Fable 5.1 y 4.5 Sonnet, con precio. Tambien GLM-5.2 y 5.3, DeepSeek V4 Pro, Kimi K3 y K2.5/2.6/2.7 Code, Qwen 3.8 y Qwen3.5 Flash. Desde el 2026-10-02 tambien Claude Sonnet 5.5 y GPT-6.1 Sol. | tokens (per 1M) | full | partial | CORREGIDO 2026-09-13: la ficha decia 'Anthropic models are absent, so it is not a full first-party substitute' y llevaba siete semanas siendo falso. Hoy vende Claude con precio publicado: Sonnet 5 a $2,6 de entrada ($0,26 cacheado) y $13 de salida por millon. Sin descuento declarado sobre el precio oficial. 2026-09-18: confirmados en su pagina de precios GLM-5.2 ($1,82/$5,72) y DeepSeek V4 Pro ($0,5655/$1,131). GPT-5.6 Sol a secas ya no aparece, solo Sol Pro ($5,50/$27,51). 2026-09-24: vende los cinco lanzamientos del 21-22, con precio: GPT-6 Sol $2,6/$13, GPT-6 Luna $0,13/$0,65, Claude Opus 5.5 $5,2/$26, Grok 4.7 $2,6/$7,8 y MiMo-V2.6-Pro $0,598/$1,197. OJO: su Opus 5.5 esta POR ENCIMA del oficial ($4/$20), asi que aqui no hay descuento, hay recargo. Minimo de pago por uso: $20. Contradiccion suya: la pagina de precios dice 880 modelos y la portada 1000+. 2026-10-02: vende los dos lanzamientos de la semana, los dos POR ENCIMA del oficial: Sonnet 5.5 a $2,60/$13 y GPT-6.1 Sol a $2,60/$13, contra $2/$10 de lista. Un 30% de recargo, no un descuento. Y su DeepSeek V4 Pro MAS QUE DOBLA, de $0,5655/$1,131 a $1,17/$3,51. La contradiccion del recuento cambia de cifras: su pagina de precios dice 453 modelos y su API publica 976. |
| APIMart | 🇭🇰 Hong Kong SAR | reseller | 100+ modelos, y desde 2026-10 VUELVEN los LLM de texto con precio por token: Claude (Sonnet 5.5, Opus 5.5, Fable 5.1...), GPT (6.1 Sol, 6 Sol/Luna), DeepSeek, GLM, Kimi, Qwen, MiniMax, Grok, Doubao y Gemini, mas todo el catalogo de imagen y video | credits | full | partial | OpenAI-compatible (base api.apimart.ai/v1), but billed in credits with no published credit-to-token conversion, so the advertised saving cannot be verified before paying. This is the entry that prompted the section. 2026-09-13: `conversion` sube de 'none' a 'partial' — ahora ensenan el credito y el dolar al lado del precio oficial ('2Credits/M~$0.2/M'), de donde se deduce 1 credito ~ $0,10, aunque NO publican la tasa como tal. En cambio el catalogo de TEXTO no se ha movido: siguen GPT-5, GPT-4o, Claude Sonnet 4.5 y DeepSeek 'R1 y V3', sin DeepSeek V4, GLM-5.x, Kimi K3 ni Qwen3.8. Crecen en imagen y video. Se esta quedando atras para codigo. CAMBIO GRAVE 2026-09-24: se ha quedado SIN modelos de texto. Sus 48 fichas de catalogo y las 214 filas de precios son todas de imagen, video o audio; las unicas filas por millon de tokens son la entrada y salida de texto de modelos multimodales de imagen. La nota del 2026-09-13 decia que seguian GPT-5, Claude Sonnet 4.5 y DeepSeek: hoy es falso. Deja de ser una pasarela para codigo. Se mantiene el credito a ~$0,10 deducible y el 20% como norma. VUELTA ATRAS 2026-10-02: la semana pasada se habia quedado sin un solo modelo de texto y hoy los vuelve a vender con precio por token, en paginas por familia (apimart.ai/model/llm/claude, /gpt, /glm...). Sonnet 5.5 a $1,60/$8 y GPT-6.1 Sol a $1,60/$8, los dos el 20% por debajo del oficial, y su 'oficial' si coincide con el de Anthropic y OpenAI, asi que el descuento ya es verificable y la tasa deducible: 1 credito = $0,10. Nuevo: membresia Gold, Platinum y Diamond con un 0%, 5% y 10% adicional, que choca con su propia frase de 'pago por uso sin tramos'; y precio por franja horaria en DeepSeek V4.1 Flash, con hasta el 60% de ahorro en valle. NO se pudieron leer los precios de DeepSeek V4 Pro, V4 Flash ni GLM-5.2: su tabla solo pinta el modelo por defecto y hay que pulsar. |
| EURouter | 🇳🇱 Netherlands | router | 142 modelos, y desde el 2026-10-02 SI con cerrados y con precio publico: Claude por AWS Bedrock (Sonnet 5, Opus 5 y 5.5, Haiku 4.5) y GPT por Microsoft Foundry (5.6 Sol/Terra/Luna, 5.4, 4.1), mas pesos abiertos, Mistral, GreenPT y Apertus | tokens + published markup | full | yes | A Netherlands-based router selling on EU data residency and GDPR rather than price. Notable as the transparent opposite of the credit resellers: it publishes its exact markup per tier and bills real tokens, so the effective price is checkable up front. Base www.eurouter.ai/api/v1. 2026-09-13: cuotas por tramo, que no estaban: Free 10.000 peticiones al mes y 60 por minuto; Plus 1 millon y 100 por minuto; Pro 10 millones y 500 por minuto. Catalogo al dia, anuncian GLM-5.2, Kimi K3 y Opus 5 en vivo. AVISO 2026-09-24: dos cosas de esta ficha dejan de sostenerse. Su banner dice que GLM-5.2, Kimi K3 y Opus 5 estan vivos, y que enruta a GPT-5, Claude y Gemini, pero su propia tabla no los ensena: no digo que no los sirvan, digo que no es verificable. Y el markup del 3-15% sobre el precio oficial tampoco cuadra: publican lista propia por modelo, y su DeepSeek V4 Pro a $1,75/$3,50 es CUATRO VECES el oficial. Otros de su tabla: DeepSeek V4 Flash 0731 $0,13/$0,28, GLM 5.2 $1,10/$4,20, GLM 5.3 $1,47/$4,50, Kimi K3 $3,00/$15,00, Kimi K2.7 Code $0,75/$3,00, MiniMax M3 $0,40/$2,00. Ninguno de los cinco lanzamientos del 21-22. CORREGIDO 2026-10-02: dos avisos de esta ficha ya no valen. Primero, SI vende cerrados y con precio publico; su API (eurouter.ai/api/models, 142 entradas) los publica todos, asi que lo de 'no es verificable' se cae. Segundo, el markup del 3-15% no describe lo que hace: en los cerrados aplica el precio del proveedor por 1,10 (Sonnet 5 a $2,20/$11) y en GPT-5.6 Sol cobra $5,50/$33, que es un 37% y un 65% por encima del oficial. Entra Opus 5.5; Sonnet 5.5 y GPT-6.1 Sol todavia no. Kimi K2.7 Code sube de $3,00 a $3,50 de salida. Su web dice 142 modelos en un sitio y 120+ en otro. |
| ShareAI | — | inference-host | 199 modelos. Ya NO es solo pesos abiertos: vende cerrados de OpenAI y xAI (gpt-6-astra, gpt-5.6-sol, gpt-5.6-terra, grok-4.6, grok-4.3), muchos sin precio por token publicado | tokens | full | partial | Not a closed-API reseller but a decentralized inference marketplace: idle GPUs serve open weights, so its prices are real prices for those models. No GPT or Claude, so limited for coding against the leaders; since 2026-09-13 it does carry one closed model, Gemini 3.5 Flash ('Gemini 3.5 Flash is now available on ShareAI'). Operator HeyShare SRL; country not confirmed. CAMBIO GRAVE 2026-09-24: cruza la linea que describia esta ficha. Vende ya modelos cerrados y PUBLICA EN EUROS, no en dolares: GPT-6 Astra a 9,10 EUR de entrada y 45,50 de salida por millon hasta 272K, y el doble por encima. Matiz importante: muchos cerrados van por 'Token exchange' y su propia ficha dice que no hay precio por token publicado, GPT-5.6 Sol entre ellos. Gemini 3.5 Flash, que se anoto el 2026-09-18, hoy no aparece en su catalogo: no lo doy por retirado, pero no se confirma. Claude no se ha visto. 2026-10-02: sin cambios de precio. Nuevo con precio: gpt-5.4 a 2,21 EUR de entrada y 13,30 de salida por millon. GPT-5.6 Sol y Terra siguen en 'Token exchange' sin precio por token, y Claude sigue sin verse. Gemini 3.5 Flash sigue sin aparecer: tercera semana sin confirmar. Su propio catalogo dio 'We couldn't load the models' y solo pinta las primeras filas, asi que no es legible entero desde fuera. |
| APIMaster | — | reseller | OpenAI, Claude, DeepSeek via "fingerprint-verified channels"; works with Cursor / Claude Code | tokens (shared balance across channels) | partial | false | OpenAI-compatible, but the headline discounts are far beyond a normal reseller margin and no markup is published, only per-"channel" prices that vary. Discounts that large on a closed API usually mean grey-market or quota-farmed capacity, not a straight resale. Company location undisclosed. Treat the savings claim with caution. 2026-09-13: Catalogo muy ampliado (GPT-6 Astra, Claude Sonnet 5, Kimi K3, GLM 5.3 Flash, y DeepSeek V4.1 Flash, ojo, no V4). Confirmado que NO hay creditos gratis: minimo de recarga $1. La cautela sigue justificada — 85-90% de descuento sobre API cerrada, sin markup publicado y con USDT entre los metodos de pago. 2026-09-18: la portada dice 'All discounts are on fingerprint-verified channels — same model, lower cost', y la palabra 'marketplace' no aparece. El minimo de recarga de $1 no se ve en la portada. CAMBIO 2026-09-24: la frase de esta ficha de que NO hay creditos gratis ya no vale. Su portada ofrece $20 de credito GPT en una prueba de 5 dias a precio oficial (GPT 6 Astra, GPT 5.6 y GPT 5.5), un 15% en la primera recarga de $10 y $20 por referido. Catalogo muy ampliado: Opus 5 y 5.5, GPT 6 Sol y Luna, Grok 4.7, MiMo v2.6 Pro, Kimi K2.8 Preview y K3, GLM 5.3 / Flash / FlashX, Gemini 3.8 Flash, Qwen 3.8 Max y Flash, Sonnet 5. Y la cautela va A MAS: su propia lista de canales verificados por huella sigue siendo la vieja (GPT-5.4, GPT-5.5, Sonnet 4.6, Opus 4.7/4.8, Fable 5, DeepSeek V4 Flash y Pro, MiniMax M3), asi que vende Opus 5.5 y los GPT-6 SIN verificar. La cita que usaba esta ficha ya no esta en su web; hoy dice que todo proveedor listado pasa su prueba de huella. 2026-10-02: ofrece ya GPT 6.1 Sol y Sonnet 5.5 en el selector. Su clasificador de huella se ha puesto al dia en parte: ya etiqueta los GPT-6 y el 6.1 Sol, y han caido deepseek-v4-pro y minimax-m3. Siguen SIN verificar Sonnet 5.5, Opus 5.5, Grok 4.7 y Kimi K3, y su propia FAQ de Claude no lista ni Sonnet 5.5 ni Opus 5.5 aunque la portada los venda. El 'hasta 90%' se queda corto: anuncia 96% en GPT-6 Astra ($0,45 por millon contra $10 de lista), lo que refuerza la cautela en vez de rebajarla. Publica precio por canal contra el oficial, asi que la conversion pasa de 'none' a 'partial'. |
| TokenMix | 🇭🇰 Hong Kong SAR | reseller | 198 modelos, 142 de chat: GPT-6 Sol y Luna, GPT-6 Astra, Claude Opus 5.5 / Sonnet 5 / Fable 5, DeepSeek V4, Kimi K3, GLM-5.2 / 5.3, Grok 4.6 y 4.5, Gemini 3.8 Flash, Qwen 3.8 Max / Flash / Omni | tokens (per-model) | partial | partial | Token Limited (Hong Kong). Pay-per-token with per-model pricing and an OpenAI-compatible base (api.tokenmix.ai/v1). No markup formula published, but it bills tokens rather than opaque credits. $1 minimum top-up. 2026-09-13: Claude Sonnet 5 ya tiene precio publicado, $1,96/$9,80. Y ojo al desambiguar GLM: los $2,24/$7,82 de esta ficha son la variante Fast Preview; el GLM-5.2 normal y el GLM-5.3 estan a $1,117647/$3,911765. 2026-09-24: sin cambios de precio. Nuevos con precio: Kimi K3 $2,647/$13,235 y GPT-6 Astra $9,50/$47,50. NINGUNO de los cinco lanzamientos del 21-22. Sus ref_prices se reconfirman una a una. 2026-10-02: ya vende tres de los lanzamientos recientes, GPT-6 Sol ($1,90/$9,50), GPT-6 Luna ($0,095/$0,475) y Claude Opus 5.5 ($3,92/$19,60); Sonnet 5.5 y GPT-6.1 Sol dan 404 en sus URLs de modelo. El descuento ya esta declarado modelo a modelo. Y da creditos gratis al registrarse, que esta ficha no recogia. Minimo de $1, pero $20 si pagas en cripto. |
| CrofAI | — | inference-host | Kimi, GLM, DeepSeek, Qwen, Gemma y MiMo-V2.5-Pro. Ya NO sirve MiniMax. Y desde 2026 tiene dos modelos PROPIOS de marca, greg-2-ultra y greg-2-super, asi que deja de ser solo pesos abiertos. | tokens (pay-per-token) | full | yes | Cheap OpenAI-compatible inference (crof.ai/v1) for open weights only, no markup, pure pay-per-token -- its own page now states \u201cno subscriptions, no minimums, only the tokens you actually burn\u201d (the tiered Hobby/Max plans some third-party listings still show are gone). One of the resellers this repo excluded from first-party price resolution earlier (as \u201ccrof\u201d); it belongs here, not in the leaderboard prices. Country not confirmed. checked 2026-07-22. 2026-09-13: DeepSeek V4 Flash baja de $0,12/$0,21 en Q4_0 a $0,07/$0,10 en Q8_0 — mas barato Y mejor cuantizado, que es lo raro. Declaran retencion cero explicita y no entrenar con las conversaciones. Los ToS dicen regirse por leyes de Estados Unidos, aunque la sede fisica sigue sin confirmarse. Contradiccion suya: la portada dice 'no subscriptions' y los ToS hablan de planes gratuitos y de pago. CERRANDO 2026-09-18: crof.ai redirige a nahcrof.com, que dice 'Nahcrof is in the process of shutting down. Currently we are working with Polar to process refunds to existing customers.' Hasta su propio /v1/models devuelve esa pagina. No compres aqui: los precios de abajo son historicos. 2026-09-24: sigue igual, cerrando y con los reembolsos en curso por Polar. Sin fecha de cierre publicada. En su cuenta de X: ya no se pueden comprar creditos y prometen una pagina para pedir el reembolso. 2026-10-02: sigue cerrando, con el mismo aviso de reembolsos por Polar y sin fecha. Un matiz: su /v1/models ya no devuelve la pagina de cierre, devuelve un 404 en JSON. |
| nano-gpt | — | router | GPT, Claude, DeepSeek, Qwen + open models (1000+), OpenAI-compatible | tokens (list price) | full | yes | A no-markup, privacy-first router: it passes provider list prices straight through (GPT-5.5 at $5/$30, same as OpenAI) with no deposit fee, and takes crypto from $0.10 with no KYC. The honest end of the spectrum -- the price is the vendor\u2019s, verifiable up front -- sold on privacy rather than a discount. Country not confirmed. 2026-09-13: hay una suscripcion opcional de $12/mes que esta ficha no recogia. Y el 'sin markup' tiene dos excepciones declaradas: 5% por fijar proveedor a mano y 5% en BYOK. Precios que se mueven: DeepSeek V4 Pro de $0,435/$0,87 a $1,10/$2,20, y GLM-5.2 de $1,4/$4,4 a $0,42/$1,32. SIN CONFIRMAR el de GPT-5.6 Sol: su propia API lo da a $2/$10, identico byte a byte al de Claude Sonnet 5 incluida la escritura de cache, lo que apunta a un dato mal copiado en su catalogo. 2026-09-24: vende los cinco lanzamientos del 21-22, y Claude Opus 5.5 al precio OFICIAL ($4/$20); GPT-6 Sol $2/$10, GPT-6 Luna $0,1/$0,5, Grok 4.7 $1,6/$4,8, MiMo-V2.6-Pro $0,435/$0,87. Sus 617 modelos confirman los ref_prices sin un cambio. Sigue el dato sospechoso de GPT-5.6 Sol, byte a byte igual que Claude Sonnet 5. 2026-10-02: 634 modelos de texto, y vende los dos lanzamientos de la semana AL PRECIO OFICIAL: Claude Sonnet 5.5 a $2/$10 y GPT-6.1 Sol a $2/$10 con cache a $0,10. Sigue sin resolverse el dato sospechoso de GPT-5.6 Sol, que su API da a $2/$10, igual que Sonnet 5: tercera semana. |
| Fal.ai · Replicate · Wavespeed AI · PiAPI · EachLabs | — | reseller | generative image / video / audio (Midjourney, Flux, Kling, etc.) | per-second / per-run / credits | n/a | n/a | Named by APIMart as its competitors. All are media-generation gateways, not coding-LLM providers, so they are recorded here only to say they were checked and are out of scope — not to rank. |
| Featherless AI | 🇸🇬 Singapore | inference-host | open-weight models only (40k+ pulled from Hugging Face) — DeepSeek V4 Pro/Flash, GLM 5.3, Qwen3, Kimi K3, Llama | suscripcion mensual por concurrencia, Y desde 2026 tambien por token (plan Developer) | partial | partial | CORREGIDO 2026-09-13: la ficha decia que no hay precio por token que comparar, y ya lo hay — el plan Developer son $50/mes en creditos, 'billed per token', hasta 256K de contexto. Quedan Chat a $25/mes (4 unidades de concurrencia, 32K, tokens ilimitados), Developer, y Business a medida con GPU dedicadas. El plan Agent de $100/$200 ya no aparece. Anuncian 40.000+ modelos y destacan GLM 5.3 (753B) y Kimi K3 (2780B). 2026-09-24: sus precios por token si son publicos, en api.featherless.ai/v1/models, y de ahi salen ya los ref_prices: GLM-5.3 $1,40/$4,40, GLM-5.3-Flash $0,15/$0,50, Kimi K3 $3/$15, DeepSeek V4.1 Flash $0,30/$1,20, Qwen3.8-27B $0,40/$3. Developer trae 100 unidades de concurrencia y un entorno de agente. Contradiccion suya: su pagina de modelos dice 50.433 y la de precios 40.000+. 2026-10-02: precios y planes identicos, ref_prices reconfirmados uno a uno contra su API. Los creditos no caducan. Su contradiccion de recuento se mueve: la pagina de modelos dice 50.963 y la de precios sigue en 40.000+. |
| Nscale | 🇬🇧 United Kingdom | inference-host | open-weight serverless — gpt-oss, Qwen2.5-Coder / Qwen3, Llama 4, Devstral, DeepSeek R1 distills (no full DeepSeek V4, no GLM, no Kimi) | tokens (per 1M, pay-as-you-go) | full | false | CAMBIO GRAVE 2026-09-13: /pricing y /product/serverless devuelven 404 y el sitemap ya no tiene ninguna pagina de precios ni de serverless. El catalogo y las tarifas estan hoy TRAS LOGIN — el /v1/models publico devuelve 401 — y la web comercial se ha reorientado a venta consultiva ('Talk to an expert', 'Reserve GPUs'). El servicio NO esta muerto: los docs siguen y el alta por consola existe, pero ya no hay tarifa publica que verificar, por eso `verifiable` baja a 'no'. Y la ficha decia 'sin Kimi': es falso desde ABRIL, su propio blog anuncio Kimi K2.5 a $0,45/$2,20 el 2026-04-13, o sea que ya lo era en la revision del 22 de julio. DeepSeek V4 y GLM siguen sin confirmarse. Los '~5 $ de credito de alta' tampoco se confirman hoy. Sedes europeas: Noruega, Portugal (Sines), Islandia y Reino Unido; HQ en Londres, fuera de la UE. Sin ISO 27001, SOC 2, GDPR ni DORA publicados en esas paginas. 2026-10-02, a peor para verificar nada: /pricing sigue dando 404 y su /v1/models sigue pidiendo clave. /product/serverless ya no es 404, pero redirige a una pagina de servicios sin catalogo ni tarifa. Y OJO con la huella europea que decia esta ficha: hoy su portada lista tambien Texas, Virginia Occidental y Carolina del Norte. Servicio nuevo: ajuste fino con banco de pruebas de prompts. Sus ref_prices y su lista de modelos siguen sin poder reverificarse, segunda semana. |
| OVHcloud AI Endpoints | 🇫🇷 France | inference-host | open-weight, EU — Llama 3.3 70B, Qwen (3.8/3.6/3.5/2.5-VL) y gpt-oss. SIN DeepSeek V4, sin GLM y sin Kimi, y desde 2026 tampoco Mistral, Codestral, Devstral ni Qwen3 Coder. | tokens (per 1M, priced in EUR) | full | yes | France-based (OVHcloud, Roubaix), 'a leading European provider of sovereign cloud services since 1999', con ISO 27000, SOC y certificaciones sanitarias en la plataforma, retencion cero y el compromiso de no entrenar con tus datos. AVISO 2026-09-13: la ficha afirmaba 'GDPR / EU data residency, served from Gravelines' y ninguna de esas dos cosas aparece ya en la pagina; pasan a no confirmadas. El motivo para descartarlo en codigo se sostiene, pero ha cambiado: antes era que faltaba el SOTA abierto; ahora ademas han caido Mistral entero, Qwen3 Coder 30B y el distill de DeepSeek, asi que la unica opcion de codigo que queda es gpt-oss-120b. Precios en EUROS, el coste en dolares flota con el cambio. Batch con 50% de descuento. Incoherencia del propio OVH: su FAQ comercial sigue diciendo 'Llama, Qwen, Deepseek y mas de 40 modelos' mientras el catalogo ensena 20 y ningun DeepSeek. 2026-09-18: el catalogo con precio se queda en ocho modelos (Qwen3.8-27B, Qwen3.6-27B, Qwen3.5-397B, Qwen3.5-9B, gpt-oss-120b y 20b, Llama 3.3 70B, Qwen2.5-VL-72B); salen Qwen3 Coder 30B, Qwen3 32B y Mistral Small 3.2. 2026-09-24: catalogo en 20 entradas, los ocho de texto con el MISMO precio que la semana pasada. Nuevos: Qwen3-Embedding-8B a 0,1 EUR y dos guardas en beta gratis (Qwen3Guard-Gen-8B y 0.6B), lo que respalda el 'algunos modelos gratis'. Sigue sin DeepSeek, GLM, Kimi ni Mistral, y GDPR y Gravelines siguen sin aparecer: segunda semana sin confirmar. |
| Scaleway Generative APIs | 🇫🇷 France | inference-host | open-weight, EU-sovereign — Llama, Mistral, Qwen3, gpt-oss, y DESDE 2026 deepseek-v4-flash-0731. Nuevos: qwen3.5-397b-a17b y gemma-4-26b-a4b-it. | tokens (per 1M, priced in EUR) | full | yes | France-based, Paris only: 'all models are hosted in secure data centers in France', y declaran que no leen ni reutilizan tus prompts. CORREGIDO 2026-09-13: la ficha decia 'DeepSeek R1 distills only, no DeepSeek V4' y ya no es cierto — sirve deepseek-v4-flash-0731 a 0,40 EUR de entrada y 0,80 de salida (0,08 cacheado). Precios en EUROS, asi que el coste normalizado a dolares flota con el cambio. Batch con 50% de descuento, literal. SIN CONFIRMAR si siguen Devstral 2, Mistral Large 3 y MiniMax-M2.5: no salen en la tabla de precios de hoy, pero tampoco consta que se hayan retirado. 2026-09-24: precios identicos, y aparecen dos que faltaban en esta ficha: Gemma 4 26B A4B (0,25/0,50 EUR) y Pixtral 12B (0,20). El millon de tokens gratis se confirma literal. Devstral 2, Mistral Large 3 y MiniMax-M2.5 siguen sin salir: segunda semana sin confirmar. Y el -50% de Batch ya NO sale con cifra, solo como 'descuento adicional', asi que deja de ser literal. 2026-10-02: vuelta atras de la nota pasada, el -50% de Batch VUELVE a estar literal: 'All requests performed using Batches API are priced with a -50% discount'. Los 16 modelos con precio, identicos. Faltan en esta ficha dos embeddings con precio: qwen3-embedding-8b y bge-multilingual-gemma2, los dos a 0,10 EUR con salida gratis. Devstral 2, Mistral Large 3 y MiniMax-M2.5 siguen fuera: tercera semana sin confirmar. |
| Public AI | — | inference-host | public-good / sovereign open-weight models only — Apertus, SEA-LION, EuroLLM, Bielik, Olmo (no mainstream or coding models) | tokens (wallet credits, per 1M) | full | partial | A non-profit "public utility for AI" (Public AI Inference Utility), serving publicly-funded sovereign models on donated / partner clusters, also routed free via Hugging Face. Currently free with a ~20 req/min limit, but "free" is explicitly provisional and there is no price sheet or SLA. The roster is sovereign / multilingual general-instruct models (Apertus, SEA-LION, EuroLLM) with no DeepSeek / GLM / Qwen-base / Llama / gpt-oss and no dedicated coding model, so it is recorded for completeness, not as a coding option. Legal HQ not stated (Swiss / EU centre of gravity). MATIZ 2026-09-13: esto NO es residencia de datos en la UE. Hay una capa global de balanceo que enruta entre paises, con AWS y Australia entre los clusteres, asi que el 'centro de gravedad suizo/europeo' describe de donde sale el proyecto, no donde se procesa tu peticion. Ya nombran a los donantes del computo: Swiss National Supercomputing Centre, Intel, AWS, Exoscale, AI Singapore, Cudo Compute, NCI Australia y Juelich. Anadido ALIA (Barcelona Supercomputing Center) al catalogo; Apertus va por la 1.5, con comprension de imagen y cuatro veces mas contexto. CAMBIO 2026-09-18: YA NO ES GRATIS. Cobra por token contra un monedero: 'Token usage is billed against wallet credits… New accounts receive starter credits'. Precios en platform.publicai.co/models: Apertus 1.5 70B $0,82/$2,92, Gemma-SEA-LION-v4-27B $0,20/$0,40, Qwen-SEA-LION-v4-32B $0,25/$0,50, Bielik-11B v3 $0,40/$0,40. Limites por plan: Free 100 peticiones/min, Plus 200, Pro 300, Enterprise 10.000. EuroLLM y ALIA no salen en la tabla de precios de hoy. 2026-09-24: la cantidad del credito de inicio ya esta publicada, $2. El catalogo con precio pasa de 4 a 9 entradas, con Apertus 1.5 en 8B y 70B y sus variantes de razonamiento. EuroLLM y ALIA siguen fuera. Plus se consigue contribuyendo por OpenCollective con el mismo correo de la cuenta. |
| Hugging Face Inference Providers | 🇺🇸 United States | router | 200+ modelos de pesos abiertos a traves de 18 proveedores: Baseten, Cerebras, Cohere, DeepInfra, Fal AI, Featherless AI, Fireworks, Groq, HF Inference, Novita, Nscale, OVHcloud AI Endpoints, Public AI, Replicate, Scaleway, Together, WaveSpeedAI y Z.ai | tokens (pass-through provider rate) | full | yes | A router, not a host: one HF token routes to leading inference providers, OpenAI-compatible (router.huggingface.co/v1), with no HF markup — you pay the partner's rate. The provider is chosen by policy suffix (:fastest default, :cheapest, :preferred, or an explicit :provider). A small monthly credit ($0.10 free / $2 on PRO at $9/mo) then pay-as-you-go. It serves whatever its partners serve (open weights only), so price and quantization come from the chosen partner, not HF. Closed models (GPT-5.x, Claude) are not routed. 2026-09-24: creditos y el 'sin markup' sin cambios. La lista de socios ha crecido a 18, y cuatro de ellos tienen ficha propia en este mismo fichero: Featherless, Nscale, OVHcloud y Public AI. 2026-10-02: sin cambios. Matiz nuevo: al usuario gratuito, agotado su credito de $0,10, el pago por uso le exige COMPRAR creditos antes. |
| NVIDIA Build | 🇺🇸 United States | inference-host | 97 modelos de peso abierto en su web; su /v1/models publica 81. Ni un Qwen entre ellos (2026-10-02). | peticiones por minuto (produccion via NIM / por token) | full | partial | CORREGIDO 2026-09-13: la ficha decia que no siempre trae el frontier mas reciente y para DeepSeek es falso — hoy sirve deepseek-v4-pro-0813 (262K de contexto) y deepseek-v4-flash-0731, ademas de kimi-k3, gemma-4-31b-it y tres Nemotron 3. GLM: su /v1/models lista z-ai/glm-5.3 y z-ai/glm-5.3-flash (2026-09-18). PUNTO FLOJO DE ESTA FICHA: los '1.000-5.000 creditos' y los '40 peticiones por minuto' NO se verifican en build.nvidia.com, que solo dice 'free inference with leading models' sin cifras; una fuente secundaria llega a decir que los limites de credito se han quitado. OJO 2026-09-18: deepseek-v4-pro-0813 tiene ficha en build.nvidia.com pero NO sale en /v1/models (82 modelos), asi que no esta claro que hoy se pueda llamar por la API. 2026-09-24: el desajuste entre su web y su API se ensancha. En /v1/models (82 modelos) el unico DeepSeek de frontera es v4.1-flash: el v4-flash-0731 estaba la semana pasada y hoy no, y el v4-pro-0813 sigue fuera, aunque las dos fichas web existan. Y 'tres Nemotron 3' se queda corto: hoy hay seis (Ultra 550B, Super 120B, Nano 30B, Nano Omni 30B, 3.5 Lightning y Embed 1B). Nuevos tambien: Laguna XS 2.1, Muse Glimmer 30B, DiffusionGemma 26B y su propio Ising Calibration 1.5 31B. 2026-10-02: el punto flojo de esta ficha se arregla a medias. Los 40 por minuto YA son verificables, en su propia FAQ: 'The free tier runs on rate limits - up to 40 requests per minute (RPM) for most models, with no per-token billing'. En cambio los '1.000-5.000 creditos' se caen: la palabra credito no aparece ni una vez en su pagina de modelos. El catalogo baja de 103 a 97 y la API de 82 a 81. Dato llamativo: ni un solo modelo Qwen en la API. Nuevos: Nemotron 3.5 Content Safety y Nemotron Parse 2.0. |
| RunPod | — | inference-host | Public Endpoints de texto, y desde el 2026-10-02 se queda en tres: Deep Cogito v2 Llama 70B, Qwen3 32B AWQ y IBM Granite 4.0 H Small. El endpoint de Moonshot Kimi HA DESAPARECIDO. Cualquier otro peso abierto lo despliegas tu en Serverless o en Pods. | tokens | full | partial | CORREGIDO 2026-09-13: la ficha lo marcaba como no apto para codigo porque 'el catalogo de texto es fino y Qwen3 32B es el principal'. Ya no: su endpoint de Kimi sirve K2.7 Code y K3, este a $3,00 de entrada y $15,00 de salida por millon, por API gestionada y por token. Qwen3 32B AWQ sigue a $10,00 por millon y Granite 4.0 H Small a $1,00. NO es un proxy de OpenRouter: salio de ahi y hoy no sirve ni un modelo de nuestra tabla por esa via, asi que esta ficha es lo unico que el sitio cuenta de el. Su tabla lista 'Deep Cogito v2 Llama 70B a $0.00001 por millon': es una errata casi segura y no se publica. El serverless lo cotizan hoy POR HORA (B300 $9,98, H200 $5,93, A100 $2,72) aunque la portada siga diciendo 'billed by the millisecond'. 2026-09-18: kimi-k2.6 y kimi-k2.7-code a $0,95/$4,00 por millon; el rango del endpoint de Kimi va de $0,95-$3,00 de entrada a $4,00-$15,00 de salida. 2026-09-24: Kimi identico (K2.6 y K2.7 Code a $0,95/$4,00, K3 a $3/$15) y sigue publicada la errata de Deep Cogito v2 a $0,00001 por millon. Dos matices: 'billed by the millisecond' ya no esta en el texto visible, solo en el JSON incrustado; y las horas de Serverless de esta ficha (B300 $9,98, H200 $5,93, A100 $2,72) no se han podido reconfirmar, porque lo que renderiza hoy /pricing es la tabla de Pods. CAMBIO GRAVE 2026-10-02: el endpoint publico de Kimi ya no existe. Las palabras kimi y moonshot aparecen cero veces en su pagina de precios, asi que la frase de esta ficha de que servia K2.7 Code y K3 se cae, y con ella el motivo para marcarlo apto para codigo: vuelve a `coding: false`. La errata de Deep Cogito a $0,00001 por millon sigue publicada. Sus horas de Serverless siguen sin reconfirmarse, y las de Pods han BAJADO: B300 $7,89, B200 $6,79, H200 $4,59, H100 SXM $3,49, A100 $1,59. Y 'billed by the millisecond' ha desaparecido tambien del JSON incrustado. |
| CoreWeave Forge (antes Weights & Biases Inference) | — | inference-host | 32 modelos de peso abierto por su propia API: DeepSeek V4 Pro/Flash y V4.1 Flash, GLM 5 / 5.2 / 5.3 Flash, Kimi K2.6 y K2.7 Code, MiniMax M3, Qwen3.8 27B, Gemma 4, Nemotron 3, Mellum2, gpt-oss. | tokens | full | partial | Left OpenRouter, so it no longer appears anywhere in the provider table — checked 2026-09-13 against the endpoints of all 445 models on the listing, and it serves none of them. It still sells inference directly, which is why it belongs here: a reader can still buy from it. Two things to know before you do. Inference is billed SEPARATELY from the Enterprise and Pro licences, in arrears, and paid access requires prepayment. The $0.50 per million 'Agent Token Rate' is for the ARIA agent only ('ARIA runs on OpenAI models… This rate applies on top of model API pricing'), not for plain inference (as of 2026-09-18). Free, Pro and Academic plans include some serverless credits; when they run out the account has to switch to pay-as-you-go explicitly. You can cap it: a monthly budget stops requests once reached. 2026-09-18: tabla de modelos alojados con precio: DeepSeek V4-Pro $1,15/$2,55, V4-Flash $0,14/$0,28, GLM 5.2 $0,76/$2,42, GLM 5.3 Flash $0,15/$0,50, Kimi K2.7 Code $0,71/$3,50, Kimi K2.6 $0,65/$3,41, MiniMax M3 $0,23/$0,96, gpt-oss-120b $0,03/$0,17. Lo de 'in arrears' y el prepago no sale en esta pagina: sin confirmar. 2026-09-24: su tabla de modelos alojados pasa de 8 a 30. Nuevos con precio, entre otros: DeepSeek V4-Pro-0813 $1,31/$3,96, V4.1-Flash $0,20/$0,65, Qwen3.8 27B $0,40/$3,00, GLM 5 $1,00/$3,20, Gemma 4 31B $0,10/$0,34, Nemotron 3 Ultra $0,50/$2,15 y JetBrains Mellum2 $0,05/$0,10. Los ref_prices de esta ficha no se mueven. Y el recargo del agente ARIA, leido hoy, es mas amplio de lo que decia esta ficha: 'All plans include an Agent Token Rate of $0.50 per million tokens... for all token types'. Lo de la facturacion a mes vencido y el prepago sigue sin aparecer. CAMBIO DE IDENTIDAD 2026-10-02: la pagina ya no es de Weights & Biases. Se titula 'CoreWeave Forge Inference, Sandboxes, and ARIA pricing' y su tabla se llama 'CoreWeave Forge hosted models', aunque la URL de wandb.ai siga sirviendo. El catalogo pasa de 30 a 32. ARIA es ahora GRATIS por tiempo limitado, y despues pasara a cobro por consumo; el recargo de $0,50 por millon sigue descrito igual. Lo de la factura a mes vencido ya se apoya en algo ('Usage is then invoiced monthly'); el prepago sigue sin aparecer. Nuevo: CoreWeave Sandboxes, con CPU a $0,128 por nucleo y hora y memoria a $0,0212 por GiB y hora, y post-entrenamiento marcado por modelo. |