Official site ↗ · 🇺🇸 United States
Serves: 97 modelos de peso abierto en su web; su /v1/models publica 81. Ni un Qwen entre ellos (2026-10-02).
Billing unit: peticiones por minuto (produccion via NIM / por token)
Converts to tokens: full
Verifiable pre-pay: partial
Pricing / discount: tramo gratis por limite de peticiones, no por credito: hasta ~40 por minuto en la mayoria de modelos y sin facturacion por token (su FAQ, 2026-10-02). Los "1.000 creditos al registrarse" que decia esta ficha ya NO aparecen en su web
CORREGIDO 2026-09-13: la ficha decia que no siempre trae el frontier mas reciente y para DeepSeek es falso — hoy sirve deepseek-v4-pro-0813 (262K de contexto) y deepseek-v4-flash-0731, ademas de kimi-k3, gemma-4-31b-it y tres Nemotron 3. GLM: su /v1/models lista z-ai/glm-5.3 y z-ai/glm-5.3-flash (2026-09-18). PUNTO FLOJO DE ESTA FICHA: los '1.000-5.000 creditos' y los '40 peticiones por minuto' NO se verifican en build.nvidia.com, que solo dice 'free inference with leading models' sin cifras; una fuente secundaria llega a decir que los limites de credito se han quitado. OJO 2026-09-18: deepseek-v4-pro-0813 tiene ficha en build.nvidia.com pero NO sale en /v1/models (82 modelos), asi que no esta claro que hoy se pueda llamar por la API. 2026-09-24: el desajuste entre su web y su API se ensancha. En /v1/models (82 modelos) el unico DeepSeek de frontera es v4.1-flash: el v4-flash-0731 estaba la semana pasada y hoy no, y el v4-pro-0813 sigue fuera, aunque las dos fichas web existan. Y 'tres Nemotron 3' se queda corto: hoy hay seis (Ultra 550B, Super 120B, Nano 30B, Nano Omni 30B, 3.5 Lightning y Embed 1B). Nuevos tambien: Laguna XS 2.1, Muse Glimmer 30B, DiffusionGemma 26B y su propio Ising Calibration 1.5 31B. 2026-10-02: el punto flojo de esta ficha se arregla a medias. Los 40 por minuto YA son verificables, en su propia FAQ: 'The free tier runs on rate limits - up to 40 requests per minute (RPM) for most models, with no per-token billing'. En cambio los '1.000-5.000 creditos' se caen: la palabra credito no aparece ni una vez en su pagina de modelos. El catalogo baja de 103 a 97 y la API de 82 a 81. Dato llamativo: ni un solo modelo Qwen en la API. Nuevos: Nemotron 3.5 Content Safety y Nemotron Parse 2.0.