Paga por lo que ejecutas.

Modelos públicos con tarifas de inferencia publicadas

Usa modelos ya desplegados sin tener que elegir ni ejecutar una GPU. Las tarifas se expresan en euros por cada millón de tokens de entrada y salida, y el importe se calcula según el uso de inferencia registrado.

Consulta la guía de modelos públicos
Modelos públicos con tarifas de inferencia publicadas
ModeloResidenciaTarifa de entrada / 1 MTarifa de salida / 1 M
deepseek-v3.2Global€0.35€1.43
deepseek-v3.2-europeanUnión Europea€0.81€2.18
gpt-oss-120b-europeanUnión Europea€0.34€1.37
gpt-oss-safeguard-120b-europeanUnión Europea€0.34€1.37
gpt-oss-20b-europeanUnión Europea€0.09€0.39
gpt-oss-safeguard-20b-europeanUnión Europea€0.09€0.39

Los modelos públicos se facturan según el uso de inferencia registrado y las tarifas publicadas de entrada y salida. Compute se factura por separado según el tiempo de GPU activa.

Estima el coste de GPU de un modelo

Busca un modelo de Hugging Face para estimar cuánta VRAM necesita y consultar infraestructura compatible a precios actuales por hora de GPU. Se trata de una estimación de cómputo, no de un precio por token ni por uso de la API del modelo.

Estimación de GPU según el modelo

Elige un modelo o una variante GGUF cuantizada para estimar la VRAM y el coste de GPU

Consultar directamente los precios de GPU

¿Ya sabes qué GPU o cuánta VRAM necesitas? Consulta el inventario sin pasar por la estimación por modelo. Compara la capacidad disponible, la ubicación, el tipo de mercado y el precio de la infraestructura por hora de GPU.

Todas las configuraciones de GPU

Precio actual de la infraestructura por hora de GPU

1429 configuraciones
Región
Mercado
Nivel
VRAM
2x RTX 306012 GB × 2 = 24 GB
spotcommunityNorth America, US

€0.03/h

Capacidad limitada

RTX 20606 GB
spotcommunityNorth America, US

€0.04/h

Capacidad limitada

RTX 306012 GB
spotcommunityNorth America, US

€0.04/h

Capacidad limitada

RTX 306012 GB
spotcommunityAsia, KR

€0.04/h

Capacidad limitada

RTX 306012 GB
spotcommunityAsia, KR

€0.04/h

Capacidad limitada

RTX A20006 GB
spotcommunityEurope, NO

€0.04/h

Capacidad limitada

4x RTX A400016 GB × 4 = 64 GB
spotcommunityNorth America, CA

€0.04/h

Capacidad limitada

RTX A400016 GB
spotcommunityNorth America, CA

€0.04/h

Capacidad limitada

RTX A400016 GB
spotcommunityNorth America, CA

€0.04/h

Capacidad limitada

2x RTX A400016 GB × 2 = 32 GB
spotcommunityNorth America, CA

€0.04/h

Capacidad limitada

Mostrando 1-10 de 1383

Página 1 de 139

Qué puede incluir tu despliegue

Firewall y Smart Balancers están incluidos en cada despliegue, por lo que la protección y el enrutamiento resiliente no añaden una tarifa de plataforma independiente. Añade Flexible Vector Database solo cuando necesites recuperación semántica gestionada.

Flexible Vector Database

Almacenamiento vectorial facturado por GB-hora

€0.0010/GB/h

Firewall

Incluido

Smart Balancers

Incluido

Precios actualizados el 9/2/2026, 8:12:24 AM

Cómo funciona la facturación

Consulta cómo registra QDivZero los cargos, el saldo, las recargas y las facturas de tu cuenta.

Consulta la guía de facturación

¿Listo para ejecutar un modelo?

Compara capacidad GPU, elige la configuración que necesita tu carga y despliega en QDivZero.