MODELOS
Suscripción Unlimited Basic: Qwen 3.8 27B ilimitado por 14,95 €/mes, sin facturación por token

CÓMPUTO Y DESPLIEGUEDE MODELOS.

Cómputo multi-proveedor para ejecutar tus modelos.

QDivZero analiza los requisitos de tu modelo y busca capacidad compatible entre distintos proveedores. Compara las opciones disponibles y selecciona la infraestructura adecuada para tu despliegue, sin que tengas que gestionar servidores ni GPUs.

¿No sabes por dónde empezar?Despliega un modelo

UN MODELO ES SOLO EL PRINCIPIO.

Ejecuta modelos de texto, imagen, vídeo, audio, embeddings y multimodales sin montar tu propia infraestructura. Desde modelos de Hugging Face hasta modelos propios, QDivZero prepara todo lo necesario para ejecutarlos en producción.

Pon precio a tu despliegue

Prueba nuevos modelos, compáralos y lleva a producción los que mejor encajen en tus aplicaciones. Todo desde el mismo entorno, sin tener que montar una infraestructura diferente para cada modelo.

CÓMO FUNCIONA

Una única forma de desplegar, independientemente del modelo.

QDivZero unifica todo el proceso de despliegue. El flujo sigue siendo el mismo aunque cambies de modelo o cambie la infraestructura que hay detrás. Tú defines los requisitos que necesitas y QDivZero se encarga de gestionarlos sobre la infraestructura, para que puedas desplegar y conectar tus aplicaciones siempre de la misma forma.

Empezar
01 —

Define tu despliegue

Selecciona tu modelo y define sus necesidades de rendimiento, región y disponibilidad.

02 —

QDivZero busca capacidad

Compara la capacidad compatible disponible entre proveedores y selecciona la mejor opción para tus requisitos.

03 —

Tu despliegue queda operativo

QDivZero prepara el entorno, pone el modelo en ejecución y lo expone mediante una API compatible con OpenAI.

Requisitos del despliegue

Configura cómo responde tu modelo

Ajusta contexto, concurrencia y comportamiento de inferencia según el tipo de uso que necesites.
Modelo seleccionadoQwen3.8-27B

Perfil de serving

Rápido
Equilibrado
Agente
Perfil validado
Ventana de contexto
Configurada
Concurrencia
Optimizada
Runtime
Listo

Listo para buscar capacidad

¿Quieres saber cuánto costaría tu despliegue?Compara precios
Abeja sobre una flor naranja.

Configura cada despliegue según cómo vas a utilizar tu modelo.

Ajusta el comportamiento de inferencia, define dónde quieres ejecutarlo y decide cuándo debe estar disponible. Desde la configuración de serving hasta la región, la capacidad o la disponibilidad, mantienes el control sobre las decisiones que importan en producción.

Lanza un despliegue

OPERA TU DESPLIEGUE DE IA

Mariposa monarca sobre una hoja.

Controla qué ocurre cuando tu modelo ya está en producción.

Supervisa uso de GPU y CPU, memoria, throughput, tokens y estado del despliegue desde un único lugar. Ajusta capacidad, disponibilidad o programación a medida que cambia tu carga, sin rehacer el despliegue.

Abrir panel del despliegue

Instancia Qwen3.8-Flash-Next-NVFP4

dep_qwen38_eu_01

En ejecuciónMonitorización
Uso de recursos
Uso de GPU72%
Uso de CPU34%
Memoria67%
24.8000MTokens procesados
Estado del despliegueSaludable
Throughput46 tok/s
Latencia128 ms
Disponibilidad99.99%
¿Quieres ver qué ocurre después de desplegar tu modelo?Explora la monitorización

Todo lo que QDivZero gestiona por ti

Despliegue de modelos

Despliega modelos públicos, de Hugging Face o privados y fine-tuned. QDivZero gestiona la infraestructura.

Routing multi-proveedor

El scheduler selecciona capacidad entre proveedores disponibles según coste, disponibilidad y latencia.

Almacenamiento persistente

Monta discos persistentes en varias cargas, comparte estado entre lanzamientos y déjalos listos para cada ejecución.

API compatible con OpenAI

Expón los modelos desplegados detrás del contrato estándar de OpenAI para que tus clientes actuales sigan funcionando.

Operaciones programadas

Usa reglas de inicio y parada basadas en cron para que las cargas funcionen cuando hace falta y permanezcan apagadas cuando no.

Controles de seguridad

Aplica controles regionales, comprobaciones del runtime y operaciones privadas por defecto para cargas en producción.

Observabilidad

Consulta tokens procesados, CPU, RAM, GPU y rendimiento desde un único lugar para optimizar y resolver incidencias.

Serverless

Inicia modelos bajo demanda y detenlos tras un periodo de inactividad configurable para evitar capacidad sin usar.

FAQ sobre los despliegues en QDivZero

Respuestas sobre cómo desplegar modelos open weight de Hugging Face, modelos propios y fine-tuned, costes de infraestructura GPU, migración desde OpenAI y APIs de inferencia.

¿En qué se diferencia QDivZero de una nube de GPU o una API de modelos de IA?

Una nube de GPU te entrega máquinas que debes configurar y operar. Una API de modelos evita ese trabajo, pero suele limitarte a un catálogo cerrado. QDivZero combina libertad y sencillez: puedes elegir entre todo el catálogo de Hugging Face y lanzar el modelo mediante una API estable sin administrar la infraestructura.

¿Qué infraestructura gestiona QDivZero al desplegar un modelo de IA?

QDivZero valida los requisitos de VRAM y runtime, selecciona capacidad GPU disponible y configura el entorno de inferencia, el almacenamiento y la disponibilidad. También centraliza la monitorización del despliegue para que tu equipo no tenga que administrar servidores y GPUs.

¿Puedo migrar una aplicación compatible con la API de OpenAI?

Sí. Cada despliegue ofrece un endpoint compatible con OpenAI para reutilizar tus SDK, clientes y flujos actuales. Puedes cambiar el modelo conectado a tu aplicación sin rehacer la integración ni modificar su arquitectura.

¿Cómo se calcula el precio de desplegar un modelo de IA?

En los despliegues de QDivZero, el cómputo activo se prorratea por segundo y se descuenta del saldo de tu cuenta. No pagas por el número de usuarios ni por los tokens procesados por ese despliegue. En la misma cuenta puedes usar modelos públicos, que descuentan saldo según los tokens de entrada y salida, y activar Unlimited Basic con Qwen 3.8 27B por una cuota mensual fija sin consumir saldo.

¿Puedo desplegar un modelo propio, privado o fine-tuned en QDivZero?

Sí. Puedes desplegar modelos desarrollados por tu equipo, mantener sus pesos privados o ejecutar versiones fine-tuned sobre cómputo dedicado. El modelo no tiene que formar parte de un catálogo público para utilizar la infraestructura de QDivZero.

¿Cómo funciona el despliegue de un modelo propio?

Defines el modelo y sus requisitos. QDivZero valida el runtime y la VRAM necesarios, busca capacidad compatible entre distintos proveedores y prepara el entorno de inferencia. Cuando está listo, recibes un endpoint para conectar el modelo con tu aplicación mediante una API compatible con OpenAI.

¿Por qué usar modelos open weight de Hugging Face en una empresa?

Los modelos open weight permiten resolver casos como RAG, clasificación, generación de código y asistentes internos con más control y libertad de elección. QDivZero los deja listos para desplegar en pocos pasos para que puedas evaluar distintas opciones y elegir la que mejor encaje en cada aplicación.

¿Listo para desplegar tu modelo?

Elige qué quieres ejecutar y define tus requisitos. QDivZero encuentra la capacidad compatible, prepara el entorno y mantiene tu despliegue listo para usar. Olvídate de gestionar infraestructura de IA y despliega tu primer endpoint de inferencia privada.