CONOCECOMPUTE.

La capa de ejecución para IA en producción.

Elige el modelo que quieres ejecutar. Compute lo transforma en un servicio listo para producción, encargándose de toda la capa de ejecución, desde el runtime hasta la red, la seguridad y los servicios necesarios.

Infraestructura sin complejidad.

Sin proveedores que comparar. Sin runtimes que configurar. Sin infraestructura que operar. Compute reúne todo lo necesario para ejecutar IA en producción.

Descubre cómo funciona.

MÁS QUEUNENDPOINT.

Todo lo necesario para producción, conectado.

Compute integra inferencia, red, seguridad, routing y servicios de plataforma en un único entorno de ejecución para convertir despliegues de modelos en servicios completos de IA.

Paga por capacidad.

La forma predecible de ejecutar IA.

Compute cobra por la capacidad activa de tu despliegue, no por cada solicitud, token o imagen generada. Aumenta la capacidad cuando lo necesites, redúcela cuando no y mantén siempre el control de tus costes.

Explorar precios

Qué incluye Compute

Despliegue de modelos

Elige un modelo y deja que Compute valide los requisitos del runtime y prepare la capacidad para servirlo.

Routing multi-proveedor

El scheduler selecciona capacidad entre proveedores disponibles según coste, disponibilidad y latencia.

Almacenamiento persistente

Monta discos persistentes en varias cargas, comparte estado entre lanzamientos y déjalos listos para cada ejecución.

API compatible con OpenAI

Expón los modelos desplegados detrás del contrato estándar de OpenAI para que tus clientes actuales sigan funcionando.

Operaciones programadas

Usa reglas de inicio y parada basadas en cron para que las cargas funcionen cuando hace falta y permanezcan apagadas cuando no.

Controles de seguridad

Aplica controles regionales, comprobaciones del runtime y operaciones privadas por defecto para cargas en producción.

Observabilidad

Consulta tokens procesados, CPU, RAM, GPU y rendimiento desde un único lugar para optimizar y resolver incidencias.

Serverless

Inicia modelos bajo demanda y detenlos tras un periodo de inactividad configurable para evitar capacidad sin usar.

Python
client = OpenAI(
    base_url="https://api.qdiv0.com/v1",
    api_key="..."
)

response = client.responses.create(
    model="moonshotai/Kimi-K3",
    input="..."
)

DE COMPUTE A TU CÓDIGO.

Usa el SDK que ya conoces.

Compute cambia cómo se ejecutan tus modelos, no cómo se conectan tus aplicaciones. Cada despliegue está disponible mediante una API compatible con OpenAI, para que tus SDK, clientes e integraciones sigan funcionando sin modificar tu código.

Ver documentación

Con Compute.
Todo listo para
ejecutar IA.