Despliegue de modelos
Elige un modelo y deja que Compute valide los requisitos del runtime y prepare la capacidad para servirlo.
La capa de ejecución para IA en producción.
Elige el modelo que quieres ejecutar. Compute lo transforma en un servicio listo para producción, encargándose de toda la capa de ejecución, desde el runtime hasta la red, la seguridad y los servicios necesarios.
Sin proveedores que comparar. Sin runtimes que configurar. Sin infraestructura que operar. Compute reúne todo lo necesario para ejecutar IA en producción.
Descubre cómo funciona.Todo lo necesario para producción, conectado.
Compute integra inferencia, red, seguridad, routing y servicios de plataforma en un único entorno de ejecución para convertir despliegues de modelos en servicios completos de IA.
La forma predecible de ejecutar IA.
Compute cobra por la capacidad activa de tu despliegue, no por cada solicitud, token o imagen generada. Aumenta la capacidad cuando lo necesites, redúcela cuando no y mantén siempre el control de tus costes.
Carga del runtime
71%
DeepSeek
Elige un modelo y deja que Compute valide los requisitos del runtime y prepare la capacidad para servirlo.
El scheduler selecciona capacidad entre proveedores disponibles según coste, disponibilidad y latencia.
Monta discos persistentes en varias cargas, comparte estado entre lanzamientos y déjalos listos para cada ejecución.
Expón los modelos desplegados detrás del contrato estándar de OpenAI para que tus clientes actuales sigan funcionando.
Usa reglas de inicio y parada basadas en cron para que las cargas funcionen cuando hace falta y permanezcan apagadas cuando no.
Aplica controles regionales, comprobaciones del runtime y operaciones privadas por defecto para cargas en producción.
Consulta tokens procesados, CPU, RAM, GPU y rendimiento desde un único lugar para optimizar y resolver incidencias.
Inicia modelos bajo demanda y detenlos tras un periodo de inactividad configurable para evitar capacidad sin usar.
client = OpenAI(
base_url="https://api.qdiv0.com/v1",
api_key="..."
)
response = client.responses.create(
model="moonshotai/Kimi-K3",
input="..."
)Usa el SDK que ya conoces.
Compute cambia cómo se ejecutan tus modelos, no cómo se conectan tus aplicaciones. Cada despliegue está disponible mediante una API compatible con OpenAI, para que tus SDK, clientes e integraciones sigan funcionando sin modificar tu código.
Ver documentación