Crear una ejecución
Alquila un nodo GPU de un proveedor, inicia un contenedor a partir de una imagen pública y ejecuta en él el script bash proporcionado. Exactamente se requiere uno de los dos formularios de presupuesto: hours acota el tiempo exactamente y cost aproxima el costo, max_usd lo contrario.
Autorizaciones
Gateway auth: send Authorization: Bearer <mka1-api-key>. For multi-user server-side integrations, you can also send X-On-Behalf-Of: <external-user-id>.
Encabezados
Optional external end-user identifier forwarded by the API gateway.
Cuerpo
Nombre del acelerador curado. GET /accelerators lista lo que está disponible.
Exactamente uno de hours o max_usd. El costo es rate x time y la tasa se fija en la adquisición, así que son intercambiables, pero no son el mismo número. Un plazo max_usd solo se resuelve una vez que la adquisición fija la tasa.
Obligatorio, sin valor predeterminado. Debe ajustarse a la imagen más lo que descargue el script; si es demasiado pequeño, el pod muere a mitad de la descarga.
x >= 1Aceleradores en un nodo. V1 es de un solo nodo: los clústeres multinodo no son ofrecidos por los proveedores que soportamos.
1 <= x <= 8Cualquier imagen pública. Debe contener bash, y en los proveedores donde instalamos sshd debe ser de la familia Debian con apt.
Para qué sirve la ejecución. Un ajuste fino termina por sí solo y su código de salida es el resultado; un despliegue atiende tráfico y se ejecuta hasta que se elimina. Son un solo recurso porque son un solo pod, un solo proveedor y un solo script: el tipo selecciona la semántica terminal, no una máquina diferente.
finetune, deployment Base64 bash. Ejecútelo como un proceso hijo de nuestro script de ejecución; su código de salida es el resultado de la ejecución. Nunca interpretado.
Entorno para la carga de trabajo. Las claves en el espacio de nombres MKA1_ están reservadas.
Filtro opcional sobre la topología dentro del nodo, por ejemplo, nvlink. El trabajo de paralelismo tensorial es materialmente más lento sobre PCIe.
Puertos del contenedor a exponer, p. ej. "8000/http". Tiene sentido para una implementación, que sirve tráfico; un ajuste fino no tiene nada que exponer.
Preferencia ordenada, probada por turno. Rechazada mientras la anonimidad del proveedor está habilitada, porque la lista en sí misma filtra la identidad del proveedor.
Los IDs de secretos almacenados se resuelven en el entorno inmediatamente antes de la transferencia.
Tu propia clave pública. Nunca generamos ni conservamos material de clave privada. Omítela y la ejecución no tendrá SSH.
Respuesta
La carrera, aceptada y presentada para adquisición.
Para qué sirve la ejecución. Un fine-tune termina por sí solo y su código de salida es el resultado; un deployment atiende tráfico y se ejecuta hasta que se elimina. Son un solo recurso porque son un solo pod, un solo proveedor y un solo script: el tipo selecciona la semántica terminal, no una máquina diferente.
finetune, deployment requested, provisioning, running, succeeded, failed, terminated Donde la carga de trabajo sirve, una vez que está en ejecución. Solo un despliegue declara puertos, así que solo un despliegue informa de un punto de conexión.
El estado de salida de la carga de trabajo. El estado del proveedor no es de confianza para esto: un proveedor informa sobre la VM en lugar del contenedor.
Por qué la ejecución está en este estado, por ejemplo, ssh_setup_failed o budget_exhausted.
Detalles de conexión. El usuario de inicio de sesión depende del proveedor y se lee del proveedor, nunca se asume.