> ## Documentation Index
> Fetch the complete documentation index at: https://docs.mka1.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Reemplazar una política de escalado del servicio



## OpenAPI

````yaml https://apigw.mka1.com/speakeasy.json?language=es patch /api/v1/compute/services/{id}/scaling
openapi: 3.1.1
info:
  title: MKA1 API
  version: 1.1.0
  description: >-
    La API MKA1 es una API RESTful que proporciona acceso a la plataforma MKA1.
    Aprende cómo comenzar con la API y el SDK de TypeScript
    [aquí](https://mka1.apidocumentation.com/guides/getting-started).
  license:
    name: Propietario
servers:
  - url: https://apigw.mka1.com
    description: MKA1 API Gateway
  - url: /
    description: Relative server URL (configurable via SDK constructor)
security: []
tags:
  - name: Resource Authorization
    description: >-
      Gestiona permisos para recursos LLM. Crea recursos, otorga/revoca permisos
      y elimina recursos. Solo los propietarios de recursos pueden otorgar,
      revocar o eliminar permisos.
    x-displayName: Autorización de Recursos
  - name: Embeddings
    description: >-
      Puntos finales de la API de incrustación de texto para generar
      representaciones vectoriales del texto. Crea incrustaciones semánticas
      para búsqueda, agrupamiento y coincidencia de similitudes utilizando
      varios modelos de incrustación.
    x-displayName: Incrustaciones
  - name: Feedback
    description: >-
      API de retroalimentación del usuario para calificar y comentar sobre las
      completaciones de chat. Recopila calificaciones de pulgares arriba/abajo y
      comentarios detallados para mejorar las respuestas del modelo y rastrear
      la satisfacción del usuario.
    x-displayName: Retroalimentación
  - name: Images
    description: >-
      Puntos finales de la API de generación de imágenes para crear imágenes a
      partir de descripciones de texto. Genera imágenes con control sobre el
      tamaño, la calidad y el estilo.
    x-displayName: Imágenes
  - name: MCP Vault
    description: >-
      API de bóveda MCP para almacenar configuraciones de servidor MCP propiedad
      del usuario y credenciales encriptadas. Los agentes hacen referencia a los
      ID de la bóveda para que los secretos se resuelvan solo en el momento de
      la ejecución de la herramienta.
    x-displayName: Bóveda MCP
  - name: Speech
    description: >-
      Puntos finales de la API de voz para el procesamiento de audio. Convierte
      texto en habla natural (TTS) o transcribe el habla a texto (STT) en
      diferentes idiomas.
    x-displayName: Discurso
  - name: Usage
    description: >-
      API de seguimiento de uso y análisis para monitorear el consumo de tokens,
      la cantidad de solicitudes y el análisis de costos. Visualiza estadísticas
      detalladas por usuario, modelo y período de tiempo.
    x-displayName: Uso
  - name: Extract
    description: >-
      API de extracción de datos estructurados para extraer información de
      archivos. Define esquemas JSON para extraer datos estructurados de
      imágenes, PDFs y documentos. Soporta plantillas de esquemas reutilizables.
    x-displayName: Extracción
  - name: Text Classification
    description: >-
      API de clasificación de texto para categorizar texto en etiquetas
      predefinidas. Utilice modelos de IA para clasificar el contenido del texto
      para análisis de sentimientos, categorización de temas y moderación de
      contenido.
    x-displayName: Clasificación de Texto
  - name: Responses
    description: >-
      API de respuestas impulsadas por agentes para crear agentes de IA con uso
      autónomo de herramientas. Crea asistentes conversacionales que pueden
      utilizar búsqueda en la web, operaciones con archivos, generación de
      imágenes, ejecución de código, simulación de uso de computadoras e
      integraciones de MCP. Soporta procesamiento en segundo plano, transmisión
      y seguimiento de estado en tiempo real.
    x-displayName: Respuestas
  - name: Files
    description: >-
      API de gestión de archivos para cargar, almacenar y gestionar archivos con
      expiración automática e integración con S3. Carga archivos que se pueden
      usar con Asistentes, Almacenes Vectoriales y otras funciones. Los archivos
      se almacenan en S3 con metadatos rastreados en PostgreSQL. Soporta la
      limpieza automática de archivos expirados.
    x-displayName: Archivos
  - name: Vector Stores
    description: >-
      API de almacenamiento de vectores para almacenar y buscar documentos
      utilizando incrustaciones. Crea almacenes de vectores, sube archivos con
      fragmentación automática y generación de incrustaciones, y realiza
      búsquedas semánticas. Los archivos se procesan de forma asincrónica
      utilizando flujos de trabajo de Temporal para durabilidad. Soporta
      limpieza automática de almacenes caducados y LanceDB para almacenamiento
      eficiente de vectores.
    x-displayName: Almacenes de Vectores
  - name: Conversations
    description: >-
      API de gestión de conversaciones para almacenar y recuperar el estado de
      la conversación a través de llamadas a la API de respuesta. Crea
      conversaciones, añade elementos (mensajes de usuario, mensajes del
      asistente, mensajes del sistema) y mantiene el historial de la
      conversación. Soporta seguimiento de metadatos y gestión del estado del
      diálogo en múltiples turnos.
    x-displayName: Conversaciones
  - name: Guardrails
    description: >-
      API de salvaguardias de seguridad de IA para configurar la moderación de
      contenido y las políticas de seguridad. Configura listas de palabras
      prohibidas, detección de inyección de mensajes y prevención de filtración
      de mensajes del sistema. Las salvaguardias se aplican a todas las
      solicitudes de una cuenta y se pueden probar antes del despliegue.
    x-displayName: Barandillas
  - name: Models
    description: >-
      API de listado de modelos para descubrir modelos disponibles. Devuelve IDs
      de modelos, propiedad y metadatos para todos los modelos registrados en la
      puerta de enlace.
    x-displayName: Modelos
  - name: Skills
    description: >-
      API de habilidades para gestionar paquetes de instrucciones y archivos
      versionados siguiendo el estándar de Habilidades del Agente. Crea,
      versiona y descarga paquetes de habilidades reutilizables que incluyen
      manifiestos SKILL.md para entornos de agentes.
    x-displayName: Habilidades
  - name: Chat Completions
    description: >-
      **Obsoleto: Usa la API de Respuestas (`/api/v1/llm/responses`) en su
      lugar.** Puntos finales de completación de chat con soporte para
      transmisión, llamadas a herramientas y múltiples proveedores.
    x-deprecated: true
    x-displayName: Completaciones de Chat
  - name: Batches
    x-displayName: Lotes
  - name: Evals
    x-displayName: Evaluaciones
  - name: Fine-Tuning
    x-displayName: Ajuste fino
  - name: Memory Stores
    x-displayName: Almacenes de memoria
  - name: Prompts
    x-displayName: Sugerencias
  - name: API Key
    x-displayName: Clave de API
  - name: Session
    x-displayName: Sesión
  - name: Organization
    x-displayName: Organización
  - name: Cluster Admin
    x-displayName: Administrador de clúster
  - name: Sessions
    description: Crear, inspeccionar, acceder y terminar sesiones de sandbox.
    x-displayName: Sesiones
  - name: Browser
    description: >-
      Conéctate a las sesiones del navegador a través del proxy del puerto de la
      puerta de enlace. Las sesiones del navegador exponen un punto final del
      Protocolo de DevTools de Chrome en el puerto 9222.
    x-displayName: Navegador
  - name: Execution
    description: >-
      Ejecutar comandos de shell y código dentro de una sesión de sandbox
      existente.
    x-displayName: Ejecución
  - name: Workspace
    description: >-
      Inspeccionar el manifiesto del espacio de trabajo, transferir archivos o
      archivos comprimidos, y descargar artefactos generados.
    x-displayName: Espacio de trabajo
  - name: Sandbox Usage
    description: >-
      Agrega estadísticas de uso de sandbox entre sesiones, ejecución y
      operaciones del espacio de trabajo.
    x-displayName: Uso de Sandbox
  - name: Sandbox Pricing
    description: >-
      Gestión de administrador de clúster de la tarjeta de tarifas de cómputo
      del entorno aislado utilizada para el gasto presupuestado.
    x-displayName: Precios de Sandbox
  - name: schema-3_other
    x-displayName: otro
  - name: Agents
    description: Crea y gestiona definiciones de agentes reutilizables.
    x-displayName: Agentes
  - name: Agent Versions
    description: >-
      Inspeccionar el historial de configuración de un agente y revertir a una
      versión anterior.
    x-displayName: Versiones de Agente
  - name: Agent Runs
    description: >-
      Ejecutar agentes guardados e inspeccionar los resultados de ejecución
      persistidos.
    x-displayName: Ejecuta Agentes
  - name: Agent Connectors
    description: >-
      Conecta agentes guardados a canales de mensajería externos como Telegram,
      incluyendo intercambio de texto, fotos y documentos compatibles.
    x-displayName: Conectores de agentes
  - name: Agent Schedules
    description: >-
      Crea y gestiona ejecuciones de agentes programadas o recurrentes
      guardadas.
    x-displayName: Horarios de Agentes
  - name: schema-4_other
    x-displayName: otro
  - name: Budgets
    x-displayName: Presupuestos
  - name: Settings
    x-displayName: Configuración
  - name: Compute Jobs
    x-displayName: Trabajos de computación
  - name: Compute Services
    x-displayName: Servicios de computación
  - name: Compute Catalog
    x-displayName: Catálogo de cómputo
  - name: Compute Volumes
    x-displayName: Calcular volúmenes
  - name: Compute Pricing
    x-displayName: Calcular precios
  - name: Compute Secrets
    x-displayName: Calcular secretos
  - name: Compute Usage
    x-displayName: Uso de cómputo
  - name: Compute Tenants
    x-displayName: Calcular inquilinos
  - description: Crear, listar, leer, actualizar y eliminar repositorios.
    name: Repositories
    x-displayName: Repositorios
  - name: Tracking Experiments
    description: Crear y consultar experimentos del inquilino.
    x-displayName: Seguimiento de experimentos
  - name: Tracking Runs
    description: Registrar y recuperar parámetros, métricas y etiquetas de ejecución.
    x-displayName: Seguimiento de ejecuciones
paths:
  /api/v1/compute/services/{id}/scaling:
    patch:
      tags:
        - Compute Services
      summary: Reemplazar una política de escalado del servicio
      operationId: updateServiceScaling
      parameters:
        - $ref: '#/components/parameters/ComputeResourceID'
        - $ref: '#/components/parameters/ComputeIdempotencyKey'
        - $ref: '#/components/parameters/ComputeIfMatchScalingGeneration'
        - name: X-On-Behalf-Of
          in: header
          required: false
          schema:
            type: string
          description: Optional external end-user identifier forwarded by the API gateway.
      requestBody:
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ComputeScalingInput'
        required: true
      responses:
        '202':
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ComputeService'
          description: Política de escalado aceptada para la conciliación asíncrona
          headers:
            ETag:
              description: >-
                Strong entity tag containing the desired scaling-policy
                generation.
              schema:
                type: string
        default:
          $ref: '#/components/responses/ComputeError'
      security:
        - bearerAuth: []
      x-codeSamples:
        - lang: python
          label: Python (SDK)
          source: |-
            from meetkai_mka1 import SDK


            with SDK(
                bearer_auth="<YOUR_BEARER_TOKEN_HERE>",
            ) as sdk:

                res = sdk.compute_services.update_service_scaling(id="<id>", idempotency_key="<value>", idle_timeout_seconds=800181, max_replicas=693036, min_replicas=178601)

                # Handle response
                print(res)
        - lang: typescript
          label: Typescript (SDK)
          source: |-
            import { SDK } from "@meetkai/mka1";

            const sdk = new SDK({
              bearerAuth: "<YOUR_BEARER_TOKEN_HERE>",
            });

            async function run() {
              const result = await sdk.computeServices.updateServiceScaling({
                id: "<id>",
                idempotencyKey: "<value>",
                computeScalingInput: {
                  idleTimeoutSeconds: 800181,
                  maxReplicas: 693036,
                  minReplicas: 178601,
                },
              });

              console.log(result);
            }

            run();
        - lang: csharp
          label: CSharp (SDK)
          source: >-
            using MeetKai.MKA1;

            using MeetKai.MKA1.Types.Components;

            using MeetKai.MKA1.Types.Requests;


            var sdk = new SDK(bearerAuth: "<YOUR_BEARER_TOKEN_HERE>");


            UpdateServiceScalingRequest req = new UpdateServiceScalingRequest()
            {
                Id = "<id>",
                IdempotencyKey = "<value>",
                Body = new ComputeScalingInput() {
                    IdleTimeoutSeconds = 800181,
                    MaxReplicas = 693036,
                    MinReplicas = 178601,
                },
            };


            var res = await sdk.ComputeServices.UpdateServiceScalingAsync(req);


            // handle response
components:
  parameters:
    ComputeResourceID:
      in: path
      name: id
      required: true
      schema:
        type: string
    ComputeIdempotencyKey:
      in: header
      name: Idempotency-Key
      required: true
      schema:
        type: string
        minLength: 1
    ComputeIfMatchScalingGeneration:
      description: >-
        Optional strong entity tag containing the current desired scaling-policy
        generation.
      in: header
      name: If-Match
      required: false
      schema:
        type: string
        minLength: 1
  schemas:
    ComputeScalingInput:
      additionalProperties: false
      properties:
        idle_timeout_seconds:
          type: integer
          minimum: 1
        max_replicas:
          type: integer
          minimum: 1
        min_replicas:
          minimum: 0
          type: integer
        target_concurrency_per_replica:
          maximum: 10000
          minimum: 1
          type: integer
      required:
        - min_replicas
        - max_replicas
        - idle_timeout_seconds
      type: object
    ComputeService:
      allOf:
        - $ref: '#/components/schemas/ComputeResource'
        - properties:
            health:
              enum:
                - healthy
                - warming
                - degraded
              type: string
            ready:
              type: boolean
            scaling:
              $ref: '#/components/schemas/ComputeServiceScaling'
            volume:
              $ref: '#/components/schemas/ComputeVolume'
          required:
            - ready
          type: object
      unevaluatedProperties: false
    ComputeResource:
      properties:
        accrued_usd:
          format: double
          type: number
        allocated_at:
          type: string
          format: date-time
        compute:
          $ref: '#/components/schemas/ComputeRequest'
        created_at:
          type: string
          format: date-time
        current_price_usd_hr:
          format: double
          type: number
        endpoints:
          items:
            $ref: '#/components/schemas/ComputeEndpoint'
          type: array
        hardware:
          $ref: '#/components/schemas/ComputeHardware'
        id:
          type: string
        instance_price_usd_hr:
          format: double
          type: number
        limits:
          $ref: '#/components/schemas/ComputeLimits'
        name:
          type: string
        price_usd_hr:
          format: double
          type: number
        pricing_model:
          enum:
            - instance_minutes
            - instance_seconds
          type: string
        provider:
          $ref: '#/components/schemas/ComputeProviderName'
        reason:
          oneOf:
            - $ref: '#/components/schemas/ComputeReason'
            - type: 'null'
        ssh:
          $ref: '#/components/schemas/ComputeSSH'
        started_at:
          oneOf:
            - type: string
              format: date-time
            - type: 'null'
        state:
          $ref: '#/components/schemas/ComputeResourceState'
        terminal_at:
          oneOf:
            - type: string
              format: date-time
            - type: 'null'
        volumes:
          items:
            $ref: '#/components/schemas/ComputeStandaloneVolumeMount'
          type: array
      required:
        - id
        - state
        - reason
        - compute
        - accrued_usd
        - limits
        - endpoints
        - created_at
        - started_at
        - terminal_at
      type: object
    ComputeServiceScaling:
      additionalProperties: false
      properties:
        applied:
          oneOf:
            - $ref: '#/components/schemas/ComputeScalingInput'
            - type: 'null'
        applied_at:
          oneOf:
            - type: string
              format: date-time
            - type: 'null'
        applied_generation:
          format: int64
          minimum: 0
          type: integer
        autoscaler:
          $ref: '#/components/schemas/ComputeAutoscalerState'
        desired:
          $ref: '#/components/schemas/ComputeScalingInput'
        desired_generation:
          format: int64
          minimum: 1
          type: integer
        desired_updated_at:
          type: string
          format: date-time
        replicas:
          $ref: '#/components/schemas/ComputeScalingReplicas'
      required:
        - desired
        - desired_generation
        - desired_updated_at
        - applied
        - applied_generation
        - applied_at
        - replicas
        - autoscaler
      type: object
    ComputeVolume:
      additionalProperties: false
      properties:
        accrued_cost_usd:
          format: double
          type: number
        data:
          items:
            $ref: '#/components/schemas/ComputeVolumeData'
          type: array
        mount_path:
          type: string
        price_usd_hr:
          format: double
          type: number
        size_gb:
          type: integer
        status:
          enum:
            - provisioning
            - loading
            - ready
            - deleting
            - deleted
            - failed
          type: string
      required:
        - status
        - size_gb
        - mount_path
        - data
        - price_usd_hr
        - accrued_cost_usd
      type: object
    ComputeErrorEnvelope:
      additionalProperties: false
      properties:
        error:
          $ref: '#/components/schemas/ComputeError'
      required:
        - error
      type: object
    ComputeRequest:
      additionalProperties: false
      properties:
        accelerator:
          type: string
        ephemeral_disk_gb:
          type: integer
          minimum: 1
        gpu_count:
          description: >-
            GPUs adjuntas. Cero es válido solo para entradas de catálogo de
            clase CPU y es obligatorio para una.
          maximum: 8
          minimum: 0
          type: integer
        instance_count:
          description: >-
            Instancias de ejecución cooperantes idénticas por asignación. La
            omisión implica una.
          minimum: 1
          type: integer
        interconnect:
          type: string
        vcpu_count:
          description: >-
            vCPUs solicitadas. Un eje general sujeto a una capacidad que solo
            respetan los backends que la admiten; un backend que agrupa la CPU
            con la GPU la rechaza. Requerido para un acelerador de clase CPU,
            donde la memoria sigue la proporción por vCPU de la familia.
          minimum: 1
          type: integer
      required:
        - accelerator
        - gpu_count
        - ephemeral_disk_gb
      type: object
    ComputeEndpoint:
      additionalProperties: false
      properties:
        host:
          type: string
        name:
          type: string
        port:
          type: integer
        protocol:
          type: string
        url:
          type: string
      required:
        - name
        - protocol
        - host
        - port
      type: object
    ComputeHardware:
      additionalProperties: false
      properties:
        accelerator:
          type: string
        gpu_count:
          type: integer
        gpu_memory_gb:
          type: integer
        interconnect:
          type: string
      required:
        - accelerator
        - gpu_count
        - gpu_memory_gb
      type: object
    ComputeLimits:
      additionalProperties: false
      properties:
        max_cost_usd:
          exclusiveMinimum: 0
          format: double
          type: number
        max_runtime_hours:
          exclusiveMinimum: 0
          format: double
          type: number
      type: object
    ComputeProviderName:
      description: >-
        Identificador opaco del proveedor de cómputo. Los valores admitidos
        dependen de la implementación.
      minLength: 1
      type: string
    ComputeReason:
      additionalProperties: false
      properties:
        code:
          type: string
        details:
          type: object
          additionalProperties: true
        message:
          type: string
      required:
        - code
        - message
      type: object
    ComputeSSH:
      additionalProperties: false
      properties:
        command:
          type: string
        host:
          type: string
        port:
          type: integer
        user:
          type: string
      required:
        - host
        - port
        - user
        - command
      type: object
    ComputeResourceState:
      enum:
        - requested
        - allocating
        - provisioning
        - running
        - ready
        - finalizing
        - terminating
        - succeeded
        - failed
        - terminated
      type: string
    ComputeStandaloneVolumeMount:
      additionalProperties: false
      properties:
        mount_path:
          pattern: ^/
          type: string
        volume_id:
          type: string
          minLength: 1
      required:
        - volume_id
        - mount_path
      type: object
    ComputeAutoscalerState:
      additionalProperties: false
      properties:
        blocked_reason:
          oneOf:
            - type: string
            - type: 'null'
        drain_timeout_seconds:
          type: integer
          minimum: 1
        evaluation_interval_seconds:
          type: integer
          minimum: 1
        last_scale_at:
          oneOf:
            - type: string
              format: date-time
            - type: 'null'
        observed_at:
          oneOf:
            - type: string
              format: date-time
            - type: 'null'
        observed_concurrency:
          oneOf:
            - format: int64
              minimum: 0
              type: integer
            - type: 'null'
        recommended_replicas:
          oneOf:
            - type: integer
              minimum: 1
            - type: 'null'
        status:
          enum:
            - disabled
            - active
            - cooling_down
            - blocked
            - unknown
          type: string
      required:
        - status
        - observed_concurrency
        - observed_at
        - recommended_replicas
        - evaluation_interval_seconds
        - drain_timeout_seconds
        - last_scale_at
        - blocked_reason
      type: object
    ComputeScalingReplicas:
      additionalProperties: false
      properties:
        allocated:
          minimum: 0
          type: integer
        applied:
          maximum: 128
          minimum: 0
          type: integer
        applied_generation:
          format: int64
          minimum: 0
          type: integer
        decision:
          enum:
            - create
            - manual
            - autoscaler
          type: string
        desired:
          maximum: 128
          minimum: 1
          type: integer
        desired_generation:
          format: int64
          minimum: 1
          type: integer
        draining:
          minimum: 0
          type: integer
        ready:
          minimum: 0
          type: integer
        updated_at:
          type: string
          format: date-time
      required:
        - desired
        - desired_generation
        - applied
        - applied_generation
        - allocated
        - ready
        - draining
        - decision
        - updated_at
      type: object
    ComputeVolumeData:
      additionalProperties: false
      properties:
        path:
          type: string
        resolved_revision:
          oneOf:
            - type: string
            - type: 'null'
        revision:
          oneOf:
            - type: string
            - type: 'null'
        type:
          enum:
            - huggingface
            - git
          type: string
        url:
          type: string
          format: uri
      required:
        - type
        - url
        - revision
        - resolved_revision
        - path
      type: object
    ComputeError:
      additionalProperties: false
      properties:
        code:
          type: string
        details:
          type: object
          additionalProperties: true
        message:
          type: string
        request_id:
          type: string
      required:
        - code
        - message
        - request_id
      type: object
  responses:
    ComputeError:
      content:
        application/json:
          schema:
            $ref: '#/components/schemas/ComputeErrorEnvelope'
      description: API error
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      bearerFormat: API Key
      description: >-
        Gateway auth: send `Authorization: Bearer <mka1-api-key>`. For
        multi-user server-side integrations, you can also send `X-On-Behalf-Of:
        <external-user-id>`.

````