> ## Documentation Index
> Fetch the complete documentation index at: https://docs.mka1.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Listar execuções da tabela de classificação para uma suíte de avaliação

> Retorna, em uma única requisição, as execuções concluídas mais recentes de cada grupo de ranking para uma suíte, com as atribuições de grupo em `groups`. Um grupo é (modelo, tarefa alvo) para execuções com restrição de task_ids e (modelo) para execuções sem restrição (task_id nulo). Monte os boards a partir de `groups`, não de run.models/run.task_ids — uma execução retornada pode citar modelos ou tarefas em cujos grupos ela não foi ranqueada. `truncated: true` significa que um limite do servidor reduziu o agregado; execuções inteiras são mantidas na ordem (melhor rank, primeiro modelo, primeira tarefa, id), então as execuções mais novas de cada grupo sobrevivem antes dos fallbacks de qualquer grupo, e nenhum grupo é descartado por ser antigo. Retome um board truncado passando `next_cursor` de volta como `cursor` e fazendo a união das respostas. Consulte a documentação de evals para a justificativa do agrupamento e as características de custo.



## OpenAPI

````yaml https://apigw.mka1.com/speakeasy.json?language=pt-BR get /api/v1/llm/evals/suites/{suite_id}/leaderboard-runs
openapi: 3.1.1
info:
  title: MKA1 API
  version: 1.1.0
  description: >-
    A API MKA1 é uma API RESTful que fornece acesso à plataforma MKA1. Aprenda
    como começar a usar a API e o SDK TypeScript
    [aqui](https://mka1.apidocumentation.com/guides/getting-started).
  license:
    name: Proprietário
servers:
  - url: https://apigw.mka1.com
    description: MKA1 API Gateway
  - url: /
    description: Relative server URL (configurable via SDK constructor)
security: []
tags:
  - name: Resource Authorization
    description: >-
      Gerencie permissões para recursos LLM. Crie recursos, conceda/revoque
      permissões e exclua recursos. Apenas os proprietários dos recursos podem
      conceder, revogar ou excluir permissões.
    x-displayName: Autorização de Recurso
  - name: Embeddings
    description: >-
      Endpoints da API de incorporação de texto para gerar representações
      vetoriais de texto. Crie incorporações semânticas para busca, clustering e
      correspondência de similaridade usando vários modelos de incorporação.
    x-displayName: Incorporações
  - name: Feedback
    description: >-
      API de feedback do usuário para avaliar e comentar sobre as conclusões de
      chat. Coleta de classificações de positivo/negativo e feedback detalhado
      para melhorar as respostas do modelo e acompanhar a satisfação do usuário.
    x-displayName: Feedback
  - name: Images
    description: >-
      Pontos de extremidade da API de geração de imagens para criar imagens a
      partir de descrições de texto. Gere imagens com controle sobre tamanho,
      qualidade e estilo.
    x-displayName: Imagens
  - name: MCP Vault
    description: >-
      API do cofre MCP para armazenar configurações de servidor MCP de
      propriedade do usuário e credenciais criptografadas. Os agentes
      referenciam IDs de cofre para que os segredos sejam resolvidos apenas no
      momento da execução da ferramenta.
    x-displayName: Cofre MCP
  - name: Speech
    description: >-
      Pontos de extremidade da API de fala para processamento de áudio. Converta
      texto em fala com som natural (TTS) ou transcreva fala em texto (STT) em
      diferentes idiomas.
    x-displayName: Discurso
  - name: Usage
    description: >-
      API de rastreamento de uso e análise para monitoramento do consumo de
      tokens, contagem de solicitações e análise de custos. Veja estatísticas
      detalhadas por usuário, modelo e período de tempo.
    x-displayName: Uso
  - name: Extract
    description: >-
      API de extração de dados estruturados para extrair informações de
      arquivos. Defina esquemas JSON para extrair dados estruturados de imagens,
      PDFs e documentos. Suporta modelos de esquema reutilizáveis.
    x-displayName: Extração
  - name: Text Classification
    description: >-
      API de classificação de texto para categorizar textos em rótulos
      predefinidos. Use modelos de IA para classificar o conteúdo textual para
      análise de sentimento, categorização de tópicos e moderação de conteúdo.
    x-displayName: Classificação de Texto
  - name: Responses
    description: >-
      API de respostas com agentes para criar agentes de IA com uso autônomo de
      ferramentas. Crie assistentes conversacionais que podem usar pesquisa na
      web, operações de arquivos, geração de imagens, execução de código,
      simulação de uso de computador e integrações MCP. Suporta processamento em
      segundo plano, streaming e monitoramento de status em tempo real.
    x-displayName: Respostas
  - name: Files
    description: >-
      API de gerenciamento de arquivos para upload, armazenamento e
      gerenciamento de arquivos com expiração automática e integração com S3.
      Faça upload de arquivos que podem ser usados com Assistentes,
      Armazenamentos Vetoriais e outras funcionalidades. Os arquivos são
      armazenados no S3 com metadados rastreados no PostgreSQL. Suporta limpeza
      automática de arquivos expirados.
    x-displayName: Arquivos
  - name: Vector Stores
    description: >-
      API de armazenamento de vetores para armazenar e pesquisar documentos
      usando embeddings. Crie armazenamentos de vetores, faça upload de arquivos
      com divisão automática e geração de embeddings, e realize pesquisas
      semânticas. Os arquivos são processados de forma assíncrona usando fluxos
      de trabalho Temporais para durabilidade. Suporta limpeza automática de
      armazenamentos expirados e LanceDB para armazenamento eficiente de
      vetores.
    x-displayName: Armazenamentos de Vetores
  - name: Conversations
    description: >-
      API de gerenciamento de conversas para armazenar e recuperar o estado da
      conversa durante chamadas à API de Resposta. Crie conversas, adicione
      itens (mensagens do usuário, mensagens do assistente, mensagens do
      sistema) e mantenha o histórico da conversa. Suporta rastreamento de
      metadados e gerenciamento de estado de diálogo em múltiplas interações.
    x-displayName: Conversa
  - name: Guardrails
    description: >-
      API de diretrizes de segurança de IA para configurar moderação de conteúdo
      e políticas de segurança. Configure listas de palavras proibidas, detecção
      de injeção de prompts e prevenção de vazamento de prompts do sistema. As
      diretrizes aplicam-se a todas as solicitações de uma conta e podem ser
      testadas antes da implementação.
    x-displayName: Guarda-corpos
  - name: Models
    description: >-
      API de listagem de modelos para descobrir modelos disponíveis. Retorna IDs
      de modelos, propriedade e metadados de todos os modelos registrados no
      gateway.
    x-displayName: Modelos
  - name: Skills
    description: >-
      API de habilidades para gerenciar pacotes versionados de instruções e
      arquivos seguindo o padrão de Habilidades do Agente. Crie, versionar e
      baixe pacotes de habilidades reutilizáveis que incluam manifestos SKILL.md
      para ambientes de agentes.
    x-displayName: Habilidades
  - name: Chat Completions
    description: >-
      **Obsoleto: Use a API de Respostas (`/api/v1/llm/responses`) em vez
      disso.** Endpoints de conclusão de chat com suporte para streaming,
      chamadas de ferramentas e múltiplos provedores.
    x-deprecated: true
    x-displayName: Conclusões de Bate-Papo
  - name: Batches
    x-displayName: Lotes
  - name: Evals
    x-displayName: Avaliações
  - name: Fine-Tuning
    x-displayName: Ajuste Fino
  - name: Memory Stores
    x-displayName: Armazenamentos de Memória
  - name: Prompts
    x-displayName: Sugestões
  - name: API Key
    x-displayName: Chave da API
  - name: Organization
    x-displayName: Organização
  - name: Cluster Admin
    x-displayName: Administrador do cluster
  - name: Sessions
    description: Crie, inspecione, acesse e encerre sessões de sandbox.
    x-displayName: Sessões
  - name: Browser
    description: >-
      Conecte-se às sessões do navegador através do proxy da porta do gateway.
      As sessões do navegador expõem um endpoint do Chrome DevTools Protocol na
      porta 9222.
    x-displayName: Navegador
  - name: Execution
    description: >-
      Executar comandos shell e código dentro de uma sessão de sandbox
      existente.
    x-displayName: Execução
  - name: Workspace
    description: >-
      Inspecione o manifesto do espaço de trabalho, transfira arquivos ou
      arquivos compactados e baixe artefatos gerados.
    x-displayName: Espaço de trabalho
  - name: Sandbox Usage
    description: >-
      Agregue estatísticas de uso da sandbox entre sessões, execução e operações
      do espaço de trabalho.
    x-displayName: Uso do Sandbox
  - name: Sandbox Pricing
    description: >-
      Gerenciamento de cluster-admin da tabela de preços de computação da
      sandbox usada para gastos orçados.
    x-displayName: Preço da Sandbox
  - name: Agents
    description: Crie e gerencie definições de agentes reutilizáveis.
    x-displayName: Agentes
  - name: Agent Versions
    description: >-
      Inspecione o histórico de configuração de um agente e reverta para uma
      versão anterior.
    x-displayName: Versões do Agente
  - name: Agent Runs
    description: Execute agentes salvos e inspecione os resultados da execução persistidos.
    x-displayName: Executa Agente
  - name: Agent Connectors
    description: >-
      Conecte agentes salvos a canais de mensagens externos, como o Telegram,
      incluindo troca de texto, foto e documentos compatíveis.
    x-displayName: Conectores de Agente
  - name: Agent Schedules
    description: Crie e gerencie execuções de agentes salvos agendadas ou recorrentes.
    x-displayName: Agendas de Agentes
  - name: schema-4_other
    x-displayName: outro
  - name: Budgets
    x-displayName: Orçamentos
  - name: Settings
    x-displayName: Configurações
  - name: Compute Jobs
    x-displayName: Jobs de Computação
  - name: Compute Services
    x-displayName: Serviços de Computação
  - name: Compute Catalog
    x-displayName: Catálogo de Computação
  - name: Compute Secrets
    x-displayName: Calcular Segredos
  - name: Compute Usage
    x-displayName: Uso de Computação
  - name: Compute Tenants
    x-displayName: Calcular Inquilinos
  - description: Criar, listar, ler, atualizar e excluir repositórios.
    name: Repositories
    x-displayName: Repositórios
  - description: >-
      Gerenciar os colaboradores explícitos de um repositório
      (leitores/escritores).
    name: Collaborators
    x-displayName: Colaboradores
paths:
  /api/v1/llm/evals/suites/{suite_id}/leaderboard-runs:
    get:
      tags:
        - Evals
      summary: Listar execuções da tabela de classificação para uma suíte de avaliação
      description: >-
        Retorna, em uma única requisição, as execuções concluídas mais recentes
        de cada grupo de ranking para uma suíte, com as atribuições de grupo em
        `groups`. Um grupo é (modelo, tarefa alvo) para execuções com restrição
        de task_ids e (modelo) para execuções sem restrição (task_id nulo).
        Monte os boards a partir de `groups`, não de run.models/run.task_ids —
        uma execução retornada pode citar modelos ou tarefas em cujos grupos ela
        não foi ranqueada. `truncated: true` significa que um limite do servidor
        reduziu o agregado; execuções inteiras são mantidas na ordem (melhor
        rank, primeiro modelo, primeira tarefa, id), então as execuções mais
        novas de cada grupo sobrevivem antes dos fallbacks de qualquer grupo, e
        nenhum grupo é descartado por ser antigo. Retome um board truncado
        passando `next_cursor` de volta como `cursor` e fazendo a união das
        respostas. Consulte a documentação de evals para a justificativa do
        agrupamento e as características de custo.
      operationId: listEvalSuiteLeaderboardRuns
      parameters:
        - name: suite_id
          in: path
          required: true
          schema:
            type: string
          example: eval_suite_aa87e2b1112a455b8deabed784372198
        - name: suite_version
          in: query
          schema:
            type: integer
            minimum: 1
            maximum: 2147483647
            description: >-
              Restrinja o ranking a execuções registradas em uma versão da
              suíte. As pontuações só são comparáveis dentro de uma versão,
              então os consumidores do leaderboard devem informar a versão que
              estão pontuando. Uma versão que a suíte não possui retorna uma
              lista vazia, não 404, então isso é lido da mesma forma que uma
              versão sem execuções concluídas ainda.
          allowEmptyValue: true
          example: 1
        - name: per_group
          in: query
          schema:
            type: integer
            minimum: 1
            maximum: 20
            default: 5
            description: >-
              Quantas execuções concluídas mais recentes manter por grupo de
              classificação. Um grupo é (modelo, tarefa alvo) para execuções
              restritas por task_ids — importações históricas registram uma
              execução por modelo e tarefa, então seus painéis são montados com
              per_group=1 — e (modelo) para execuções irrestritas, que cobrem
              todas as tarefas da sua versão. Mais de 1 permite que um
              consumidor recorra a uma execução anterior para uma tarefa cuja
              execução mais recente não tenha estatísticas utilizáveis.
          allowEmptyValue: true
          example: 5
        - name: model
          in: query
          schema:
            type: string
            minLength: 1
            maxLength: 255
            description: >-
              Restrinja o ranking aos grupos de um único modelo. Útil quando o
              consumidor já conhece os eixos da sua placa; para descobrir e
              paginar além de uma resposta truncada, use cursor/next_cursor. Um
              valor vazio é rejeitado em vez de ser tratado como omitido.
          allowEmptyValue: true
          example: meetkai:qwen3.5-35b-a3b
        - name: cursor
          in: query
          schema:
            type: string
            minLength: 1
            maxLength: 2048
            description: >-
              Cursor opaco de retomada de uma resposta truncada anterior,
              proveniente do next_cursor. Continua a ordenação exatamente de
              onde a página anterior parou — dentro de um modelo ou de um nível
              de classificação, quando foi ali que o corte ocorreu. Passe-o de
              volta literalmente; um valor malformado gera um 400. Página com um
              conjunto fixo de filtros, como o cursor da lista de execuções.
          allowEmptyValue: true
        - name: X-On-Behalf-Of
          in: header
          required: false
          schema:
            type: string
          description: Optional external end-user identifier forwarded by the API gateway.
      responses:
        '200':
          description: OK
          content:
            application/json:
              schema:
                type: object
                properties:
                  object:
                    const: eval.leaderboard_runs
                  data:
                    type: array
                    items:
                      type: object
                      properties:
                        id:
                          type: string
                        object:
                          const: eval.run
                        suite_id:
                          type: string
                        suite_version:
                          type: integer
                          minimum: -9007199254740991
                          maximum: 9007199254740991
                        suite_version_id:
                          type: string
                        status:
                          $ref: '#/components/schemas/EvalRunStatus'
                        models:
                          type: array
                          items:
                            type: string
                        task_ids:
                          anyOf:
                            - type: array
                              items:
                                type: string
                            - type: 'null'
                        judge_model:
                          anyOf:
                            - type: string
                            - type: 'null'
                        embedding_model:
                          anyOf:
                            - type: string
                            - type: 'null'
                        generation:
                          type: object
                          properties:
                            instructions:
                              type: string
                            temperature:
                              type: number
                              minimum: 0
                              maximum: 2
                            top_p:
                              type: number
                              minimum: 0
                              maximum: 1
                            max_output_tokens:
                              type: integer
                              minimum: 1
                              maximum: 9007199254740991
                            max_gen_toks:
                              type: integer
                              minimum: 1
                              maximum: 9007199254740991
                              description: lm-eval alias for max_output_tokens.
                            stop:
                              anyOf:
                                - type: string
                                - type: array
                                  minItems: 1
                                  items:
                                    type: string
                            until:
                              type: array
                              minItems: 1
                              items:
                                type: string
                              description: lm-eval generate_until stop sequences.
                            max_tool_calls:
                              type: integer
                              minimum: 1
                              maximum: 9007199254740991
                            reasoning: {}
                            text: {}
                            tools:
                              type: array
                              items:
                                anyOf:
                                  - {}
                                  - type: 'null'
                            tool_choice: {}
                            parallel_tool_calls:
                              type: boolean
                            truncation:
                              enum:
                                - auto
                                - disabled
                              type: string
                            service_tier:
                              enum:
                                - auto
                                - default
                                - flex
                                - priority
                              type: string
                            presence_penalty:
                              type: number
                              minimum: -2
                              maximum: 2
                            frequency_penalty:
                              type: number
                              minimum: -2
                              maximum: 2
                            top_k:
                              type: integer
                              minimum: 0
                              maximum: 9007199254740991
                            min_p:
                              type: number
                              minimum: 0
                              maximum: 1
                            repetition_penalty:
                              type: number
                              minimum: 0
                            do_sample:
                              type: boolean
                            extra_body:
                              type: object
                              propertyNames:
                                type: string
                              additionalProperties: {}
                            chat_template_kwargs:
                              type: object
                              propertyNames:
                                type: string
                              additionalProperties: {}
                            prefill_think:
                              anyOf:
                                - type: boolean
                                - type: string
                            use_cache:
                              type: boolean
                            timeout_seconds:
                              type: integer
                              minimum: 1
                              maximum: 3600
                            max_retries:
                              type: integer
                              minimum: 0
                              maximum: 10
                            max_empty_retries:
                              type: integer
                              minimum: 0
                              maximum: 10
                          additionalProperties: {}
                        request_counts:
                          type: object
                          properties:
                            total:
                              type: integer
                              minimum: -9007199254740991
                              maximum: 9007199254740991
                            completed:
                              type: integer
                              minimum: -9007199254740991
                              maximum: 9007199254740991
                            failed:
                              type: integer
                              minimum: -9007199254740991
                              maximum: 9007199254740991
                          required:
                            - total
                            - completed
                            - failed
                        metrics:
                          anyOf:
                            - type: object
                              propertyNames:
                                type: string
                              additionalProperties: {}
                            - type: 'null'
                        error:
                          anyOf:
                            - type: object
                              propertyNames:
                                type: string
                              additionalProperties: {}
                            - type: 'null'
                        artifact_file_ids:
                          type: array
                          items:
                            type: string
                        metadata:
                          type: object
                          propertyNames:
                            type: string
                            maxLength: 64
                          additionalProperties:
                            type: string
                            maxLength: 512
                        created_at:
                          type: integer
                          minimum: -9007199254740991
                          maximum: 9007199254740991
                        started_at:
                          anyOf:
                            - type: integer
                              minimum: -9007199254740991
                              maximum: 9007199254740991
                            - type: 'null'
                        completed_at:
                          anyOf:
                            - type: integer
                              minimum: -9007199254740991
                              maximum: 9007199254740991
                            - type: 'null'
                        cancelled_at:
                          anyOf:
                            - type: integer
                              minimum: -9007199254740991
                              maximum: 9007199254740991
                            - type: 'null'
                        failed_at:
                          anyOf:
                            - type: integer
                              minimum: -9007199254740991
                              maximum: 9007199254740991
                            - type: 'null'
                      required:
                        - id
                        - object
                        - suite_id
                        - suite_version
                        - suite_version_id
                        - status
                        - models
                        - task_ids
                        - judge_model
                        - embedding_model
                        - generation
                        - request_counts
                        - metrics
                        - error
                        - artifact_file_ids
                        - metadata
                        - created_at
                        - started_at
                        - completed_at
                        - cancelled_at
                        - failed_at
                    description: The deduplicated runs behind `groups`, newest first.
                  groups:
                    type: array
                    items:
                      $ref: '#/components/schemas/EvalLeaderboardRunGroup'
                    description: >-
                      The server's group assignments — build boards from these,
                      not from run.models/run.task_ids. Ordered by model, then
                      task id with the covers-everything group first within each
                      model, then rank; that ordering is contract.
                  truncated:
                    type: boolean
                    description: >-
                      True when a server ceiling trimmed the aggregate. Whole
                      runs are kept in (rank, model, task) order — never dropped
                      for being old; resume with `cursor: next_cursor`.
                  next_cursor:
                    anyOf:
                      - type: string
                      - type: 'null'
                    description: >-
                      Set when truncated: pass as `cursor` on the next request
                      and union the responses until truncated is false to
                      assemble the complete aggregate. Null when this response
                      is complete.
                required:
                  - object
                  - data
                  - groups
                  - truncated
                  - next_cursor
              example:
                object: eval.leaderboard_runs
                data:
                  - id: eval_run_aa87e2b1112a455b8deabed784372198
                    object: eval.run
                    suite_id: eval_suite_aa87e2b1112a455b8deabed784372198
                    suite_version: 1
                    suite_version_id: eval_sver_aa87e2b1112a455b8deabed784372198
                    status: in_progress
                    models:
                      - auto
                    task_ids: null
                    judge_model: auto
                    embedding_model: auto
                    generation:
                      temperature: 0
                      max_output_tokens: 512
                    request_counts:
                      total: 100
                      completed: 10
                      failed: 0
                    metrics: null
                    error: null
                    artifact_file_ids: []
                    metadata:
                      purpose: mvp
                    created_at: 1704067200
                    started_at: 1704067210
                    completed_at: null
                    cancelled_at: null
                    failed_at: null
                groups:
                  - model: meetkai:qwen3.5-35b-a3b
                    task_id: null
                    rank: 1
                    run_id: eval_run_aa87e2b1112a455b8deabed784372198
                truncated: false
                next_cursor: null
      security:
        - bearerAuth: []
      x-codeSamples:
        - lang: python
          label: Python (SDK)
          source: |-
            from meetkai_mka1 import SDK


            with SDK(
                bearer_auth="<YOUR_BEARER_TOKEN_HERE>",
            ) as sdk:

                res = sdk.llm.evals.list_suite_leaderboard_runs(suite_id="eval_suite_aa87e2b1112a455b8deabed784372198", suite_version=1, per_group=5, model="meetkai:qwen3.5-35b-a3b")

                # Handle response
                print(res)
        - lang: typescript
          label: Typescript (SDK)
          source: |-
            import { SDK } from "@meetkai/mka1";

            const sdk = new SDK({
              bearerAuth: "<YOUR_BEARER_TOKEN_HERE>",
            });

            async function run() {
              const result = await sdk.llm.evals.listSuiteLeaderboardRuns({
                suiteId: "eval_suite_aa87e2b1112a455b8deabed784372198",
                suiteVersion: 1,
                model: "meetkai:qwen3.5-35b-a3b",
              });

              console.log(result);
            }

            run();
        - lang: csharp
          label: CSharp (SDK)
          source: >-
            using MeetKai.MKA1;

            using MeetKai.MKA1.Types.Components;

            using MeetKai.MKA1.Types.Requests;


            var sdk = new SDK(bearerAuth: "<YOUR_BEARER_TOKEN_HERE>");


            ListEvalSuiteLeaderboardRunsRequest req = new
            ListEvalSuiteLeaderboardRunsRequest() {
                SuiteId = "eval_suite_aa87e2b1112a455b8deabed784372198",
                SuiteVersion = 1,
                Model = "meetkai:qwen3.5-35b-a3b",
            };


            var res = await sdk.Llm.Evals.ListSuiteLeaderboardRunsAsync(req);


            // handle response
components:
  schemas:
    EvalRunStatus:
      enum:
        - queued
        - in_progress
        - finalizing
        - completed
        - failed
        - cancelling
        - cancelled
      type: string
    EvalLeaderboardRunGroup:
      type: object
      properties:
        model:
          type: string
          description: O modelo do grupo.
        task_id:
          anyOf:
            - type: string
            - type: 'null'
          description: >-
            A tarefa-alvo do grupo, ou nulo para o grupo de cobertura total por
            modelo no qual execuções irrestritas (sem task_ids) são
            classificadas — essas execuções cobrem todas as tarefas da sua
            versão.
        rank:
          type: integer
          minimum: -9007199254740991
          maximum: 9007199254740991
          description: >-
            1 é a execução concluída mais recente do grupo. As classificações
            ordenam as execuções dentro de um grupo, mas não são índices de
            slot: sob truncamento, as classificações sobreviventes de um grupo
            podem não ser contíguas.
        run_id:
          type: string
          description: >-
            A execução que possui este rank; o objeto de execução completo está
            em `data`.
      required:
        - model
        - task_id
        - rank
        - run_id
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      bearerFormat: API Key
      description: >-
        Gateway auth: send `Authorization: Bearer <mka1-api-key>`. For
        multi-user server-side integrations, you can also send `X-On-Behalf-Of:
        <external-user-id>`.

````