Skip to main content
GET
Listar modelos do gateway
Por padrão, este endpoint retorna somente modelos que podem ser roteados no momento. Defina availability=all para incluir modelos conhecidos, mas que ainda não estão disponíveis. As respostas do catálogo ficam em cache por cinco minutos e podem ser servidas por mais cinco minutos enquanto o cache é revalidado. Isso se aplica às representações JSON, RSS e Atom do catálogo atual; o feed de lançamentos tem seu próprio cache de consulta, com duração menor. GET /models/me está reservado para uma filtragem futura de modelos com base nos guardrails do solicitante atual. No momento, ele retorna 501 not implemented; por isso, use GET /models para consultar o catálogo compartilhado do Gateway.

Filtros úteis

  • endpoints usa nomes públicos, como chat.completions, responses e messages
  • status filtra o ciclo de vida do modelo, por exemplo, active, deprecated ou retired
  • provider filtra pelo ID público do provedor, por exemplo, openai, anthropic ou google_vertex
  • provider_status filtra o nível de rollout do provedor, como active, beta, alpha ou not_ready
  • provider_routing_status filtra o estado de roteamento do provedor
  • model_routing_status filtra o estado de roteamento do modelo
  • capability_status filtra o estado de capacidade do provedor para o mapeamento do endpoint solicitado
  • provider_availability_status filtra a disponibilidade do provedor, como active, coming_soon ou inactive
  • provider_availability_reason filtra o motivo de disponibilidade do provedor, como preview_only, provider_not_ready, gated, access_limited ou region_limited
  • organisation filtra pelo prefixo do ID público do modelo, por exemplo, anthropic em anthropic/claude-3-haiku
  • availability=active é o padrão
  • availability=all inclui modelos ou provedores coming_soon, inactive ou ainda não roteáveis publicamente
  • input_modalities é um alias de input_types
  • output_modalities é um alias de output_types
  • supported_parameters é um alias de params
Para consultar o contrato de endpoint de um modelo, chame GET /models/{author}/{slug}/endpoints. A resposta separa as rotas dos provedores e inclui, em cada linha, o caminho público, as modalidades, os detalhes dos parâmetros compatíveis, a disponibilidade, o estado do roteamento, o slug do modelo no provedor e um resumo de preços. As entradas de provedores também podem incluir:
  • availability_status
  • availability_reason
  • provider_status
  • provider_routing_status
  • model_routing_status
  • capability_status

Resposta

availability_reason é o campo único que explica por que uma entrada de provedor está ativa, disponível apenas em prévia ou inativa.

Autorizações

Authorization
string
header
obrigatório

Autenticação com token Bearer

Parâmetros de consulta

Pesquisa sem diferenciar maiúsculas e minúsculas em identificadores, nomes e descrições de modelos e organizações.

Maximum string length: 200

Pesquisa de provedores ou organizações de modelos sem diferenciar maiúsculas e minúsculas.

Maximum string length: 100
input_modality
enum<string>

Exigir uma modalidade de entrada suportada.

Opções disponíveis:
text,
image,
audio,
video
minimum_context_tokens
number

Exigir pelo menos esta quantidade de tokens de contexto de entrada.

Intervalo obrigatório: x >= 0
maximum_input_price_per_million
number

Preço máximo em USD de entrada por milhão de tokens.

Intervalo obrigatório: x >= 0
gateway_available_only
boolean
padrão:false

Retornar apenas modelos com pelo menos uma oferta roteável do gateway.

sort_by
enum<string>
padrão:relevance

Campo usado para ordenar os resultados da descoberta de modelos.

Opções disponíveis:
relevance,
input_price,
output_price,
context_length,
provider_count
sort_order
enum<string>

Direção de ordenação opcional. Preços são ordenados de forma crescente por padrão; outros valores numéricos, de forma decrescente.

Opções disponíveis:
asc,
desc
endpoints
string[]

Filtrar por endpoints

organisation

Filtrar por organização Identificador da organização.

Opções disponíveis:
01-ai,
adept,
ai21,
aion-labs,
aisingapore,
alibaba,
allenai,
amazon,
anthracite-org,
anthropic,
arcee-ai,
baai,
baichuan,
baidu,
bigcode,
black-forest-labs,
bytedance,
bytedance-seed,
cogito,
cognitivecomputations,
cohere,
crofai,
cursor,
cyfragovpl,
databricks,
decart,
deepseek,
dots-studio,
early-access,
eleven-labs,
essential-ai,
fastino,
fish-audio,
github,
google,
gryphe,
hexgrad,
ibm,
ibm-granite,
inception,
inclusionai,
inference-net,
inflection,
intfloat,
jetbrains,
kblab,
kling,
kuaishou,
kwaipilot,
kwaivgi,
lg,
lightricks,
liquid-ai,
mancer,
medaibase,
meituan,
meta,
microsoft,
mindai,
minimax,
mistral,
mistralai,
moonshotai,
morph,
naver-hyperclova,
near-ai,
nex-agi,
nous,
nousresearch,
novasearch,
nvidia,
openai,
openbmb,
opencompass,
opengvlab,
orcarouter,
ornith,
perceptron,
perplexity,
phala,
pixverse,
poe,
poolside,
prime-intellect,
prism-ml,
qwen,
reka,
relace,
runway,
sakana,
sao10k,
sapiens-ai,
sentence-transformers,
sference,
shanghai-ai-laboratory,
shengshu-ai,
snowflake,
sourceful,
spacex-ai,
speakleash,
stability-ai,
stealth,
stepfun,
suno,
tencent,
thedrummer,
thinking-machines,
undi95,
upstage,
venice,
vercel,
villanova-ai,
voyage,
windsurf,
writer,
xai,
xgenerationlab,
xiaomi,
z-ai,
zyphra
provider
string[]

Filtrar por ID do provedor

provider_status
string[]

Filtrar pelo status de lançamento do provedor

provider_routing_status
string[]

Filtrar pelo status de roteamento do provedor

model_routing_status
string[]

Filtrar pelo status de roteamento do modelo

capability_status
string[]

Filtrar pelo status de recursos do provedor

provider_availability_status
string[]

Filtrar pelo status de disponibilidade do provedor

provider_availability_reason
string[]

Filtrar pelo motivo de disponibilidade do provedor

status
string[]

Filtrar pelo status do modelo

input_types
string[]

Filtrar por tipos de entrada

input_modalities
string[]

Alias público de input_types.

output_types
string[]

Filtrar por tipos de saída

output_modalities
string[]

Alias público de output_types.

params
string[]

Filtrar por parâmetros

supported_parameters
string[]

Alias público de params.

availability
enum<string>
padrão:active

Filtro de disponibilidade. active retorna somente modelos roteáveis publicamente; all inclui registros de disponibilidade não roteáveis.

Opções disponíveis:
active,
all
limit
integer
padrão:50

Limitar o número de resultados

Intervalo obrigatório: 1 <= x <= 250
offset
integer
padrão:0

Deslocamento da paginação

Intervalo obrigatório: 0 <= x <= 5000
format
enum<string>
padrão:json

Formato da resposta. O padrão é json.

Opções disponíveis:
json,
rss,
atom
feed
enum<string>

Alias de format. Aceita json, rss ou atom.

Opções disponíveis:
json,
rss,
atom

Resposta

Lista de modelos

ok
boolean
obrigatório
Exemplo:

true

availability_mode
enum<string>
obrigatório
Opções disponíveis:
active,
all
Exemplo:

"active"

limit
integer
obrigatório
Intervalo obrigatório: 1 <= x <= 250
Exemplo:

50

offset
integer
obrigatório
Intervalo obrigatório: 0 <= x <= 5000
Exemplo:

0

total
integer
obrigatório
Intervalo obrigatório: x >= 0
Exemplo:

128

models
object[]
obrigatório
Última modificação em 2 de outubro de 2026