Skip to main content
O ChatCLI suporta uma ampla gama de modelos dos principais provedores de IA. Troque de modelo a qualquer momento com /switch --model <nome>. Legenda de capacidades:
  • 👁 Vision — aceita imagens como entrada
  • 🔧 Tools — uso nativo de ferramentas (function calling)
  • 📋 JSON Mode — saída JSON estruturada garantida
  • 💻 Code Exec — execução de código nativa no provedor
Todos os provedores suportam streaming via SSE (Server-Sent Events). O ChatCLI habilita streaming automaticamente.
Modelos ideais para geração de código e raciocínio complexo. Suportam tanto a Chat Completions API quanto a Responses API.
O GPT-5.6 (GA em 9 de julho de 2026) chega em três tiers nomeados: Sol (flagship), Terra (equilibrado para o dia a dia) e Luna (rápido e econômico) — US4/20,US 4/20, US 2/12 e US0,20/1,20porMTokrespectivamente(oSolcaiudeUS 0,20/1,20 por MTok respectivamente (o Sol caiu de US 5/30 para US$ 4/20 em 21/ago/2026 — preço promocional válido pelo menos até 21/nov/2026). Os três funcionam com API key e com OAuth do ChatGPT (/auth login openai-codex); no backend Codex o ChatCLI envia automaticamente os headers de identificação de cliente exigidos (sem eles o backend retorna 404 para o Luna).
Specs re-verificadas em set/2026: o gpt-5.4 roda o mesmo perfil 1,05M / 128K do 5.5/5.6 (o alias gpt-5.4-pro é Responses-only, 30/30/180); gpt-5.4-mini/-nano viraram uma entrada própria de 400K / 128K; gpt-5.3-codex (Responses-only) e gpt-5.2 (+ gpt-5.2-pro, Responses-only, 21/21/168) são 400K / 128K. Os aliases gpt-5.3, gpt-5.3-mini, gpt-5.3-nano, gpt-5.2-mini e gpt-5.2-nano foram removidos — esses modelos não existem na API — assim como o gpt-5.3-codex-spark (exclusivo do app Codex, nunca foi um id da plataforma). Desligamentos anunciados pela OpenAI: o3-mini, o4-mini e gpt-4.1-nano em 23/out/2026; os snapshots gpt-5, gpt-5-mini, gpt-5-nano, gpt-5-pro e o3 em 11/dez/2026.
O roteamento entre Chat Completions e Responses API é automático por modelo via catálogo (gpt-5.x, gpt-4.1 e a série o preferem Responses; gpt-4o permanece na Chat Completions). Force Responses para todos os modelos com OPENAI_USE_RESPONSES=true. Sessões OAuth sempre usam a Responses API. Streaming habilitado para todos os modelos.

Como funciona a seleção de modelo

O ChatCLI determina qual modelo usar com a seguinte prioridade (do mais alto para o mais baixo):
  1. Flag --model na linha de comando: chatcli --model gpt-5.4
  2. Comando /switch durante a sessão: /switch --model claude-sonnet-4-6
  3. Variável de ambiente MODEL: define o modelo padrão
  4. Variável de ambiente LLM_PROVIDER: determina o provedor (openai, anthropic, google, xai, openrouter, etc.)
  5. Modelo padrão do provedor: cada provedor tem um modelo padrão definido no catálogo

Aliases de modelos

Cada modelo possui aliases que facilitam a digitação. O ChatCLI resolve aliases automaticamente para o ID canônico do modelo. Por exemplo: Aliases são definidos no catálogo de modelos e aceitos em todos os contextos: --model, /switch, e variável MODEL. Os modelos são registrados no pacote llm/catalog com metadados completos. O ChatCLI usa o catálogo para determinar automaticamente:
  • Versão da API — qual endpoint e versão de protocolo usar para cada modelo
  • Max tokens — limites de contexto e output para gerenciar prompts e respostas
  • Capacidades — quais funcionalidades estão disponíveis (vision, tools, JSON mode, etc.)
  • Headers específicos — por exemplo, o header anthropic-version varia conforme o modelo
Isso significa que ao trocar de modelo, o ChatCLI ajusta automaticamente todos os parâmetros de requisição sem necessidade de configuração manual.

Listagem dinâmica de modelos

O ChatCLI busca os modelos disponíveis diretamente da API de cada provedor, usando o token ou API key configurada. Isso garante que você veja exatamente os modelos que sua conta tem acesso — incluindo modelos novos que ainda não estão no catálogo estático.

Como funciona

  1. Ao iniciar o ChatCLI ou trocar de provedor (via /switch, /auth login, etc.), uma busca em background consulta o endpoint de modelos do provedor ativo
  2. Os modelos descobertos são cacheados para uso no autocomplete do comando /switch --model
  3. Cada sugestão indica a origem: [API] (dinâmico) ou [catalog] (estático)

Endpoints por provedor

Autocomplete inteligente

Ao digitar /switch --model e pressionar Tab, o ChatCLI sugere os modelos disponíveis:
Se a API não estiver acessível, o fallback é o catálogo estático:
Ao dar Enter com /switch --model sem valor, o ChatCLI lista todos os modelos disponíveis com indicação de origem (API ou catalog).

OAuth e listagem dinâmica

A listagem funciona tanto com API key quanto com OAuth:
  • Anthropic OAuth: usa ?beta=true e headers Chrome-like, com decompressão gzip automática
  • OpenAI OAuth: consulta o backend do ChatGPT (/backend-api/models) em vez do endpoint padrão
  • GitHub Copilot OAuth: usa o Device Flow token para consultar api.githubcopilot.com/models
Após um /auth login, o cache de modelos é atualizado automaticamente para refletir o novo provedor.

Versionamento da API Anthropic

Modelos Claude podem usar diferentes valores de anthropic-version no header da API. O catálogo gerencia isso automaticamente:
  • Modelos mais recentes (claude-fable-5-1, claude-fable-5, claude-opus-5-5, claude-opus-5, claude-sonnet-5, claude-opus-4-8, claude-opus-4-7, claude-sonnet-4-6) usam a versão mais atual da API
  • Toda entrada atual do catálogo usa a versão default; os modelos Claude 3.x aposentados que usavam headers antigos não estão mais registrados
  • O ChatCLI envia o header correto para cada modelo sem necessidade de intervenção do usuário