/switch --model <nome>.
Legenda de capacidades:
- 👁 Vision — aceita imagens como entrada
- 🔧 Tools — uso nativo de ferramentas (function calling)
- 📋 JSON Mode — saída JSON estruturada garantida
- 💻 Code Exec — execução de código nativa no provedor
- OpenAI
- Anthropic (Claude)
- AWS Bedrock (catálogo completo)
- Google (Gemini)
- xAI (Grok)
- GitHub Copilot
- ZAI (Zhipu AI)
- MiniMax
- Moonshot (Kimi)
- StackSpot
- Devin CLI (Cognition)
- Ollama (Local)
- OpenRouter
Modelos ideais para geração de código e raciocínio complexo. Suportam tanto a Chat Completions API quanto a Responses API.
O GPT-5.6 (GA em 9 de julho de 2026) chega em três tiers nomeados: Sol (flagship), Terra (equilibrado para o dia a dia) e Luna (rápido e econômico) — US 2/12 e US 5/30 para US$ 4/20 em 21/ago/2026 — preço promocional válido pelo menos até 21/nov/2026). Os três funcionam com API key e com OAuth do ChatGPT (
/auth login openai-codex); no backend Codex o ChatCLI envia automaticamente os headers de identificação de cliente exigidos (sem eles o backend retorna 404 para o Luna).Specs re-verificadas em set/2026: o
gpt-5.4 roda o mesmo perfil 1,05M / 128K do 5.5/5.6 (o alias gpt-5.4-pro é Responses-only, 180); gpt-5.4-mini/-nano viraram uma entrada própria de 400K / 128K; gpt-5.3-codex (Responses-only) e gpt-5.2 (+ gpt-5.2-pro, Responses-only, 168) são 400K / 128K. Os aliases gpt-5.3, gpt-5.3-mini, gpt-5.3-nano, gpt-5.2-mini e gpt-5.2-nano foram removidos — esses modelos não existem na API — assim como o gpt-5.3-codex-spark (exclusivo do app Codex, nunca foi um id da plataforma). Desligamentos anunciados pela OpenAI: o3-mini, o4-mini e gpt-4.1-nano em 23/out/2026; os snapshots gpt-5, gpt-5-mini, gpt-5-nano, gpt-5-pro e o3 em 11/dez/2026.O roteamento entre Chat Completions e Responses API é automático por modelo via catálogo (
gpt-5.x, gpt-4.1 e a série o preferem Responses; gpt-4o permanece na Chat Completions). Force Responses para todos os modelos com OPENAI_USE_RESPONSES=true. Sessões OAuth sempre usam a Responses API. Streaming habilitado para todos os modelos.Como funciona a seleção de modelo
O ChatCLI determina qual modelo usar com a seguinte prioridade (do mais alto para o mais baixo):- Flag
--modelna linha de comando:chatcli --model gpt-5.4 - Comando
/switchdurante a sessão:/switch --model claude-sonnet-4-6 - Variável de ambiente
MODEL: define o modelo padrão - Variável de ambiente
LLM_PROVIDER: determina o provedor (openai, anthropic, google, xai, openrouter, etc.) - Modelo padrão do provedor: cada provedor tem um modelo padrão definido no catálogo
Aliases de modelos
Cada modelo possui aliases que facilitam a digitação. O ChatCLI resolve aliases automaticamente para o ID canônico do modelo. Por exemplo:
Aliases são definidos no catálogo de modelos e aceitos em todos os contextos:
--model, /switch, e variável MODEL.
Sistema de catálogo
Os modelos são registrados no pacotellm/catalog com metadados completos. O ChatCLI usa o catálogo para determinar automaticamente:
- Versão da API — qual endpoint e versão de protocolo usar para cada modelo
- Max tokens — limites de contexto e output para gerenciar prompts e respostas
- Capacidades — quais funcionalidades estão disponíveis (vision, tools, JSON mode, etc.)
- Headers específicos — por exemplo, o header
anthropic-versionvaria conforme o modelo
Listagem dinâmica de modelos
O ChatCLI busca os modelos disponíveis diretamente da API de cada provedor, usando o token ou API key configurada. Isso garante que você veja exatamente os modelos que sua conta tem acesso — incluindo modelos novos que ainda não estão no catálogo estático.Como funciona
- Ao iniciar o ChatCLI ou trocar de provedor (via
/switch,/auth login, etc.), uma busca em background consulta o endpoint de modelos do provedor ativo - Os modelos descobertos são cacheados para uso no autocomplete do comando
/switch --model - Cada sugestão indica a origem:
[API](dinâmico) ou[catalog](estático)
Endpoints por provedor
Autocomplete inteligente
Ao digitar/switch --model e pressionar Tab, o ChatCLI sugere os modelos disponíveis:
OAuth e listagem dinâmica
A listagem funciona tanto com API key quanto com OAuth:- Anthropic OAuth: usa
?beta=truee headers Chrome-like, com decompressão gzip automática - OpenAI OAuth: consulta o backend do ChatGPT (
/backend-api/models) em vez do endpoint padrão - GitHub Copilot OAuth: usa o Device Flow token para consultar
api.githubcopilot.com/models
/auth login, o cache de modelos é atualizado automaticamente para refletir o novo provedor.
Versionamento da API Anthropic
Modelos Claude podem usar diferentes valores deanthropic-version no header da API. O catálogo gerencia isso automaticamente:
- Modelos mais recentes (claude-fable-5-1, claude-fable-5, claude-opus-5-5, claude-opus-5, claude-sonnet-5, claude-opus-4-8, claude-opus-4-7, claude-sonnet-4-6) usam a versão mais atual da API
- Toda entrada atual do catálogo usa a versão default; os modelos Claude 3.x aposentados que usavam headers antigos não estão mais registrados
- O ChatCLI envia o header correto para cada modelo sem necessidade de intervenção do usuário