/switch --model <nome>.
Legenda de capacidades:
- 👁 Vision — aceita imagens como entrada
- 🔧 Tools — uso nativo de ferramentas (function calling)
- 📋 JSON Mode — saída JSON estruturada garantida
- 💻 Code Exec — execução de código nativa no provedor
- OpenAI
- Anthropic (Claude)
- AWS Bedrock (catálogo completo)
- Google (Gemini)
- xAI (Grok)
- GitHub Copilot
- ZAI (Zhipu AI)
- MiniMax
- Moonshot (Kimi)
- StackSpot
- Devin CLI (Cognition)
- Ollama (Local)
- OpenRouter
Modelos ideais para geração de código e raciocínio complexo. Suportam tanto a Chat Completions API quanto a Responses API.
O GPT-5.6 (GA em 9 de julho de 2026) chega em três tiers nomeados: Sol (flagship), Terra (equilibrado para o dia a dia) e Luna (rápido e econômico) — US 2,50/15 e US$ 1/6 por MTok respectivamente. Os três funcionam com API key e com OAuth do ChatGPT (
/auth login openai-codex); no backend Codex o ChatCLI envia automaticamente os headers de identificação de cliente exigidos (sem eles o backend retorna 404 para o Luna).O roteamento entre Chat Completions e Responses API é automático por modelo via catálogo (
gpt-5.x, gpt-4.1 e a série o preferem Responses; gpt-4o permanece na Chat Completions). Force Responses para todos os modelos com OPENAI_USE_RESPONSES=true. Sessões OAuth sempre usam a Responses API. Streaming habilitado para todos os modelos.Como funciona a seleção de modelo
O ChatCLI determina qual modelo usar com a seguinte prioridade (do mais alto para o mais baixo):- Flag
--modelna linha de comando:chatcli --model gpt-5.4 - Comando
/switchdurante a sessão:/switch --model claude-sonnet-4-6 - Variável de ambiente
MODEL: define o modelo padrão - Variável de ambiente
LLM_PROVIDER: determina o provedor (openai, anthropic, google, xai, openrouter, etc.) - Modelo padrão do provedor: cada provedor tem um modelo padrão definido no catálogo
Aliases de modelos
Cada modelo possui aliases que facilitam a digitação. O ChatCLI resolve aliases automaticamente para o ID canônico do modelo. Por exemplo:
Aliases são definidos no catálogo de modelos e aceitos em todos os contextos:
--model, /switch, e variável MODEL.
Sistema de catálogo
Os modelos são registrados no pacotellm/catalog com metadados completos. O ChatCLI usa o catálogo para determinar automaticamente:
- Versão da API — qual endpoint e versão de protocolo usar para cada modelo
- Max tokens — limites de contexto e output para gerenciar prompts e respostas
- Capacidades — quais funcionalidades estão disponíveis (vision, tools, JSON mode, etc.)
- Headers específicos — por exemplo, o header
anthropic-versionvaria conforme o modelo
Listagem dinâmica de modelos
O ChatCLI busca os modelos disponíveis diretamente da API de cada provedor, usando o token ou API key configurada. Isso garante que você veja exatamente os modelos que sua conta tem acesso — incluindo modelos novos que ainda não estão no catálogo estático.Como funciona
- Ao iniciar o ChatCLI ou trocar de provedor (via
/switch,/auth login, etc.), uma busca em background consulta o endpoint de modelos do provedor ativo - Os modelos descobertos são cacheados para uso no autocomplete do comando
/switch --model - Cada sugestão indica a origem:
[API](dinâmico) ou[catalog](estático)
Endpoints por provedor
Autocomplete inteligente
Ao digitar/switch --model e pressionar Tab, o ChatCLI sugere os modelos disponíveis:
OAuth e listagem dinâmica
A listagem funciona tanto com API key quanto com OAuth:- Anthropic OAuth: usa
?beta=truee headers Chrome-like, com decompressão gzip automática - OpenAI OAuth: consulta o backend do ChatGPT (
/backend-api/models) em vez do endpoint padrão - GitHub Copilot OAuth: usa o Device Flow token para consultar
api.githubcopilot.com/models
/auth login, o cache de modelos é atualizado automaticamente para refletir o novo provedor.
Versionamento da API Anthropic
Modelos Claude podem usar diferentes valores deanthropic-version no header da API. O catálogo gerencia isso automaticamente:
- Modelos mais recentes (claude-fable-5, claude-sonnet-5, claude-opus-4-8, claude-opus-4-7, claude-sonnet-4-6) usam a versão mais atual da API
- Modelos legados (claude-3-opus, claude-3-haiku) podem usar versões anteriores para compatibilidade
- O ChatCLI envia o header correto para cada modelo sem necessidade de intervenção do usuário