@image gera e edita imagens via o pacote llm/imagegen, local/keyless-first e multi-provedor.
Seleção de backend (local primeiro)
imagegen.NewFromEnv escolhe, degradando para null quando nada está configurado:
CHATCLI_IMAGE_PROVIDER=sdwebui→ Stable Diffusion WebUI local (/sdapi/v1/txt2img, defaulthttp://localhost:7860). Keyless — o caminho preferido.CHATCLI_IMAGE_URL→ endpoint OpenAI-compatível (/images/generations). Cobre OpenAI, LocalAI e similares.OPENAI_API_KEY→ OpenAI Images API (defaultgpt-image-2).CHATCLI_IMAGE_PROVIDER=responses(ouopenai+CHATCLI_IMAGE_API=responses) → OpenAI Responses API, onde um modelo de chat comogpt-5.6-solgera a imagem via a toolimage_generation.GOOGLEAI_API_KEY/GEMINI_API_KEY→ Google nativo (Gemini image / “Nano Banana”:generateContent, gera e edita; defaultgemini-3.1-flash-image— a família Imagen:predictfoi desligada pelo Google em 17/08/2026).XAI_API_KEY→ xAI Grok Imagine nativo (shape OpenAI, omitesize; defaultgrok-imagine-image-2.0). Só gera.CHATCLI_IMAGE_PROVIDER=bedrock→ AWS Bedrock (Stability / Nova Canvas viaInvokeModel, reusando a cadeia de credenciais do provider de chat).
CHATCLI_IMAGE_PROVIDER fixa o backend (sdwebui|url|openai|responses|google|xai|zai|minimax|bedrock); CHATCLI_IMAGE_API escolhe images|responses no OpenAI; CHATCLI_IMAGE_MODEL ajusta o modelo.
O modelo é herdado por geração E edição.
@image gen e @image edit leem o mesmo CHATCLI_IMAGE_MODEL/CHATCLI_IMAGE_PROVIDER — um único /model-image vale para os dois. Você nunca configura “um modelo para criar e outro para editar”.Tool @image
edit aceita image (caminho), mask (PNG opcional para inpainting), strength (0..1 — quanto mudar a imagem). O resultado reporta o(s) caminho(s) do(s) arquivo(s).
Edição multi-provedor (não depende de um só)
Edição é uma capacidade por-API — nem todo backend de geração tem endpoint de edição. O@image edit é gateado por capability: backends que editam recebem o Edit; os que só geram recusam de forma clara (e roteiam, veja abaixo).
Herança e roteamento automático
A edição herda o provider/modelo ativo. Só quando o backend ativo não edita é que o@image edit roteia para um fallback edit-capable — e avisa explicitamente:
ℹ️ O backend de imagemOrdem do fallback (cada um gated por credencial, nunca roteia para algo que não roda):"xai"não edita imagens; roteado para"sdwebui"nesta edição. DefinaCHATCLI_IMAGE_EDIT_PROVIDERpara fixar outro.
Modelos & configuração por comando
gpt-image-2 (default; os antigos gpt-image-1/1.5/1-mini estão deprecados e desligam no fim de 2026); OpenAI Responses gpt-5.6-sol/gpt-5.6-terra/gpt-5.6-luna, gpt-5.5; Google gemini-3.1-flash-image (default), gemini-3.1-flash-lite-image, gemini-3-pro-image (gemini-2.5-flash-image desliga em 02/10/2026; Imagen foi desligado em 17/08/2026); xAI grok-imagine-image-2.0 (default), grok-imagine-image; Z.AI glm-image, cogview-4-250304; MiniMax image-01; Bedrock stability.stable-image-core-v1:1 (default), stability.stable-image-ultra-v1:1, stability.sd3-5-large-v1:0, amazon.nova-canvas-v1:0 (legado, EOL 30/09/2026).
Formatos & detalhes
- OpenAI edits aceita
image/jpeg,image/png,image/webp(nãogif). OContent-Typedo part multipart é enviado corretamente a partir dos bytes da imagem. - SD WebUI img2img usa
denoising_strength(mapeado destrength); default0.6(mudança visível preservando a estrutura). - Bedrock Stability usa
mode: image-to-image+strength; Nova Canvas (legado) usaIMAGE_VARIATIONcomsimilarityStrength.
Privacidade & custo
- Stable Diffusion WebUI local é keyless, gera e edita na sua máquina — ideal para privacidade e custo zero.
- Backends de nuvem usam a chave do próprio usuário.
- Confirme antes de gerar/editar lotes grandes; mencione o custo quando aplicável.
Relacionado
- Entrada de Imagem (Visão) — o modelo vê imagens que você anexa
- Text-to-Speech & Voz
- Chat Gateway