Skip to main content
O tool @image gera e edita imagens via o pacote llm/imagegen, local/keyless-first e multi-provedor.

Seleção de backend (local primeiro)

imagegen.NewFromEnv escolhe, degradando para null quando nada está configurado:
  1. CHATCLI_IMAGE_PROVIDER=sdwebuiStable Diffusion WebUI local (/sdapi/v1/txt2img, default http://localhost:7860). Keyless — o caminho preferido.
  2. CHATCLI_IMAGE_URL → endpoint OpenAI-compatível (/images/generations). Cobre OpenAI, LocalAI e similares.
  3. OPENAI_API_KEYOpenAI Images API (default gpt-image-2).
  4. CHATCLI_IMAGE_PROVIDER=responses (ou openai + CHATCLI_IMAGE_API=responses) → OpenAI Responses API, onde um modelo de chat como gpt-5.6-sol gera a imagem via a tool image_generation.
  5. GOOGLEAI_API_KEY/GEMINI_API_KEYGoogle nativo (Gemini image / “Nano Banana” :generateContent, gera e edita; default gemini-3.1-flash-image — a família Imagen :predict foi desligada pelo Google em 17/08/2026).
  6. XAI_API_KEYxAI Grok Imagine nativo (shape OpenAI, omite size; default grok-imagine-image-2.0). Só gera.
  7. CHATCLI_IMAGE_PROVIDER=bedrockAWS Bedrock (Stability / Nova Canvas via InvokeModel, reusando a cadeia de credenciais do provider de chat).
CHATCLI_IMAGE_PROVIDER fixa o backend (sdwebui|url|openai|responses|google|xai|zai|minimax|bedrock); CHATCLI_IMAGE_API escolhe images|responses no OpenAI; CHATCLI_IMAGE_MODEL ajusta o modelo.
O modelo é herdado por geração E edição. @image gen e @image edit leem o mesmo CHATCLI_IMAGE_MODEL/CHATCLI_IMAGE_PROVIDER — um único /model-image vale para os dois. Você nunca configura “um modelo para criar e outro para editar”.

Tool @image

edit aceita image (caminho), mask (PNG opcional para inpainting), strength (0..1 — quanto mudar a imagem). O resultado reporta o(s) caminho(s) do(s) arquivo(s).

Edição multi-provedor (não depende de um só)

Edição é uma capacidade por-API — nem todo backend de geração tem endpoint de edição. O @image edit é gateado por capability: backends que editam recebem o Edit; os que só geram recusam de forma clara (e roteiam, veja abaixo).

Herança e roteamento automático

A edição herda o provider/modelo ativo. Só quando o backend ativo não edita é que o @image edit roteia para um fallback edit-capable — e avisa explicitamente:
ℹ️ O backend de imagem "xai" não edita imagens; roteado para "sdwebui" nesta edição. Defina CHATCLI_IMAGE_EDIT_PROVIDER para fixar outro.
Ordem do fallback (cada um gated por credencial, nunca roteia para algo que não roda):
Você pode fixar o editor sem mexer no provider de geração:
Se nenhum editor estiver disponível, o tool mostra um erro claro listando os backends que editam e como configurá-los.

Modelos & configuração por comando

Catálogo (resumo, ago/2026): OpenAI Images gpt-image-2 (default; os antigos gpt-image-1/1.5/1-mini estão deprecados e desligam no fim de 2026); OpenAI Responses gpt-5.6-sol/gpt-5.6-terra/gpt-5.6-luna, gpt-5.5; Google gemini-3.1-flash-image (default), gemini-3.1-flash-lite-image, gemini-3-pro-image (gemini-2.5-flash-image desliga em 02/10/2026; Imagen foi desligado em 17/08/2026); xAI grok-imagine-image-2.0 (default), grok-imagine-image; Z.AI glm-image, cogview-4-250304; MiniMax image-01; Bedrock stability.stable-image-core-v1:1 (default), stability.stable-image-ultra-v1:1, stability.sd3-5-large-v1:0, amazon.nova-canvas-v1:0 (legado, EOL 30/09/2026).

Formatos & detalhes

  • OpenAI edits aceita image/jpeg, image/png, image/webp (não gif). O Content-Type do part multipart é enviado corretamente a partir dos bytes da imagem.
  • SD WebUI img2img usa denoising_strength (mapeado de strength); default 0.6 (mudança visível preservando a estrutura).
  • Bedrock Stability usa mode: image-to-image + strength; Nova Canvas (legado) usa IMAGE_VARIATION com similarityStrength.

Privacidade & custo

  • Stable Diffusion WebUI local é keyless, gera e edita na sua máquina — ideal para privacidade e custo zero.
  • Backends de nuvem usam a chave do próprio usuário.
  • Confirme antes de gerar/editar lotes grandes; mencione o custo quando aplicável.

Relacionado