Pular para o conteúdo principal

Tutorial: Visual Intelligence

Objetivo: Extrair texto de uma imagem de caixa de diálogo de erro que não pode ser copiado. Nível: Intermediário Tempo: 1 minuto

Pré-requisitos

  • Provedor de IA com suporte a visão: o Visual Intelligence exige um provedor que suporte recursos de visão/multimodais:
    • OpenAI: GPT-5.4, GPT-5.5 (o GPT-5.5 exige Pro Plus ou superior)
    • Anthropic: Claude Opus 4.8 (exige Pro Plus ou superior), Claude Sonnet 4.6, Claude Haiku 4.5
    • Google: Gemini 3.1 Pro, Gemini 3.5 Flash
    • xAI: Grok 4.3

Observação: Se o provedor configurado não suportar entrada de visão/multimodal, os comandos de captura de tela do Visual Intelligence não ficarão disponíveis. Configure um provedor com suporte a visão nas Settings antes de usar esse recurso.

Cenário

Um aplicativo travou e exibiu uma mensagem de erro em um pop-up. Você não consegue selecionar o texto com o mouse para pesquisá-lo no Google.

Passo 1: Capturar

  1. Pressione o atalho de captura de tela (macOS Shift+Cmd+S, Windows/Linux Ctrl+Shift+Alt+S).
  2. A tela congela e uma mira de seleção aparece.
  3. Clique e arraste para desenhar um retângulo ao redor da caixa de diálogo de erro.

Passo 2: Analisar

Assim que você solta o mouse, a caixa de diálogo Screenshot Analysis Result do Rephlo aparece.

  1. Selecione o comando "Extract Text".
    • Instrução: "You are an OCR tool. Extract all visible text exactly as it appears."

Passo 3: Resultado

O Rephlo retorna o texto bruto:

"Error 0x8004005: Unspecified error in module lib_core.dll at address 0x4f..."

Passo 4: Resolver

Agora você pode:

  1. Copiar o código de erro.
  2. Executar um comando "Troubleshoot" sobre esse texto extraído para perguntar imediatamente à IA como corrigir o problema.