Zum Hauptinhalt springen

Tutorial: Visual Intelligence

Ziel: Text aus einem Bild eines Fehlerdialogs extrahieren, der sich nicht kopieren lässt. Niveau: Mittelstufe Dauer: 1 Minute

Voraussetzungen

  • Vision-fähiger KI-Provider: Visual Intelligence erfordert einen Provider, der Vision-/Multimodal-Fähigkeiten unterstützt:
    • OpenAI: GPT-5.4, GPT-5.5 (GPT-5.5 erfordert Pro Plus oder höher)
    • Anthropic: Claude Opus 4.8 (erfordert Pro Plus oder höher), Claude Sonnet 4.6, Claude Haiku 4.5
    • Google: Gemini 3.1 Pro, Gemini 3.5 Flash
    • xAI: Grok 4.3

Hinweis: Wenn Ihr konfigurierter Provider keine Vision-/Multimodal-Eingabe unterstützt, sind die Visual-Intelligence-Screenshot-Commands nicht verfügbar. Konfigurieren Sie einen Vision-fähigen Provider in den Settings, bevor Sie diese Funktion nutzen.

Szenario

Eine Anwendung ist abgestürzt und hat eine Popup-Fehlermeldung angezeigt. Sie können den Text nicht mit der Maus markieren, um ihn zu googeln.

Schritt 1: Erfassen

  1. Drücken Sie den Screenshot Hotkey (macOS Shift+Cmd+S, Windows/Linux Ctrl+Shift+Alt+S).
  2. Der Bildschirm friert ein, und ein Fadenkreuz erscheint.
  3. Klicken und ziehen Sie einen Rahmen um den Fehlerdialog.

Schritt 2: Analysieren

Sobald Sie die Maustaste loslassen, erscheint der Rephlo-Dialog Screenshot Analysis Result.

  1. Wählen Sie den Command "Extract Text".
    • Instruction: "You are an OCR tool. Extract all visible text exactly as it appears."

Schritt 3: Ergebnis

Rephlo gibt den Rohtext zurück:

"Error 0x8004005: Unspecified error in module lib_core.dll at address 0x4f..."

Schritt 4: Lösen

Jetzt können Sie:

  1. Klicken Sie auf Copy, um den Fehlercode zu kopieren.
  2. Führen Sie einen "Troubleshoot"-Command auf diesen extrahierten Text aus, um die KI sofort nach einer Lösung zu fragen.