Tutorial: Visual Intelligence
Ziel: Text aus einem Bild eines Fehlerdialogs extrahieren, der sich nicht kopieren lässt. Niveau: Mittelstufe Dauer: 1 Minute
Voraussetzungen
- Vision-fähiger KI-Provider: Visual Intelligence erfordert einen Provider, der Vision-/Multimodal-Fähigkeiten unterstützt:
- OpenAI: GPT-5.4, GPT-5.5 (GPT-5.5 erfordert Pro Plus oder höher)
- Anthropic: Claude Opus 4.8 (erfordert Pro Plus oder höher), Claude Sonnet 4.6, Claude Haiku 4.5
- Google: Gemini 3.1 Pro, Gemini 3.5 Flash
- xAI: Grok 4.3
Hinweis: Wenn Ihr konfigurierter Provider keine Vision-/Multimodal-Eingabe unterstützt, sind die Visual-Intelligence-Screenshot-Commands nicht verfügbar. Konfigurieren Sie einen Vision-fähigen Provider in den Settings, bevor Sie diese Funktion nutzen.
Szenario
Eine Anwendung ist abgestürzt und hat eine Popup-Fehlermeldung angezeigt. Sie können den Text nicht mit der Maus markieren, um ihn zu googeln.
Schritt 1: Erfassen
- Drücken Sie den Screenshot Hotkey (macOS
Shift+Cmd+S, Windows/LinuxCtrl+Shift+Alt+S). - Der Bildschirm friert ein, und ein Fadenkreuz erscheint.
- Klicken und ziehen Sie einen Rahmen um den Fehlerdialog.
Schritt 2: Analysieren
Sobald Sie die Maustaste loslassen, erscheint der Rephlo-Dialog Screenshot Analysis Result.
- Wählen Sie den Command "Extract Text".
- Instruction: "You are an OCR tool. Extract all visible text exactly as it appears."
Schritt 3: Ergebnis
Rephlo gibt den Rohtext zurück:
"Error 0x8004005: Unspecified error in module lib_core.dll at address 0x4f..."
Schritt 4: Lösen
Jetzt können Sie:
- Klicken Sie auf Copy, um den Fehlercode zu kopieren.
- Führen Sie einen "Troubleshoot"-Command auf diesen extrahierten Text aus, um die KI sofort nach einer Lösung zu fragen.