跳到主要内容

教程:Visual Intelligence(视觉智能)

目标:从一个无法复制文本的错误对话框图片中提取文字。 难度:中级 用时:1 分钟

前置条件

  • 具备视觉能力的 AI 提供商:Visual Intelligence 需要一个支持视觉/多模态能力的提供商:
    • OpenAI:GPT-5.4、GPT-5.5(GPT-5.5 需要 Pro Plus 或更高级别)
    • Anthropic:Claude Opus 4.8(需要 Pro Plus 或更高级别)、Claude Sonnet 4.6、Claude Haiku 4.5
    • Google:Gemini 3.1 Pro、Gemini 3.5 Flash
    • xAI:Grok 4.3

说明:如果您配置的提供商不支持视觉/多模态输入,Visual Intelligence 的截图命令将不可用。请在使用此功能前,先在 Settings 中配置一个具备视觉能力的提供商。

场景

某个应用崩溃了,并弹出一条错误提示。您无法用鼠标选中该文本去 Google 搜索。

步骤 1:捕获

  1. 按下截图热键(macOS Shift+Cmd+S,Windows/Linux Ctrl+Shift+Alt+S)。
  2. 屏幕会冻结并出现十字光标。
  3. 点击并拖拽,框选出错误对话框。

步骤 2:分析

松开鼠标后,Rephlo 的 Screenshot Analysis Result(截图分析结果) 对话框会出现。

  1. 选择 "Extract Text" 命令。
    • 指令内容:"You are an OCR tool. Extract all visible text exactly as it appears."

步骤 3:结果

Rephlo 返回原始文本:

"Error 0x8004005: Unspecified error in module lib_core.dll at address 0x4f..."

步骤 4:解决

现在您可以:

  1. **复制(Copy)**错误代码。
  2. 对提取出的文本运行一个 "Troubleshoot" 命令,立即向 AI 询问修复方法。