教程:Visual Intelligence(视觉智能)
目标:从一个无法复制文本的错误对话框图片中提取文字。 难度:中级 用时:1 分钟
前置条件
- 具备视觉能力的 AI 提供商:Visual Intelligence 需要一个支持视觉/多模态能力的提供商:
- OpenAI:GPT-5.4、GPT-5.5(GPT-5.5 需要 Pro Plus 或更高级别)
- Anthropic:Claude Opus 4.8(需要 Pro Plus 或更高级别)、Claude Sonnet 4.6、Claude Haiku 4.5
- Google:Gemini 3.1 Pro、Gemini 3.5 Flash
- xAI:Grok 4.3
说明:如果您配置的提供商不支持视觉/多模态输入,Visual Intelligence 的截图命令将不可用。请在使用此功能前,先在 Settings 中配置一个具备视觉能力的提供商。
场景
某个应用崩溃了,并弹出一条错误提示。您无法用鼠标选中该文本去 Google 搜索。
步骤 1:捕获
- 按下截图热键(macOS
Shift+Cmd+S,Windows/LinuxCtrl+Shift+Alt+S)。 - 屏幕会冻结并出现十字光标。
- 点击并拖拽,框选出错误对话框。
步骤 2:分析
松开鼠标后,Rephlo 的 Screenshot Analysis Result(截图分析结果) 对话框会出现。
- 选择 "Extract Text" 命令。
- 指令内容:"You are an OCR tool. Extract all visible text exactly as it appears."
步骤 3:结果
Rephlo 返回原始文本:
"Error 0x8004005: Unspecified error in module lib_core.dll at address 0x4f..."
步骤 4:解决
现在您可以:
- **复制(Copy)**错误代码。
- 对提取出的文本运行一个 "Troubleshoot" 命令,立即向 AI 询问修复方法。