Googlebook 的 Magic Pointer 有一个很大的改变:

以前使用 AI,

你常常要:

Copy。

开 Gemini。

Paste。

再解释:

「我现在正在看的是什么。」

Magic Pointer 直接把 Gemini 带到:

你正在看的地方。

所以 Prompt 可以短很多。

但这也很容易出现另一个问题:

你晃一下 Cursor,

然后只说:

「帮我处理一下。」

AI 看得到 Context,

不代表它知道:

你到底只想看哪一块?

你要它做到哪一步?

哪一步现在还不要做?

今天只学一个很简单的方法:

每次叫出 Magic Pointer 前,

先补三件事:

看哪里。

要什么。

不要做什么。

第一句:看哪里

Google 官方对 Magic Pointer 的设计重点,

就是让 Gemini 理解:

你目前指着的:

文字。

图片。

以及相关 Context。

Google DeepMind 甚至把这种交互概念称为:

Show and Tell。

以前你要写:

「请看网页中间第三段里的日期。」

现在可以:

直接选它。

所以第一个动作不是:

写更长 Prompt。

而是:

先把真正需要的内容选出来。

例如你正在看一份:

Marathon Training Plan。

里面有:

训练日期。

里程。

饮食建议。

广告。

其他文章链接。

但你今天只需要:

跑步日期。

那就先选:

真正包含日期与训练安排的区域。

不要一开始就把整个页面都当成任务。

第二句:要什么

选好 Context 之后,

再告诉 Gemini:

你现在要的结果到底是什么?

例如不要只说:

「帮我整理。」

可以改成:

「只整理成日期+训练项目的清单。」

这里重点不是 Prompt 写得漂亮。

而是让输出有:

终点。

例如:

摘要成 5 点。

列出三个日期。

比较两个产品。

找出可疑信号。

把选取内容翻译成繁体中文。

整理成待办清单。

AI 已经知道「这是什么」之后,

你真正需要补的是:

「我要它变成什么。」

第三句:不要做什么

这是最容易被省略的一句。

Google 官方直接示范:

Magic Pointer 可以选取 Marathon Training Plan,

再让 Gemini 把那些训练:

排进 Google Calendar。

也就是它不一定只:

看。

还可能进一步:

做。

所以如果你现在其实只想先确认日期,

可以直接补一句:

「先不要加入 Calendar。」

这就是第三层:

不要做什么。

三句合起来,就变得很清楚

不要:

「帮我处理这个。」

改成:

看哪里:

只看我目前选取的训练日期。

要什么:

整理成日期+训练项目的清单。

不要做什么:

先不要加入 Calendar。

就是这么简单。

为什么 Magic Pointer 反而更需要这三句?

因为传统 Chatbot 最大的麻烦是:

Context 不够。

所以你一直补数据。

Magic Pointer 想解决这件事。

Google DeepMind 的设计方向就是:

让 Pointer 理解:

你正在指什么。

例如:

一个 Word。

一个 Paragraph。

图片某一部分。

Code Block。

甚至可以只说:

「Fix this。」

「Move that。」

不必每次重新描述整个世界。

这很方便。

但 Prompt 变短之后,

另一种歧义就开始变重要:

你要它做到哪里停?

例子一:看到可疑 Email

Google 官方示范:

你可以 Hover 一封可疑 Email,

让 Gemini 同时分析:

文字。

图片。

判断它比较像:

Spam

还是:

正常 Email。

这时不要只问:

「这封怎么办?」

可以改成:

看哪里:

只分析这封 Email 的内容与图片。

要什么:

列出 3 个最值得注意的可疑信号。

不要做什么:

不要回信、不要打开链接、不要替我做任何外部动作。

先得到:

判断材料。

再自己决定:

删掉。

Report。

询问寄件者。

或其他处理。

例子二:比较两张图片

Magic Pointer 也可以:

选取几张图片,

让 Gemini 把它们一起可视化。

例如:

你正在看自己的客厅照片,

旁边又看到一张新沙发。

你可以说:

看哪里:

只使用我选取的客厅与沙发两张图。

要什么:

先产生一张沙发放进客厅的预览。

不要做什么:

不要改变墙面、地板与其他家具。

这时「不要做什么」

不一定是:

付款。

寄信。

也可能只是:

不要改掉我已经满意的内容。

例子三:看到一堆项目日期

假设你正在看:

活动企划页面。

里面有:

场地确认。

摄影。

客户 Review。

正式发布。

你可以先:

选取那四个日期。

再说:

看哪里:

只看我选的四个 Milestones。

要什么:

依日期排序,列出可能冲突。

不要做什么:

不要改 Calendar,也不要通知任何人。

这时 Magic Pointer 就先当:

检查工具。

不是:

自动运行工具。

第一次跑新任务,最好先停在「整理」

如果是一个你第一次用 Magic Pointer 处理的工作,

比较稳的方法是:

第一轮:

只读。

第二轮:

整理/草拟。

确认没问题之后,

第三轮才:

运行。

例如:

看 Training Plan。

先列日期。

自己确认。

再要求加入 Calendar。

而不是:

第一次看到数据,

就直接:

读取+判断+运行

全部绑在一句话里。

AI 能少一个步骤,不代表人也要少一个确认点

Googlebook 的方向很清楚。

过去:

看网页

Copy

开 AI

Paste

解释 Context

得到答案。

Magic Pointer 想把中间很多摩擦拿掉。

变成:

Point

→ Ask

→ Result。

这是效率提升。

但如果 Result 接着会:

修改 Calendar。

产生正式内容。

改动图片。

或做其他有后果的事情,

Human Gate 还是可以保留。

也就是:

减少搬数据。

不等于:

减少必要的确认。

选取小范围,也不是一种技术上的「隐私隔离」

这里还要特别分清楚。

今天教你:

先选真正需要的画面,

主要目的是:

让任务更清楚。

Google DeepMind 的 AI Pointer 设计本来就会利用:

Visual Context

与:

Semantic Context

理解你指的是什么。

所以不要把:

「我只圈这一段」

理解成:

系统技术上保证只能看到这几个 Pixel,其他任何 Context 都完全不可能参与。

Google 官方目前没有这样承诺。

真正的隐私边界,

仍然应该看:

产品实际功能。

帐号设置。

数据处理规则。

以及当时的 Privacy Documentation。

今天这个方法处理的是:

工作范围。

不是替产品创建一层新的 Security Boundary。

Magic Pointer 本身只有你叫它才启动

Google 目前对 Magic Pointer 的说明是:

它只有在你:

主动晃动 Cursor 叫出来

时才会开始作用。

没有使用时:

保持关闭。

Googlebook 也可以将 Magic Pointer 关掉。

这表示 Google 至少把:

User Invocation

设计成其中一个控制点。

但叫出之后,

任务仍然是:

你自己说得愈清楚,

边界愈清楚。

今天只记这个三格

下次看到 Magic Pointer,

不要只想:

「终于不用写 Prompt 了。」

Prompt 的背景可能少了,

但任务边界还是要有。

直接记:

看哪里

AI 这次只需要处理什么?

要什么

我要的结果是摘要、比较、Draft,还是清单?

不要做什么

哪一步先不要运行?

例如最简单的一句:

只看我选的日期,先整理成清单,不要加入 Calendar。

这已经比:

「帮我处理。」

安全、清楚很多。

AI-native Computer 真正省时间的地方,

应该是:

不用一直搬 Context。

而不是:

把人的判断和停止点也一起拿掉。

如果你也想知道自己的工作里,哪一步最适合先交给 AI,留言「流程」。

今天,和 AI 一起进步一点。

每天学会一个 AI 技巧。

每天节省一点时间。

每天提升一点能力。

SasaDaily,陪你一起成长。

推荐阅读

AI 一分钟教学|2026/08/26:用 Ask Gemini 查工作数据前,先写「范围+时间+要找什么+先不要行动」

AI 一分钟教学|2026/08/19:让 Auto Browse 帮你跑网站前,先写清楚「做到这里一定停」