Googlebook 的 Magic Pointer 有一个很大的改变:
以前使用 AI,
你常常要:
Copy。
开 Gemini。
Paste。
再解释:
「我现在正在看的是什么。」
Magic Pointer 直接把 Gemini 带到:
你正在看的地方。
所以 Prompt 可以短很多。
但这也很容易出现另一个问题:
你晃一下 Cursor,
然后只说:
「帮我处理一下。」
AI 看得到 Context,
不代表它知道:
你到底只想看哪一块?
你要它做到哪一步?
哪一步现在还不要做?
今天只学一个很简单的方法:
每次叫出 Magic Pointer 前,
先补三件事:
看哪里。
要什么。
不要做什么。
第一句:看哪里
Google 官方对 Magic Pointer 的设计重点,
就是让 Gemini 理解:
你目前指着的:
文字。
图片。
以及相关 Context。
Google DeepMind 甚至把这种交互概念称为:
Show and Tell。
以前你要写:
「请看网页中间第三段里的日期。」
现在可以:
直接选它。
所以第一个动作不是:
写更长 Prompt。
而是:
先把真正需要的内容选出来。
例如你正在看一份:
Marathon Training Plan。
里面有:
训练日期。
里程。
饮食建议。
广告。
其他文章链接。
但你今天只需要:
跑步日期。
那就先选:
真正包含日期与训练安排的区域。
不要一开始就把整个页面都当成任务。
第二句:要什么
选好 Context 之后,
再告诉 Gemini:
你现在要的结果到底是什么?
例如不要只说:
「帮我整理。」
可以改成:
「只整理成日期+训练项目的清单。」
这里重点不是 Prompt 写得漂亮。
而是让输出有:
终点。
例如:
摘要成 5 点。
列出三个日期。
比较两个产品。
找出可疑信号。
把选取内容翻译成繁体中文。
整理成待办清单。
AI 已经知道「这是什么」之后,
你真正需要补的是:
「我要它变成什么。」
第三句:不要做什么
这是最容易被省略的一句。
Google 官方直接示范:
Magic Pointer 可以选取 Marathon Training Plan,
再让 Gemini 把那些训练:
排进 Google Calendar。
也就是它不一定只:
看。
还可能进一步:
做。
所以如果你现在其实只想先确认日期,
可以直接补一句:
「先不要加入 Calendar。」
这就是第三层:
不要做什么。
三句合起来,就变得很清楚
不要:
「帮我处理这个。」
改成:
看哪里:
只看我目前选取的训练日期。
要什么:
整理成日期+训练项目的清单。
不要做什么:
先不要加入 Calendar。
就是这么简单。
为什么 Magic Pointer 反而更需要这三句?
因为传统 Chatbot 最大的麻烦是:
Context 不够。
所以你一直补数据。
Magic Pointer 想解决这件事。
Google DeepMind 的设计方向就是:
让 Pointer 理解:
你正在指什么。
例如:
一个 Word。
一个 Paragraph。
图片某一部分。
Code Block。
甚至可以只说:
「Fix this。」
「Move that。」
不必每次重新描述整个世界。
这很方便。
但 Prompt 变短之后,
另一种歧义就开始变重要:
你要它做到哪里停?
例子一:看到可疑 Email
Google 官方示范:
你可以 Hover 一封可疑 Email,
让 Gemini 同时分析:
文字。
图片。
判断它比较像:
Spam
还是:
正常 Email。
这时不要只问:
「这封怎么办?」
可以改成:
看哪里:
只分析这封 Email 的内容与图片。
要什么:
列出 3 个最值得注意的可疑信号。
不要做什么:
不要回信、不要打开链接、不要替我做任何外部动作。
先得到:
判断材料。
再自己决定:
删掉。
Report。
询问寄件者。
或其他处理。
例子二:比较两张图片
Magic Pointer 也可以:
选取几张图片,
让 Gemini 把它们一起可视化。
例如:
你正在看自己的客厅照片,
旁边又看到一张新沙发。
你可以说:
看哪里:
只使用我选取的客厅与沙发两张图。
要什么:
先产生一张沙发放进客厅的预览。
不要做什么:
不要改变墙面、地板与其他家具。
这时「不要做什么」
不一定是:
付款。
寄信。
也可能只是:
不要改掉我已经满意的内容。
例子三:看到一堆项目日期
假设你正在看:
活动企划页面。
里面有:
场地确认。
摄影。
客户 Review。
正式发布。
你可以先:
选取那四个日期。
再说:
看哪里:
只看我选的四个 Milestones。
要什么:
依日期排序,列出可能冲突。
不要做什么:
不要改 Calendar,也不要通知任何人。
这时 Magic Pointer 就先当:
检查工具。
不是:
自动运行工具。
第一次跑新任务,最好先停在「整理」
如果是一个你第一次用 Magic Pointer 处理的工作,
比较稳的方法是:
第一轮:
只读。
第二轮:
整理/草拟。
确认没问题之后,
第三轮才:
运行。
例如:
看 Training Plan。
↓
先列日期。
↓
自己确认。
↓
再要求加入 Calendar。
而不是:
第一次看到数据,
就直接:
读取+判断+运行
全部绑在一句话里。
AI 能少一个步骤,不代表人也要少一个确认点
Googlebook 的方向很清楚。
过去:
看网页
↓
Copy
↓
开 AI
↓
Paste
↓
解释 Context
↓
得到答案。
Magic Pointer 想把中间很多摩擦拿掉。
变成:
Point
→ Ask
→ Result。
这是效率提升。
但如果 Result 接着会:
修改 Calendar。
产生正式内容。
改动图片。
或做其他有后果的事情,
Human Gate 还是可以保留。
也就是:
减少搬数据。
不等于:
减少必要的确认。
选取小范围,也不是一种技术上的「隐私隔离」
这里还要特别分清楚。
今天教你:
先选真正需要的画面,
主要目的是:
让任务更清楚。
Google DeepMind 的 AI Pointer 设计本来就会利用:
Visual Context
与:
Semantic Context
理解你指的是什么。
所以不要把:
「我只圈这一段」
理解成:
系统技术上保证只能看到这几个 Pixel,其他任何 Context 都完全不可能参与。
Google 官方目前没有这样承诺。
真正的隐私边界,
仍然应该看:
产品实际功能。
帐号设置。
数据处理规则。
以及当时的 Privacy Documentation。
今天这个方法处理的是:
工作范围。
不是替产品创建一层新的 Security Boundary。
Magic Pointer 本身只有你叫它才启动
Google 目前对 Magic Pointer 的说明是:
它只有在你:
主动晃动 Cursor 叫出来
时才会开始作用。
没有使用时:
保持关闭。
Googlebook 也可以将 Magic Pointer 关掉。
这表示 Google 至少把:
User Invocation
设计成其中一个控制点。
但叫出之后,
任务仍然是:
你自己说得愈清楚,
边界愈清楚。
今天只记这个三格
下次看到 Magic Pointer,
不要只想:
「终于不用写 Prompt 了。」
Prompt 的背景可能少了,
但任务边界还是要有。
直接记:
看哪里
AI 这次只需要处理什么?
要什么
我要的结果是摘要、比较、Draft,还是清单?
不要做什么
哪一步先不要运行?
例如最简单的一句:
只看我选的日期,先整理成清单,不要加入 Calendar。
这已经比:
「帮我处理。」
安全、清楚很多。
AI-native Computer 真正省时间的地方,
应该是:
不用一直搬 Context。
而不是:
把人的判断和停止点也一起拿掉。
如果你也想知道自己的工作里,哪一步最适合先交给 AI,留言「流程」。
今天,和 AI 一起进步一点。
每天学会一个 AI 技巧。
每天节省一点时间。
每天提升一点能力。
SasaDaily,陪你一起成长。
推荐阅读
AI 一分钟教学|2026/08/26:用 Ask Gemini 查工作数据前,先写「范围+时间+要找什么+先不要行动」