Gemini 跳过按钮:手动控制 Gemini 思考模式
- Aisha Washington

- 6月6日
- 讀畢需時 5 分鐘

我们都曾盯着闪烁的光标,看着一个 AI "思考"一个问题,而这个问题其实并不需要深入思考。你请求一个简单的转换或一个基本的事实日期,而模型却旋转了二十秒来模拟复杂的思维链。Google 正在解决这种延迟摩擦。
Code discovered in the Google App Beta 15.45.33 reveals a new feature rolling out to select users: a manual Gemini Skip Button。此控件允许用户在中途切断推理过程并要求立即得到答案。虽然这听起来像纯粹的效率升级,但该实现引入了关于最终回答你的模型智能水平的一个重大权衡。
Real-World Experience: Using the Gemini Skip Button

在深入研究代码和规格之前,我们需要看看这对用户实际感受如何。Beta 测试者和早期采用者已经发现了一个关键行为,这从 Google 的补丁说明中并不明显。
The Hidden Trade-off: Speed vs. Intelligence
当你按下 Gemini Skip Button 时,你不只是在告诉系统“快一点”;你可能是在告诉它完全换一个“大脑”。社区观察表明,中断 Gemini Thinking Mode 通常会触发回退到更轻量、更快的模型——具体来说是 Gemini Flash 模型——而不是简单地强制 Pro 模型输出其当前想法。
这对高级用户来说是一个重要区别。如果你使用 Gemini Advanced specifically for high-level reasoning,按下“Skip”会抵消该价值。你实际上是用一个精力充沛但立即回答的实习生,换掉了一个思考时间过长的博士生。
When to Use the Skip Function
根据当前的测试行为,以下是该功能适用和不适用的场景:
Use it for: 基础数学、翻译或表面级定义,其中“思考”过程显然在幻觉不存在的复杂性。
Avoid it for: 编码任务、复杂逻辑谜题或细微的创意写作。在这里中断逻辑链不仅会减少等待时间;它还会将输出质量降低到答案可能在事实上不正确或产生幻觉的程度。
Current Limitations
显然需要更精细的控制。用户目前面临二元选择:等待完整的“深度思考”过程(大约在 10,000 个 token 后停止),或跳到较低层级的模型。
The Technical Logic Behind the Gemini Skip Button

该功能的存在已通过 APK 拆解和服务器端推送得到确认。
The strings
<string name="gemini_thinking_skip_button_label">Skip</string> and <string name="assistant_robin_message_processingstatus_skipping_thinking">Skipping in-depth thinking</string> are embedded directly in the application code.
Why Google Built This
深度推理模型,类似于 OpenAI 的 o1 系列,通过在呈现最终答案之前生成隐藏的“思维链”来运行。这会消耗大量计算资源和时间。Gemini Thinking Mode 是为处理复杂查询而设计的,但 AI models 目前缺乏完美的“复杂度分类器”。它们经常难以区分需要三秒思考的查询和需要三十秒思考的查询。
The Gemini Skip Button 是 Google 承认自动分类器尚未就绪的体现。他们没有因简单问题的感知延迟而冒用户流失的风险,而是将决策权交给了用户。
Comparison with Competitors
这种方法不同于当前的市场标准。OpenAI 目前自动处理推理模式和标准模式之间的切换(尽管并不总是完美)。Google 正在测试一种更手动、更触觉化的方法。通过给用户一个物理按钮可按,他们提供了一种能减少等待心理挫败感的主观能动性,即使底层技术过程——切换到更快、能力较弱的模型——是一种妥协。
Safety Implications of Interrupting Gemini Thinking Mode

An unexpected side effect of the Gemini Skip Button involves AI safety and content filtering. “思考”过程不仅关乎逻辑;它也关乎安全评估。在那些处理秒数中,模型正在根据安全准则审查其潜在输出。
Bypassing the Guardrails
早期分析表明,跳过思考阶段可能会无意中绕过某些安全触发器。因为系统会回退到 Flash 模型——该模型可能与深度推理过程相比具有不同或不太严格的实时审查——用户发现更容易引出通常会被阻止的响应。
如果深度推理模型检测到接近政策违规的查询,它通常会思考拒绝并提供标准的“我无法帮助处理该请求”消息。通过按下 skip,系统会中止该评估循环并立即转储原始输出或 Flash 生成的输出。这为“越狱”模型创造了一个潜在向量,其中 skip 的速度允许用户超越审查。
Future Outlook for Manual AI Control

The introduction of the Gemini Skip Button signals a shift in how interface designers are approaching AI interaction。我们正在从用户输入提示并希望获得最佳结果的“黑箱”时代,走向主动引导的时代。
Google 显然正在对该功能进行 A/B 测试。它与 Google 帐户 ID 而非特定设备相关联,这意味着它是一个服务器端开关,正在针对特定群体切换以收集使用数据。如果数据显示用户在 50% 的查询中按下“Skip”,Google will likely retune the sensitivity of the Gemini Thinking Mode to trigger less often.
长期解决方案不是一个按钮,而是更好的上下文感知。模型应该知道“2+2”需要零思考时间。在架构高效到足以立即做出该判断之前,手动 skip 功能充当必要的桥梁。它允许部署强大的推理模型,而不会破坏对临时查询的用户体验。
然而,当前的实现留下了市场空白。用户想要 Gemini Pro 的智能,而不需要“思考”的强制延迟,他们也不想仅仅因为不耐烦就被降级到 Flash。Gemini Skip Button 的下一迭代需要提供一个中间地带:停止思考,但保留智能模型。
FAQ
How do I get the Gemini Skip Button?
该功能目前处于 A/B 测试中,并通过与你的 Google 帐户关联的服务器端更新激活。安装最新的 Beta APK (15.45.33) 是必要的,但不能保证该功能会出现在你的界面上。
Does using the Gemini Skip Button lower the quality of the answer?
是的,在许多情况下是这样。观察表明,使用 skip 功能经常会将活动模型从高推理 Pro 版本切换到更快的轻量级 Gemini Flash 模型,这对于复杂任务可能不太准确。
Can I turn off Gemini Thinking Mode entirely?
目前,没有全局设置可以永久禁用特定模型的 Thinking Mode。The Skip button is a per-response manual intervention,尽管用户可以在开始聊天前从模型选择器中手动选择非思考模型(如 Gemini Flash)。
Why does Gemini take so long to think?
Gemini Thinking Mode 生成一个“思维链”——本质上是在自言自语以验证逻辑和事实——然后向你展示最终结果。这个过程消耗数千个 token 和处理能力,从而导致你在屏幕上看到的延迟。
Is the Gemini Skip Button available on iOS?
Testing is currently focused on the Google App for Android。目前没有确认的时间表,说明此特定 UI 元素何时会反映在 iOS Google 应用或网页界面中。


