Google 正式为 Gemini for Mac 推出全新的 AI 语音听写体验,让语音输入不再只是简单的转文字,而是能够直接生成适合发送、记录和创作的内容。

新版功能启用方式十分简单,在任意应用中长按 Fn 键即可开始语音输入,无需切换到 Gemini 窗口,也不用复制粘贴。用户说完后,Gemini 会直接将整理后的文本插入当前光标所在位置,适用于邮件、文档、聊天软件、笔记等几乎所有支持输入文字的应用。

与传统语音输入不同,这项功能不仅负责识别语音,还会对内容进行智能整理。例如:

  • 自动删除“嗯”“啊”“那个”等口头语;
  • 自动修正用户中途的自我纠正;
  • 优化标点和语句结构;
  • 输出更加流畅、规范的文字。

也就是说,它更像是一位实时编辑,而不仅仅是语音识别工具。

Google 表示,这项能力旨在让用户能够一边思考、一边表达,而无需再花时间修改语音转写结果。对于需要快速记录会议纪要、撰写邮件、整理灵感或生成文档的用户来说,整个输入流程会更加自然。

值得注意的是,这项 AI 听写并不会取代 macOS 自带的 Dictation,而是提供了另一种更加智能的输入方式。Apple 的原生听写主要负责准确识别语音,而 Gemini 则进一步加入了 AI 文本优化能力,使最终输出更接近正式写作效果。

今年以来,Google 持续增强 Gemini 在 macOS 平台上的能力。此前推出的 Gemini Spark 已支持本地文件处理、自动化工作流以及与 Google Docs、Sheets 等应用联动,而此次加入 AI 语音听写,则进一步完善了桌面端的人机交互体验,使 Gemini 更接近系统级 AI 助手。