Copied


Google 在 macOS 的 Gemini 中推出智能语音输入

realtime news   Aug 25, 2026 18:01 1 Min Read


Google 已正式在 macOS 的 Gemini 应用中推出其智能语音输入功能,使用户可以在任何应用中直接将语音转录为精美的文字。从 2026 年 8 月 25 日起,该功能在全球范围内以英语推出,未来更新中计划支持更多语言。

智能语音输入工具不仅仅是基础的语音转文字功能。用户可以长按 Fn 键自然说话,应用会将他们的语言转录为光标位置的清晰文本。像“呃”和“嗯”这样的填充词会自动删除,中途的句子修正可以无缝处理,并且文本会被格式化以便立即使用。这意味着用户在转录后无需手动清理或编辑,对于经常口述电子邮件、文档或消息的人来说,这是一个重要的优势。

Google 还在 Gemini 中整合了“窗口语音输入”功能,使应用能够利用屏幕上的上下文。例如,用户可以直接在电子邮件或文档中重写、总结或优化内容,而无需切换到单独的聊天机器人界面。这种系统范围的功能旨在提升 macOS 用户的生产力,特别是在专业和创意工作流程中。

Gemini 应用最初于 2026 年 4 月推出,适用于 macOS Sequoia 15.0 或更高版本。它需要至少 8 GB 的内存以及大约 200 MB 的安装空间。该应用免费提供,方便 Mac 用户优化其写作和编辑过程。

Google 对 AI 驱动工具的投资反映了将生成式 AI 融入日常应用的更广泛行业趋势。公司在 2026 年 7 月下旬首次宣布扩展 Gemini 的语音功能,而智能语音输入的加入突显了其通过自然语言处理改善用户交互的重点。随着 Google 在这个领域不断创新,竞争平台如 Apple 的内置 macOS 语音输入和 Microsoft 的 AI Copilot 可能面临更大的压力。

目前,Gemini 中的智能语音输入功能在 macOS 上仅限于英语,但 Google 暗示计划在该功能成熟后支持更多语言。用户可以通过下载或更新 Gemini 应用并在其设置中激活语音输入功能来立即启用该工具。Google 官方博客上提供了教程和演示,供想要深入了解此功能的用户参考。


Read More