Google 发布了 Gemini 3.5 Transcribe 语音转文字模型,官方称其为最精确的语音识别模型,可将原始音频直接转换为准确且格式化的文本 。开发者可通过 Google AI Studio 的 Gemini API 和 Gemini Enterprise Agent Platform 使用该模型 。该…
一名开发者在Hacker News上分享了新开源项目Yap,这是一款专为macOS设计的菜单栏应用,实现了无需下载模型的本地设备语音转文字功能。该应用利用macOS 26新增的SpeechAnalyzer和SpeechTranscriber API进行语音识别,用户只需设置快捷键便可进行语音输入,转录的文本随后直接粘…