这个工具是做什么的
Google 最新语音转文字模型:流式识别平均词错误率 4.0%、非流式 2.6%,覆盖 85 种语言并支持地区口音;支持自动自我修正、删除口语填充词、自动格式化,可为最多三名说话人做带时间戳语音归属识别,支持自定义词汇表。通过 Google AI Studio 与 Antigravity 的 Gemini API 以公开预览形式使用。
基本信息
- 分类:语音识别
- 厂商 / 团队:Google
- 价格:公开预览
- 收录日期:2026-08-29
- 官网:aistudio.google.com
适用场景
语音识别 · ASR · Gemini · Google · 多模态