这个工具是做什么的

Google 最新语音转文字模型:流式识别平均词错误率 4.0%、非流式 2.6%,覆盖 85 种语言并支持地区口音;支持自动自我修正、删除口语填充词、自动格式化,可为最多三名说话人做带时间戳语音归属识别,支持自定义词汇表。通过 Google AI Studio 与 Antigravity 的 Gemini API 以公开预览形式使用。

基本信息

  • 分类:语音识别
  • 厂商 / 团队:Google
  • 价格:公开预览
  • 收录日期:2026-08-29
  • 官网:aistudio.google.com

适用场景

语音识别 · ASR · Gemini · Google · 多模态

官方入口

aistudio.google.com ↗

同类工具