这个工具是做什么的

Cactus 发布开源语音识别模型 Whistle:整个模型就是一个 16.9 MB 的文件,在 CPU 上跑、无依赖、不需要 GPU,官方给的首次出字延迟是 11 毫秒。它一次能转写最长 30 秒的音频,支持英语、德语、法语、西班牙语、意大利语、荷兰语与波兰语(语言自动识别),除了转写还能给每个词标出起止时间与置信度、以及直接输出语音嵌入向量。模型与 Needle(同门的端侧文本模型)共用同一个 C++ 引擎与 .cact 容器,所以同一个二进制既能做语音又能做文本,甚至能把一段录音直接转成工具调用。引擎预编译覆盖 macOS / Linux / Android / iOS / watchOS / Windows on ARM / RISC-V / 浏览器 / WASI 等十七个目标。适合移动端、可穿戴、机器人与嵌入式设备上做完全离线的语音交互。

基本信息

  • 分类:语音识别
  • 厂商 / 团队:Cactus Compute
  • 价格:开源免费(权重在 Hugging Face 开放,端上运行无 API 费用)
  • 收录日期:2026-10-09
  • 官网:cactuscompute.com

适用场景

语音识别 · 端侧 · 开源模型 · 离线 · 低资源

官方入口

cactuscompute.com ↗

同类工具