这个工具是做什么的
Cactus 发布开源语音识别模型 Whistle:整个模型就是一个 16.9 MB 的文件,在 CPU 上跑、无依赖、不需要 GPU,官方给的首次出字延迟是 11 毫秒。它一次能转写最长 30 秒的音频,支持英语、德语、法语、西班牙语、意大利语、荷兰语与波兰语(语言自动识别),除了转写还能给每个词标出起止时间与置信度、以及直接输出语音嵌入向量。模型与 Needle(同门的端侧文本模型)共用同一个 C++ 引擎与 .cact 容器,所以同一个二进制既能做语音又能做文本,甚至能把一段录音直接转成工具调用。引擎预编译覆盖 macOS / Linux / Android / iOS / watchOS / Windows on ARM / RISC-V / 浏览器 / WASI 等十七个目标。适合移动端、可穿戴、机器人与嵌入式设备上做完全离线的语音交互。
基本信息
- 分类:语音识别
- 厂商 / 团队:Cactus Compute
- 价格:开源免费(权重在 Hugging Face 开放,端上运行无 API 费用)
- 收录日期:2026-10-09
- 官网:cactuscompute.com
适用场景
语音识别 · 端侧 · 开源模型 · 离线 · 低资源