返回 AI 工具目录
whisper.cpp
开发框架人工精选最近核验 2026年7月23日
whisper.cpp 是 OpenAI Whisper 语音识别模型的 C/C++ 实现,面向本地、离线的语音转文字。它以纯 C/C++ 编写、无外部依赖,支持 F16/F32 混合精度与整型量化,内置语音活动检测(VAD),运行时几乎零内存分配。项目覆盖广泛的硬件加速:Apple Silicon 的 NEON、Accelerate、Metal 与 Core ML,x86 的 AVX,NVIDIA CUDA/cuBLAS,AMD ROCm,Intel OpenVINO,以及 Vulkan、Ascend NPU、摩尔线程 GPU、OpenBLAS 等。
定价开源部署本地运行、自托管国内可达国内可达许可MIT
解决什么问题
- 在本地、离线完成 Whisper 语音转文字
- 纯 C/C++ 无外部依赖,便于嵌入
- 支持整型量化以降低内存与算力
- 覆盖 CPU、Metal、CUDA 等多种加速
- 提供多语言绑定,可跨平台集成
适合
- 需端侧或离线语音识别的场景
- 移动端、嵌入式与树莓派等受限设备
- 对数据不出设备有隐私要求
- 需嵌入现有 C/C++ 或多语言项目
不适合
- 仅做语音识别,不含说话人分离等完整流程
- 大模型高精度转写对硬件仍有算力要求
- 需自行下载并转换 GGML 格式模型权重
- 无托管服务,部署与运维需自行负责
如何接入
- 以 C/C++ 库或命令行方式集成
- 提供 Rust、Go、Java、Python 等绑定
- 支持 Metal、CUDA、OpenVINO 等后端编译
- 可编译到 WebAssembly 在浏览器运行
- 附带服务器示例支持流式转写
已知限制
- 识别精度取决于所选 Whisper 模型规模
- 大模型在低端设备上延迟较高
- 需自行下载并转换模型为 GGML 格式
- 中文等语种效果依赖上游模型能力
接入与使用事实
- 部署方式
- 本地运行、自托管
- 实现语言
- C、C++
- 中文界面
- 待确认
- 中文文档
- 待确认
- 定价方式
- 开源
- 许可证
- MIT
- 国内可达性
- 国内可达
- 可达性观察
- 待补充
权限、依赖与维护信号
这些字段记录公开可见信号,不等同于安全审计结论。
权限信号
暂无公开信号。
依赖信号
暂无公开信号。
维护信号
暂无公开信号。
公开来源与证据
暂无可公开的来源链接。
