返回 AI 工具目录

whisper.cpp

开发框架人工精选最近核验 2026年7月23日

whisper.cpp 是 OpenAI Whisper 语音识别模型的 C/C++ 实现,面向本地、离线的语音转文字。它以纯 C/C++ 编写、无外部依赖,支持 F16/F32 混合精度与整型量化,内置语音活动检测(VAD),运行时几乎零内存分配。项目覆盖广泛的硬件加速:Apple Silicon 的 NEON、Accelerate、Metal 与 Core ML,x86 的 AVX,NVIDIA CUDA/cuBLAS,AMD ROCm,Intel OpenVINO,以及 Vulkan、Ascend NPU、摩尔线程 GPU、OpenBLAS 等。

定价开源部署本地运行、自托管国内可达国内可达许可MIT

解决什么问题

  • 在本地、离线完成 Whisper 语音转文字
  • 纯 C/C++ 无外部依赖,便于嵌入
  • 支持整型量化以降低内存与算力
  • 覆盖 CPU、Metal、CUDA 等多种加速
  • 提供多语言绑定,可跨平台集成

适合

  • 需端侧或离线语音识别的场景
  • 移动端、嵌入式与树莓派等受限设备
  • 对数据不出设备有隐私要求
  • 需嵌入现有 C/C++ 或多语言项目

不适合

  • 仅做语音识别,不含说话人分离等完整流程
  • 大模型高精度转写对硬件仍有算力要求
  • 需自行下载并转换 GGML 格式模型权重
  • 无托管服务,部署与运维需自行负责

如何接入

  • 以 C/C++ 库或命令行方式集成
  • 提供 Rust、Go、Java、Python 等绑定
  • 支持 Metal、CUDA、OpenVINO 等后端编译
  • 可编译到 WebAssembly 在浏览器运行
  • 附带服务器示例支持流式转写

已知限制

  • 识别精度取决于所选 Whisper 模型规模
  • 大模型在低端设备上延迟较高
  • 需自行下载并转换模型为 GGML 格式
  • 中文等语种效果依赖上游模型能力

接入与使用事实

部署方式
本地运行、自托管
实现语言
C、C++
中文界面
待确认
中文文档
待确认
定价方式
开源
许可证
MIT
国内可达性
国内可达
可达性观察
待补充

权限、依赖与维护信号

这些字段记录公开可见信号,不等同于安全审计结论。

权限信号

暂无公开信号。

依赖信号

暂无公开信号。

维护信号

暂无公开信号。

公开来源与证据

暂无可公开的来源链接。

访问官网