多GPU分布式异步语音识别API Python源码

这是一套基于Whisper的异步语音识别与翻译API源码,支持多GPU分布式部署,内置任务队列与爬虫模块,适合开发者学习高性能API与分布式系统实践。

多GPU分布式异步语音识别API Python源码
开发语言Python
资源大小6.21MB
运行环境Linux / macOS / Windows / Web
资源状态可查看

项目定位与核心能力

该项目是一个基于Whisper的异步语音识别与翻译API,通过本地部署模型进行推理,无需依赖外部API服务。

它支持多GPU并发与分布式部署,能够有效利用多卡资源,适合处理大规模语音识别任务。

  • 基于FastAPI提供Swagger UI文档,方便接口调试与测试。
  • 支持MySQL/SQLite数据库,以及异步模型池、任务优先级、回调通知等功能。

扩展功能与集成

内置抖音、TikTok等平台的爬虫模块,可实现无缝的媒体处理流程。

还支持字幕生成与ChatGPT集成,进一步扩展了API的应用场景。

部署与使用前核对

项目运行环境覆盖Linux、macOS、Windows及Web平台,使用前请阅读压缩包内的README.md文件,以获取详细的配置与部署说明。

建议在部署前确认GPU驱动、Python版本及依赖库的兼容性,确保多GPU环境能够正常工作。

图片预览