
开发语言Python
资源大小6.21MB
运行环境Linux / macOS / Windows / Web
资源状态可查看
项目定位与核心能力
该项目是一个基于Whisper的异步语音识别与翻译API,通过本地部署模型进行推理,无需依赖外部API服务。
它支持多GPU并发与分布式部署,能够有效利用多卡资源,适合处理大规模语音识别任务。
- 基于FastAPI提供Swagger UI文档,方便接口调试与测试。
- 支持MySQL/SQLite数据库,以及异步模型池、任务优先级、回调通知等功能。
扩展功能与集成
内置抖音、TikTok等平台的爬虫模块,可实现无缝的媒体处理流程。
还支持字幕生成与ChatGPT集成,进一步扩展了API的应用场景。
部署与使用前核对
项目运行环境覆盖Linux、macOS、Windows及Web平台,使用前请阅读压缩包内的README.md文件,以获取详细的配置与部署说明。
建议在部署前确认GPU驱动、Python版本及依赖库的兼容性,确保多GPU环境能够正常工作。
界面预览