faster-whisper是基于OpenAI的whisper的优化版本,faster-whisper使用CTranslate2对 OpenAI 的 Whisper 模型的重新实现,它是 Transformer 模型的快速推理引擎。在相同准确率下,该实现比openai/whisper快 4 倍,同时占用更少的内存。在 CPU 和 GPU 上均采用 8 位量化,效率可进一步提高。
以下是使用不同实现方式转录13 分钟音频所需的时间和内存使用测试结果,测试设备为NVIDIA Tesla V100S,模型为Large-v2:
测试工具 | 精确 | Beam size | 时间 | 最大GPU显存 | 最大CPU内存 |
---|---|---|---|---|---|
openai/whisper | fp16 | 5 | 4m30s | 11325MB | 9439MB |
faster-whisper | fp16 | 5 | 54s | 4755MB | 3244MB |
faster-whisper | int8 | 5 | 59s | 3091MB | 3117MB |
可以明显的看出faster-whisper的执行速度是有非常大的提升的,快了近5倍了。这个应用是非常好的一个工具了,我制作了最新版的faster-whisper一键启动整合包,操作界面如下:

软件支持音频文件和视频文件的语音转文字
默认使用模型为small,模型越大识别效果越好,但是对电脑配置要求也越高,如果想使用更大的模型,需要到网盘里将另外两个模型下载到项目文件夹里huggingface文件夹内,
软件支持将识别的内容翻译为其它语言,可选的翻译工具有百度翻译和谷歌翻译,国内用户可用百度翻译,国外用户可用谷歌翻译。使用百度翻译需要先申请APP ID和密钥,可以看这篇文章《最新百度翻译api免费申请AppId和AppSecret流程,每月免费100万字符》,将申请到的APP ID和密钥填到软件里即可使用百度翻译功能。
如使用翻译功能必须填写下面的目标语言,软件里我只预设了少量几种语言,但是百度和谷歌支持几十种语言的翻译,你可以将语言代码直接填到目标语言输入框里。百度和谷歌翻译的语言代码如下:
百度翻译语言代码列表
语言代码 | 名称 |
---|---|
zh | 中文 |
en | 英语 |
yue | 粤语 |
wyw | 文言文 |
jp | 日语 |
kor | 韩语 |
fra | 法语 |
spa | 西班牙语 |
th | 泰语 |
ara | 阿拉伯语 |
ru | 俄语 |
pt | 葡萄牙语 |
de | 德语 |
it | 意大利语 |
el | 希腊语 |
nl | 荷兰语 |
pl | 波兰语 |
bul | 保加利亚语 |
est | 爱沙尼亚语 |
dan | 丹麦语 |
fin | 芬兰语 |
cs | 捷克语 |
rom | 罗马尼亚语 |
slo | 斯洛文尼亚语 |
swe | 瑞典语 |
hu | 匈牙利语 |
cht | 繁体中文 |
vie | 越南语 |
Google翻译语言代码列表
语言 | 代码 |
---|---|
南非荷兰语 | af |
阿尔巴尼亚语 | sq |
阿姆哈拉语 | am |
阿拉伯语 | ar |
亚美尼亚文 | hy |
阿萨姆语 | as |
艾马拉语 | ay |
阿塞拜疆语 | az |
班巴拉语 | bm |
巴斯克语 | eu |
白俄罗斯语 | be |
孟加拉文 | bn |
博杰普尔语 | bho |
波斯尼亚语 | bs |
保加利亚语 | bg |
加泰罗尼亚语 | ca |
宿务语 | ceb |
中文(简体) | zh-CN |
中文(繁体) | zh-TW |
科西嘉语 | co |
克罗地亚语 | hr |
捷克语 | cs |
丹麦语 | da |
迪维希语 | dv |
多格来语 | doi |
荷兰语 | nl |
英语 | en |
世界语 | eo |
爱沙尼亚语 | et |
Ewe | ee |
菲律宾语(塔加拉语) | fil |
芬兰语 | fi |
法语 | fr |
弗里斯兰语 | fy |
加利西亚语 | gl |
格鲁吉亚语 | ka |
德语 | de |
希腊文 | el |
瓜拉尼人 | gn |
古吉拉特文 | gu |
海地克里奥尔语 | ht |
Hausa | ha |
夏威夷语 | haw |
希伯来语 | he 或 iw |
印地语 | hi |
苗语 | hmn |
匈牙利语 | hu |
冰岛语 | is |
伊博语 | ig |
伊洛卡诺语 | ilo |
印度尼西亚语 | id |
爱尔兰语 | ga |
意大利语 | it |
日语 | ja |
爪哇语 | jv 或 jw |
卡纳达文 | kn |
哈萨克语 | kk |
高棉语 | km |
卢旺达语 | rw |
Konkani | gom |
韩语 | ko |
Krio | kri |
库尔德语 | ku |
库尔德语(索拉尼) | ckb |
吉尔吉斯语 | ky |
老挝语 | lo |
拉丁文 | la |
拉脱维亚语 | lv |
林加拉语 | ln |
立陶宛语 | lt |
卢干达语 | lg |
卢森堡语 | lb |
马其顿语 | mk |
迈蒂利语 | mai |
马尔加什语 | mg |
马来语 | ms |
马拉雅拉姆文 | ml |
马耳他语 | mt |
毛利语 | mi |
马拉地语 | mr |
梅泰语(曼尼普尔语) | mni-Mtei |
米佐语 | lus |
蒙古文 | mn |
缅甸语 | my |
尼泊尔语 | ne |
挪威语 | no |
尼杨扎语(齐切瓦语) | ny |
奥里亚语(奥里亚) | or |
奥罗莫语 | om |
普什图语 | ps |
波斯语 | fa |
波兰语 | pl |
葡萄牙语(葡萄牙、巴西) | pt |
旁遮普语 | pa |
克丘亚语 | qu |
罗马尼亚语 | ro |
俄语 | ru |
萨摩亚语 | sm |
梵语 | sa |
苏格兰盖尔语 | gd |
塞佩蒂语 | nso |
塞尔维亚语 | sr |
塞索托语 | st |
修纳语 | sn |
信德语 | sd |
僧伽罗语 | si |
斯洛伐克语 | sk |
斯洛文尼亚语 | sl |
索马里语 | so |
西班牙语 | es |
巽他语 | su |
斯瓦希里语 | sw |
瑞典语 | sv |
塔加路语(菲律宾语) | tl |
塔吉克语 | tg |
泰米尔语 | ta |
鞑靼语 | tt |
泰卢固语 | te |
泰语 | th |
提格里尼亚语 | ti |
Tsonga | ts |
土耳其语 | tr |
土库曼语 | tk |
契维语(阿坎语) | ak |
乌克兰语 | uk |
乌尔都语 | ur |
维吾尔语 | ug |
乌兹别克语 | uz |
越南语 | vi |
威尔士语 | cy |
班图语 | xh |
意第绪语 | yi |
约鲁巴语 | yo |
祖鲁语 | zu |
如有需要的可自行下载测试
注意:软件运行路径中不能有中文和空格
语音识别转文字软件faster-whisper整合包下载链接:
相关推荐
麦克风电脑内播放声音实时识别转文字软件FunASR整合包V5下载
离线语音识别转文字软件Faster-whisper整合包使用说明视频教程
音频视频转文字软件faster-whisper 1.1.1整合包下载,精准快速语音转录工具
实时语音识别转文字软件V3版,批量音频视频录音转文字提取工具下载
免费音频视频语音识别转文字软件SenseVoice整合包,支持批量操作可生成字幕
照片人物表情控制软件AdvancedLivePortrait整合包,图片转视频工具
最新版PDF转Markdown格式软件MinerU一键启动整合包v0.10.0下载
AI视频修复软件Topaz Video AI v5.5.0绿色版,模糊视频变清晰工具
最近更新

百度夸克webdav服务+alist+RaiDrive,将网盘挂载为本地电脑硬盘方法教程
由于每天都要操作网盘不下十几次,频繁启动网盘比较麻烦。 使用百度夸克网盘的webdav服务可以将百度夸克网盘挂载到本地电脑上,就像操作本地电脑硬盘一样操作网盘,非常方便。我们以alist+raidrive为例演示。 首先打开百度网盘pan....

Unreal Engine 5恐怖游戏设计制作教程,从入门到精通从零开始完整项目开发详细讲解,中英文字幕
和大家分享一个以前收集的UE5虚幻引擎恐怖游戏开发教程,这是国外一个大神制作的视频教程,教程从零开始到制作出一款完整的游戏。内容讲解全面,如蓝图基础知识讲解、角色控制、高级交互系统、高级库存系统、物品检查、恐怖环境氛围设计、过场动画、AI系...

PDF/图片转markdown软件MonkeyOCR整合包,文档图片解析工具下载
MonkeyOCR是上个月刚发布的一款文档解析工具,可以将PDF文档或图片识别转换为markdown格式文件。官方测试显示性能极佳。我基于当前最新版制作了免安装一键启动整合包,支持批量操作,并降低了显卡要求。 MonkeyOCR官方介绍 M...

AI视频变现项目,完整详细教程20250628期

即梦AI:创作者的强力“外挂”!免费积分等你领取
还在为创作图片、故事及视频内容而烦恼吗?朋友,你需要一个靠谱的“智能搭子”了!那就是即梦AI,就是那个能让你事半功倍、脑洞大开的神奇伙伴! 即梦AI,到底是什么? 简单说,即梦AI是字节跳动旗下一个强大、易用且懂你的一站式AI创作平台。&n...

支付宝发现金红包了!支付宝的羊毛快来薅💰️💰️
支付宝小荷包搞活动啦,新用户加入立得2元无门槛现金红包。 支付宝小荷包是支付宝推出的一款便捷的零钱管理工具,适合日常小额支付和理财。 什么是支付宝小荷包? 支付宝小荷包,简单来说,就像是你在支付宝里的“私人金库”。它不仅支持快速转账、收款,...

美团官方发福利,吃喝玩乐外卖神券天天领
美团官方发福利了,加美团企业微信,每天免费领各种吃喝玩乐神券,领取福利流程如下: 1、微信扫码登录↓↓↓ 2、长按添加美团企业微信 3、天天领券 每日签到领取更多红包 更有超多促销活动,限时活动,低价爆品等,让你放肆嗨吃嗨喝!

免费PDF文档翻译软件BabelDOC整合包下载,AI一键PDF全文翻译工具
分享另一个热门的PDF文档翻译软件BabelDOC,软件可以将PDF文档由原语言翻译成指定语言文档,基于在线大语言模型处理能力,文档翻译效果更准确,并保留排版,支持批量文档翻译,我制作了最新版免安装一键启动整合包。 BabelDOC介绍 另...

AI歌曲创作软件YuE整合包下载,一键谱曲演唱音乐生成器
YuE:开放的全曲音乐生成基础模型,可免费一键生成完整歌曲,AI作曲,AI演唱,是一个高质量的AI音乐生成软件。我制作了最新的面安装一键启动整合包。 YuE介绍 YuE 是一系列突破性的开源基础模型,专为音乐生成而设计,尤其适用于将歌词转化...

可灵AI会员专属优惠邀请码,限时福利领取
可灵AI发福利了,通过专属优惠邀请码 6BZPEJK83JZ9 可额外获得50%灵感值。 现在图片、音乐、视频等等,啥都可以用AI生成,可灵AI就是快手旗下非常强大的一个AI内容创作平台,功能多样,效果强大。我最近半年几乎每周都会使用多次,...