兴国资源网 Design By www.nnzcdc.com
CapsWriter(详情请戳 作者项目地址)是一款免费开源且可完全离线识别的语音输入工具,无需担心因在线版本识别带来的各种隐私泄露问题。支持win7及以上的系统,已经更新融合了语音输入以及音视频文件实现字幕转录的功能。相比某些必须在线识别又或者需要付费又有时长限制的app、软件或网站而言,此款良心多了,基本能满足大部分场合需求如会议记录或键盘失灵等。有需自取~~~
软件特性:
1.完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔
2.热词功能:可以在 hot-en.txthot-zh.txt hot-rule.txt 中添加三种热词,客户端动态识别载入
3.日记功能:默认每次录音识别后,识别结果记录在 年份/月份/日期.md ,录音文件保存在 年份/月份/assets
4.关键词日记:识别结果若以关键词开头,会被记录在 年份/月份/关键词-日期.md,关键词在 keywords.txt 中定义
5.转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕、txt文本等等
6.服务端、客户端分离,可以服务多台客户端
使用说明:
> >详细完整教程请戳:从安装到基本入门上手
PS:懒人包为python开发打包而成,降低环境部署的难度。部分杀软会误报,如担心请自行扔进虚拟机或验证可靠性再使用。另外,该软件的核心在于模型,模型有点大,介意的则勿下。。
以下仅作简明扼要:
1.主程序基本是百兆之内的压缩包(很好辨认),根据系统环境解压后,再将models.zip模型包里边的文件全部移到已解压的主程序根目录models文件夹之下,如:D:\CapsWriter-Offline-Windows-64bit\models。然后运行根目录的服务端start_server.exe,等待模型加载完成(等待时长视电脑配置而定)。最后双击运行start_client.exe客户端。
2.工作原理:默认长按键盘上的大写锁定键Capslock,录音开始,当松开大写锁定键 时,就会识别录音,并将识别结果立刻输入到带有输入框的地方(前提需提前打开输入栏)。相关识别到的录音和日志默认放在根目录下的2024文件夹里,不需要或重录时记得及时清理。
如需要更改触发按键、单击录音单击停止或端口修改等设置,可自行用记事本等文本编辑工具打开config.py文件进行修改,每一栏都有详细的注释说明。
3. 可将音视频文件拖动到客户端中打开,等待处理即可。但转录字幕功能必须在服务端加载完模型并保持后台运行的情况下才可使用,否则会出现闪退不工作等问题。
默认转录之后生成的文件会跟着音视频文件的目录:
json 文件:包含了字级时间戳
txt 文件:包含了分行结果
merge.txt 文件:包含了带标点的整段结果
srt 文件:字幕文件
如果生成的字幕有微小错误,可以在分行的 txt 文件中修改,并将 txt 文件拖动到客户端打开,最后自动修正其余字幕文件。其余功能自行体验。。。
基本效果:(与视频演示的略有点不同,毕竟是1倍慢录制,但基本原理是如此)
相关设置:(此处可改为不常用的insert键激活录音,端口号任意等等,不改亦可)
转录效果:(转化后生成四个字幕类的不同格式文件)
下载地址:
1 > > 微软盘下载 密码:12Vc
2 > > 123盘下载
3 > > 阿里盘下载
4 > > 百度盘下载 密码:zky3
5 > > 蓝盘下载 密码:b9qt
软件特性:
1.完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔
2.热词功能:可以在 hot-en.txthot-zh.txt hot-rule.txt 中添加三种热词,客户端动态识别载入
3.日记功能:默认每次录音识别后,识别结果记录在 年份/月份/日期.md ,录音文件保存在 年份/月份/assets
4.关键词日记:识别结果若以关键词开头,会被记录在 年份/月份/关键词-日期.md,关键词在 keywords.txt 中定义
5.转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕、txt文本等等
6.服务端、客户端分离,可以服务多台客户端
使用说明:
> >详细完整教程请戳:从安装到基本入门上手
PS:懒人包为python开发打包而成,降低环境部署的难度。部分杀软会误报,如担心请自行扔进虚拟机或验证可靠性再使用。另外,该软件的核心在于模型,模型有点大,介意的则勿下。。
以下仅作简明扼要:
1.主程序基本是百兆之内的压缩包(很好辨认),根据系统环境解压后,再将models.zip模型包里边的文件全部移到已解压的主程序根目录models文件夹之下,如:D:\CapsWriter-Offline-Windows-64bit\models。然后运行根目录的服务端start_server.exe,等待模型加载完成(等待时长视电脑配置而定)。最后双击运行start_client.exe客户端。
2.工作原理:默认长按键盘上的大写锁定键Capslock,录音开始,当松开大写锁定键 时,就会识别录音,并将识别结果立刻输入到带有输入框的地方(前提需提前打开输入栏)。相关识别到的录音和日志默认放在根目录下的2024文件夹里,不需要或重录时记得及时清理。
如需要更改触发按键、单击录音单击停止或端口修改等设置,可自行用记事本等文本编辑工具打开config.py文件进行修改,每一栏都有详细的注释说明。
3. 可将音视频文件拖动到客户端中打开,等待处理即可。但转录字幕功能必须在服务端加载完模型并保持后台运行的情况下才可使用,否则会出现闪退不工作等问题。
默认转录之后生成的文件会跟着音视频文件的目录:
json 文件:包含了字级时间戳
txt 文件:包含了分行结果
merge.txt 文件:包含了带标点的整段结果
srt 文件:字幕文件
如果生成的字幕有微小错误,可以在分行的 txt 文件中修改,并将 txt 文件拖动到客户端打开,最后自动修正其余字幕文件。其余功能自行体验。。。
基本效果:(与视频演示的略有点不同,毕竟是1倍慢录制,但基本原理是如此)
sshot-1898712333336.png
相关设置:(此处可改为不常用的insert键激活录音,端口号任意等等,不改亦可)
sshot-8997991111111111.png
转录效果:(转化后生成四个字幕类的不同格式文件)
sshot-189895566666.png
sshot-898989787123331.png
sshot-187123666.png
下载地址:
1 > > 微软盘下载 密码:12Vc
2 > > 123盘下载
3 > > 阿里盘下载
4 > > 百度盘下载 密码:zky3
5 > > 蓝盘下载 密码:b9qt
兴国资源网 Design By www.nnzcdc.com
广告合作:本站广告合作请联系QQ:858582 申请时备注:广告合作(否则不回)
免责声明:本站资源来自互联网收集,仅供用于学习和交流,请遵循相关法律法规,本站一切资源不代表本站立场,如有侵权、后门、不妥请联系本站删除!
免责声明:本站资源来自互联网收集,仅供用于学习和交流,请遵循相关法律法规,本站一切资源不代表本站立场,如有侵权、后门、不妥请联系本站删除!
兴国资源网 Design By www.nnzcdc.com
暂无评论...
稳了!魔兽国服回归的3条重磅消息!官宣时间再确认!
昨天有一位朋友在大神群里分享,自己亚服账号被封号之后居然弹出了国服的封号信息对话框。
这里面让他访问的是一个国服的战网网址,com.cn和后面的zh都非常明白地表明这就是国服战网。
而他在复制这个网址并且进行登录之后,确实是网易的网址,也就是我们熟悉的停服之后国服发布的暴雪游戏产品运营到期开放退款的说明。这是一件比较奇怪的事情,因为以前都没有出现这样的情况,现在突然提示跳转到国服战网的网址,是不是说明了简体中文客户端已经开始进行更新了呢?
更新日志
2024年04月30日
2024年04月30日
- 群星《巅峰煲碟皇·男人篇》[WAV+CUE]
- 2023年中国自研移动游戏全球流水TOP20:《原神》排名第三
- 《纸片马里奥RPG重置版》新预告 5月23日正式发售
- 蓄势待发了!开发商称对《寂静岭2RE》表现充满信心
- 梦剧院.1998-十年十美·十周年新曲+精丫乐意唱片】【WAV+CUE】
- 萧亚轩.2014-不解释亲吻【SONY】【WAV+CUE】
- 群星.2023-长风渡影视原声带【韶愔音乐】【FLAC分轨】
- 林慧萍1996-12-忘了我是女人[点将][WAV+CUE]
- 群星.2023-三体影视原声专辑【炎乐传媒】【FLAC分轨】
- 群星.2024-别对我动心影视原声带【千曜音乐】【FLAC分轨】
- 《明日方舟》联动中国电影资料馆 携手修复经典动画《铁扇公主》
- 《寂静岭2:重制版》开发商新作曝光:与T2合作开发的全新IP
- 回来了!劳拉海报将重新回归《古墓丽影1-3复刻版》
- Taylor Swift霉霉《THE TORTURED POETS DEPARTMENT》2024.4.19最新专辑[FLAC][787M]
- 司南《Chapter II 塔罗牌》[320K/MP3][87.42MB]