- 2024-3-20 00:21 发布
- 浏览 1655 次
- 下载 1 次
软件简介
CapsWriter(详情请戳 作者项目地址)是一款免费开源且可完全离线识别的语音输入工具,无需担心因在线版本识别带来的各种隐私泄露问题。支持win7及以上的系统,已经更新融合了语音输入以及音视频文件实现字幕转录的功能。相比某些必须在线识别又或者需要付费又有时长限制的app、软件或网站而言,此款良心多了,基本能满足大部分场合需求如会议记录或键盘失灵等。有需自取~~~
软件特性:
1.完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔
2.热词功能:可以在 hot-en.txthot-zh.txt hot-rule.txt 中添加三种热词,客户端动态识别载入
3.日记功能:默认每次录音识别后,识别结果记录在 年份/月份/日期.md ,录音文件保存在 年份/月份/assets
4.关键词日记:识别结果若以关键词开头,会被记录在 年份/月份/关键词-日期.md,关键词在 keywords.txt 中定义
5.转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕、txt文本等等
6.服务端、客户端分离,可以服务多台客户端
使用说明:
> >详细完整教程请戳:从安装到基本入门上手
PS:懒人包为python开发打包而成,降低环境部署的难度。部分杀软会误报,如担心请自行扔进虚拟机或验证可靠性再使用。另外,该软件的核心在于模型,模型有点大,介意的则勿下。。
以下仅作简明扼要:
1.主程序基本是百兆之内的压缩包(很好辨认),根据系统环境解压后,再将models.zip模型包里边的文件全部移到已解压的主程序根目录models文件夹之下,如:D:\CapsWriter-Offline-Windows-64bit\models。然后运行根目录的服务端start_server.exe,等待模型加载完成(等待时长视电脑配置而定)。最后双击运行start_client.exe客户端。
2.工作原理:默认长按键盘上的大写锁定键Capslock,录音开始,当松开大写锁定键 时,就会识别录音,并将识别结果立刻输入到带有输入框的地方(前提需提前打开输入栏)。相关识别到的录音和日志默认放在根目录下的2024文件夹里,不需要或重录时记得及时清理。
如需要更改触发按键、单击录音单击停止或端口修改等设置,可自行用记事本等文本编辑工具打开config.py文件进行修改,每一栏都有详细的注释说明。
3. 可将音视频文件拖动到客户端中打开,等待处理即可。但转录字幕功能必须在服务端加载完模型并保持后台运行的情况下才可使用,否则会出现闪退不工作等问题。
默认转录之后生成的文件会跟着音视频文件的目录:
json 文件:包含了字级时间戳
txt 文件:包含了分行结果
merge.txt 文件:包含了带标点的整段结果
srt 文件:字幕文件
如果生成的字幕有微小错误,可以在分行的 txt 文件中修改,并将 txt 文件拖动到客户端打开,最后自动修正其余字幕文件。其余功能自行体验。。。
基本效果:(与视频演示的略有点不同,毕竟是1倍慢录制,但基本原理是如此)
相关设置:(此处可改为不常用的insert键激活录音,端口号任意等等,不改亦可)
转录效果:(转化后生成四个字幕类的不同格式文件)
软件特性:
1.完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔
2.热词功能:可以在 hot-en.txthot-zh.txt hot-rule.txt 中添加三种热词,客户端动态识别载入
3.日记功能:默认每次录音识别后,识别结果记录在 年份/月份/日期.md ,录音文件保存在 年份/月份/assets
4.关键词日记:识别结果若以关键词开头,会被记录在 年份/月份/关键词-日期.md,关键词在 keywords.txt 中定义
5.转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕、txt文本等等
6.服务端、客户端分离,可以服务多台客户端
使用说明:
> >详细完整教程请戳:从安装到基本入门上手
PS:懒人包为python开发打包而成,降低环境部署的难度。部分杀软会误报,如担心请自行扔进虚拟机或验证可靠性再使用。另外,该软件的核心在于模型,模型有点大,介意的则勿下。。
以下仅作简明扼要:
1.主程序基本是百兆之内的压缩包(很好辨认),根据系统环境解压后,再将models.zip模型包里边的文件全部移到已解压的主程序根目录models文件夹之下,如:D:\CapsWriter-Offline-Windows-64bit\models。然后运行根目录的服务端start_server.exe,等待模型加载完成(等待时长视电脑配置而定)。最后双击运行start_client.exe客户端。
2.工作原理:默认长按键盘上的大写锁定键Capslock,录音开始,当松开大写锁定键 时,就会识别录音,并将识别结果立刻输入到带有输入框的地方(前提需提前打开输入栏)。相关识别到的录音和日志默认放在根目录下的2024文件夹里,不需要或重录时记得及时清理。
如需要更改触发按键、单击录音单击停止或端口修改等设置,可自行用记事本等文本编辑工具打开config.py文件进行修改,每一栏都有详细的注释说明。
3. 可将音视频文件拖动到客户端中打开,等待处理即可。但转录字幕功能必须在服务端加载完模型并保持后台运行的情况下才可使用,否则会出现闪退不工作等问题。
默认转录之后生成的文件会跟着音视频文件的目录:
json 文件:包含了字级时间戳
txt 文件:包含了分行结果
merge.txt 文件:包含了带标点的整段结果
srt 文件:字幕文件
如果生成的字幕有微小错误,可以在分行的 txt 文件中修改,并将 txt 文件拖动到客户端打开,最后自动修正其余字幕文件。其余功能自行体验。。。
基本效果:(与视频演示的略有点不同,毕竟是1倍慢录制,但基本原理是如此)
相关设置:(此处可改为不常用的insert键激活录音,端口号任意等等,不改亦可)
转录效果:(转化后生成四个字幕类的不同格式文件)

影像后期下载排行
名称
趋势
下载量
-
EDIUS Pro 9破解版是一款极其专业的非线性视频编辑软件,如果平常的视频编...[详情]
影像后期最新收录
名称
趋势
浏览量
-
达芬奇调色软件更新 | DaVinci Resolve 19.1 DaVinci Resolve 19.1版软...[详情]
热门排行
-
高清屏幕录像软件 Mirillis Action! v2.7.0 中文注册版
-
专业视频剪辑软件 Vegas Pro 15 v15.0.0.177 中文破解版
-
EDIUS Pro 9破解版是一款极其专业的非线性视频编辑软件
-
會聲會影2020直装旗舰版_23.2.0.588
-
小日本视频转换器 v5.1.0.46 汉化版
-
视频多余移动物体移除软件 ProDAD Erazr 1.5.76.2 Win破解版
-
DaVinci Resolve studio 19.1.1【达芬奇】中文破解版下载
-
FXhome Ignite Pro 4.0 特效合成插件套装(含枪火插件) For AE/PR/OFX(For Win)
-
专业剪辑特效合成软件 HitFilm Pro 9.1.8023.07201 Win破解版
-
EDIUS 8.5.3.3262 中文完美破解版(D友有福了)
-
Sayatoo 傻丫头卡拉字幕精灵2.3.8.5568修复WIN10闪退
-
C4D R21 Maxon Cinema 4D R21.207 Win破解版【带中文语言包+预设库】
-
EDIUS Pro 6.55 注册永久使用版
-
Edius 10.34.12119 最新版含插件
-
EDIUS 8.5.3.4924 一键安装中文破解版(竖屏教程)
-
C4D S24三维软件Maxon Cinema 4D S24.037 Win/Mac中文版/英文版/破解版+通用破解补丁
-
500款证件照服装+修图师必备插件免费送
-
Corel产品注册机20180618
-
雷特字幕软件PJ版 2.3.5.0
-
智能抠图及换背景 PhotoScissors 6.1 x86 & x64 完美汉化版
-
edius抠像插件robusky 1.2 汉化最新版
-
AE PR中文汉化插件Boris FX Continuum Complete 2020 V13 BCC 13
-
绝对强大字幕插件 NewBlue Titler Pro 7.0.191114 最终特别中文版
-
ddlm老师的幻影粒子Continuum 2019 Particle Emitters不完全汉化版
-
离线语音识别输入工具CapsWriter v1.0——支持无限时长语音+音视频文件转录字幕
-
证件照助手1.0.1正式版(之前发的1.0.0版本有使用次数限制,已经删除,本版本没有使用
-
ProDAD Heroglyph 4.0.295 英雄字幕
-
proDAD VitaScene 4.0.295 中文汉化版 扫光插件