找回密码
 立即注册
查看: 3244|回复: 76

AI一键音频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载

  [复制链接]

签到天数: 25 天

[LV.4]偶尔看看III

635

主题

835

回帖

5万

积分

武林盟主

积分
53766

宣传达人灌水之王突出贡献荣誉管理论坛元老

QQ
发表于 2024-7-3 09:20:03 | 显示全部楼层 |阅读模式

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...


这是 CapsWriter-Offline ,一个 PC 端的语音输入、字幕转录工具。可用实现简单一键将音频文件转换成文字的懒人工具。

两个功能:
1、实时转换,按下键盘上的 大写锁定键,录音开始,当松开 大写锁定键 时,就会识别你的录音,并将识别结果立刻输入
2,离线转换,将音视频文件拖动到客户端打开,即可转录生成 srt 字幕

官方视频教程


特性
完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔
热词功能:可以在 hot-en.txt hot-zh.txt hot-rule.txt 中添加三种热词,客户端动态载入
日记功能:默认每次录音识别后,识别结果记录在 年份/月份/日期.md ,录音文件保存在 年份/月份/assets
关键词日记:识别结果若以关键词开头,会被记录在 年份/月份/关键词-日期.md,关键词在 keywords.txt 中定义
转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕
服务端、客户端分离,可以服务多台客户端
编辑 config.py ,可以配置服务端地址、快捷键、录音开关……


本地离线整合包

请确保电脑上安装了 Microsoft Visual C++ Redistributable 运行库
服务端载入模型所用的 onnxruntime 只能在 Windows 10 及以上版本的系统使用
服务端载入模型需要系统内存 4G,只能在 64 位系统上使用
额外打包了 32 位系统可用的客户端,在 Windows 7 及以上版本的系统可用
我已经把模型和软件打包好,无需单独下载模型,下载整合包,解压即用。


软件目录说明

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...



功能:热词

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...


如果你有专用名词需要替换,可以加入热词文件。规则文件中以 # 开头的行以及空行会被忽略,可以用作注释。

中文热词请写到 hot-zh.txt 文件,每行一个,替换依据为拼音,实测每 1 万条热词约引入 3ms 延迟

英文热词请写到 hot-en.txt 文件,每行一个,替换依据为字母拼写

自定义规则热词请写到 hot-rule.txt 文件,每行一个,将搜索和替换词以等号隔开,如 毫安时  =  mAh

你可以在 core_client.py 文件中配置是否匹配中文多音字,是否严格匹配拼音声调。

检测到修改后,客户端会动态载入热词,效果示例:

例如 hot-zh.txt 有热词「我家鸽鸽」,则所有识别结果中的「我家哥哥」都会被替换成「我家鸽鸽」
例如 hot-en.txt 有热词「ChatGPT」,则所有识别结果中的「chat gpt」都会被替换成「ChatGPT」
例如 hot-rule.txt 有热词「毫安时 = mAh」,则所有识别结果中的「毫安时」都会被替换成「mAh」


功能:日记、关键词

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...

AI一键音视频转文字工具 速度超快,支持实时转换,无需联网,本地整合包下载 ... ... ... ... ... ... ...


默认每次语音识别结束后,会以年、月为分类,保存录音文件和识别结果:

录音文件存放在「年/月/assets」文件夹下
识别结果存放在「年/月/日.md」Markdown 文件中
例如今天是2023年6月5号,示例:

语音输入任一句话后,录音就会被保存到 2023/06/assets 路径下,以时间和识别结果命名,并将识别结果保存到 2023/06/05.md 文件中,方便我日后查阅
例如我在 keywords.txt 中定义了关键词「健康」,用于随时记录自己的身体状况,吃完饭后我可以按住 CapsLock 说「健康今天中午吃了大米炒饭」,由于识别结果以「健康」关键词开头,这条识别记录就会被保存到 2023/06/05-健康.md 中
例如我在 keywords.txt 中定义了关键词「重要」,用于随时记录突然的灵感,有想法时我就可以按住 CapsLock 说「重要,xx问题可以用xxxx方法解决」,由于识别结果以「重要」关键词开头,这条识别记录就会被保存到 2023/06/05-重要.md 中


功能:转录文件

在服务端运行后,将音视频文件拖动到客户端打开,即可转录生成四个同名文件:

json 文件,包含了字级时间戳
txt 文件,包含了分行结果
merge.txt 文件,包含了带标点的整段结果
srt 文件,字幕文件
如果生成的字幕有微小错误,可以在分行的 txt 文件中修改,然后将 txt 文件拖动到客户端打开,客户端检测到输入的是 txt 文件,就会查到同名的 json 文件,结合 json 文件中的字级时间戳和 txt 文件中修正结果,更新 srt 字幕文件。


修改配置

5.png

你可以编辑 config.py ,在开头部分有注释,指导你修改服务端、客户端的:

连接的地址和端口,默认是 127.0.0.1 和 6006
键盘快捷键
是否要保存录音文件
要移除识别结果末尾的哪些标点,(如果你想把句尾的问号也删除掉,可以在这边加上)


下载地址:
游客,如果您要查看本帖隐藏内容请回复
DEEPFACE论坛免责声明
本论坛发布的所有内容,包括图片、软件、模型等部分来自网络,版权归原作者所有。
本论坛提供的内容仅用于个人学习和研究,请勿滥用,否则由此引发的责任需自行承担。
请合理合法使用AI技术,并遵守当地法律法规,不要用于违法用途!
如本站发布内容侵犯了你的合法权益,请联系我们删除。

各种参数DFL换脸模型/实时换脸模型底丹、实时换脸模型训练教学/实时换脸模型定制、AI软件个性化定制
论坛所有一键包报错请在帖子下方跟帖,看到会回复,不支持一对一解答,请确认再下载!
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)

该用户从未签到

0

主题

5

回帖

16

积分

初入江湖

积分
16
发表于 2024-7-3 10:13:41 | 显示全部楼层
学习一下

该用户从未签到

0

主题

5

回帖

16

积分

初入江湖

积分
16
发表于 2024-7-3 10:16:33 | 显示全部楼层

可惜链接无效了

签到天数: 25 天

[LV.4]偶尔看看III

635

主题

835

回帖

5万

积分

武林盟主

积分
53766

宣传达人灌水之王突出贡献荣誉管理论坛元老

QQ
 楼主| 发表于 2024-7-3 10:34:18 | 显示全部楼层

这软件动了百度的利益,秒封。我重传一个加密的

各种参数DFL换脸模型/实时换脸模型底丹、实时换脸模型训练教学/实时换脸模型定制、AI软件个性化定制
论坛所有一键包报错请在帖子下方跟帖,看到会回复,不支持一对一解答,请确认再下载!
全站默认解压密码: https://deepface.cc/ 或 https://deepfaces.cc/ (密码就是这个网址,不要点开去找。复制完整网址即可,不要有空格)

该用户从未签到

0

主题

2

回帖

10

积分

初入江湖

积分
10
发表于 2024-7-3 11:06:18 | 显示全部楼层
学习一下

该用户从未签到

0

主题

103

回帖

130

积分

无名之辈

积分
130
发表于 2024-7-3 15:14:01 | 显示全部楼层
谢谢分享,试用一下看效果如何

该用户从未签到

0

主题

103

回帖

130

积分

无名之辈

积分
130
发表于 2024-7-4 18:28:31 | 显示全部楼层
下了两次,解压缩都显示出现“校验和错误”

点评

重新下载  发表于 2024-8-4 16:36
我晚点看看是不是压缩包有问题  发表于 2024-7-4 21:06

该用户从未签到

0

主题

5

回帖

12

积分

初入江湖

积分
12
发表于 2024-7-5 02:39:17 来自手机 | 显示全部楼层
学习一下

该用户从未签到

0

主题

13

回帖

47

积分

初入江湖

积分
47
发表于 2024-7-5 08:30:36 | 显示全部楼层
只可以音频不可以视频吗?

签到天数: 3 天

[LV.2]偶尔看看I

0

主题

13

回帖

187

积分

无名之辈

积分
187
发表于 2024-7-5 20:40:49 | 显示全部楼层
谢谢分享,看看。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|AIGC资源站

GMT+8, 2025-5-16 17:36 , Processed in 0.089238 second(s), 6 queries , Redis On.

Powered by Discuz! X3.5

©2001-2023 Discuz! Team

快速回复 返回顶部 返回列表