WHISPERJAV 然後丟 GROK
commade17402 发表于 2026-1-21 16:20
楼主一开始说要破解马赛克。
字幕肯定是用 海南鸡饭 AI
海南鸡饭他底模用的whisper large v2,我去看了看,这模型上下文太小了,它是切割音频每片30s去跑,模型会读取上一段音频解码出的文本,但是会被硬性截断为最后224个Token,224 Token大约对应100-150个汉字,一个片子差不多都在1.2个小时,这上下文太小不够看的
tianjiangweiren 发表于 2026-1-21 17:27
哪里有教程呢
这是我自己弄的,组合的开源项目,我前面的帖子有写基础步骤
zhihuizhiguang4 发表于 2026-1-21 19:17
这是我自己弄的,组合的开源项目,我前面的帖子有写基础步骤
能优化一下吗?这里都是小白,看看安装步骤,都劝退了。没有拖入bat文件方便。
commade17402 发表于 2026-1-21 12:09
有电脑直接自己lada.10.1版破解。正常电脑原版4k60fps,2-3小时一部。而且没有98的水印。 ...
这么快的?我1080p的都要跑2-3小时 有菜最后那部4K跑了12个小时
海南鸡用哪个设置?默认的中文字幕提取也不太准确。
偶偶跑,可以用云电脑,一半时间就能跑完
commade17402 发表于 2026-1-22 09:08
能优化一下吗?这里都是小白,看看安装步骤,都劝退了。没有拖入bat文件方便。 ...
让模型直接听译,和一个模型听写,一个翻译,就这点区别。我理解鸡饭那个相当于直接用的openai做的whisper加了部署脚本和处理脚本,自己喂了点数据这样,所以傻瓜式部署硬件适配openai已经大部分做好了,问题是那个模型本身就1.5B参数,上限太小了。