tianjiangweiren 发表于 2026-1-21 17:25:42

PeterYue 发表于 2026-1-21 17:25:43

WHISPERJAV 然後丟 GROK

tianjiangweiren 发表于 2026-1-21 17:27:18

zhihuizhiguang4 发表于 2026-1-21 17:51:34

commade17402 发表于 2026-1-21 16:20
楼主一开始说要破解马赛克。
字幕肯定是用 海南鸡饭 AI

海南鸡饭他底模用的whisper large v2,我去看了看,这模型上下文太小了,它是切割音频每片30s去跑,模型会读取上一段音频解码出的文本,但是会被硬性截断为最后224个Token,224 Token大约对应100-150个汉字,一个片子差不多都在1.2个小时,这上下文太小不够看的

zhihuizhiguang4 发表于 2026-1-21 19:17:16

tianjiangweiren 发表于 2026-1-21 17:27
哪里有教程呢

这是我自己弄的,组合的开源项目,我前面的帖子有写基础步骤

commade17402 发表于 2026-1-22 09:08:56

zhihuizhiguang4 发表于 2026-1-21 19:17
这是我自己弄的,组合的开源项目,我前面的帖子有写基础步骤

能优化一下吗?这里都是小白,看看安装步骤,都劝退了。没有拖入bat文件方便。

zyzy1 发表于 2026-1-22 13:17:41

commade17402 发表于 2026-1-21 12:09
有电脑直接自己lada.10.1版破解。正常电脑原版4k60fps,2-3小时一部。而且没有98的水印。 ...

这么快的?我1080p的都要跑2-3小时 有菜最后那部4K跑了12个小时

tarcy0410 发表于 2026-1-22 14:32:53

海南鸡用哪个设置?默认的中文字幕提取也不太准确。

popu9266 发表于 2026-1-22 16:15:03

偶偶跑,可以用云电脑,一半时间就能跑完

zhihuizhiguang4 发表于 2026-1-23 14:10:54

commade17402 发表于 2026-1-22 09:08
能优化一下吗?这里都是小白,看看安装步骤,都劝退了。没有拖入bat文件方便。 ...

让模型直接听译,和一个模型听写,一个翻译,就这点区别。我理解鸡饭那个相当于直接用的openai做的whisper加了部署脚本和处理脚本,自己喂了点数据这样,所以傻瓜式部署硬件适配openai已经大部分做好了,问题是那个模型本身就1.5B参数,上限太小了。
页: 1 [2] 3
查看完整版本: 现在翻译字幕最厉害的是哪个脚本