这个项目能做什么
cuesift 是一种 triage 引擎,它从字幕翻译结果中仅挑选出真正需要人工审查的条目。它不是对全部字幕进行全量审查,而是根据风险评分,将高于一定比例或阈值的条目放入审查队列,从而降低成本和瓶颈。
**主要功能**
- CLI 命令:`cuesift check`(字幕规范检查——行长度、CPS、时间重叠等 7 类违规),`cuesift translate`(利用 LLM 进行多语言翻译,自动根据目标语言应用对应的规范配置文件),`cuesift transcribe`(语音转文本,STT)
- 分流:翻译完成后立即使用 Tier 0 的 9 种信号(长度比例、翻译率、重复、结构为空等)计算风险分数。可通过 `--review-budget`、`--review-threshold`、`--review-top-k` 等参数设置审查配额。
- Tier 1:通过自洽性(对同一段落重新翻译后测量波动)和逆向翻译(嵌入相似度)来捕捉语义错误。需同时使用 `--tier1` 和 `--embed-model` 参数。
- 输入输出格式:支持 SRT、WebVTT、ASS、SAMI。输出文件名遵循 `{stem}.{目标语言}.{扩展名}` 的规则,以防止重复的语言标签。
- 缓存:将翻译调用结果存储在 `.cuesift/cache/` 目录中,以便在重新运行时减少网络开销。
- 审查报告:提供 JSON 或 HTML 格式。
**基准测试**
在使用 TED2020 语料库进行的合成错误注入实验中,预算占比 10% 时,英译韩(en-ko)和日译韩(ja-ko)相较于随机抽样的错误召回率(Recall)分别提高了 7.32 倍和 7.56 倍。但这仅基于合成错误,尚未验证与实际翻译错误的一致性。意义逆转(negation)错误仅凭确定性信号难以捕获,这进一步确认了 Tier 1 的必要性。
**当前状态**
目前处于 pre-alpha 阶段,Tier 0 信号引擎和 CLI 命令已完成实现及实际测量。Tier 1 的逆向翻译信号虽可工作,但候选选择逻辑尚未完成。在正式稳定版发布之前,不建议在生产环境中使用。
评论
0 评分人数达到10人后显示
登录后参与讨论。