YuzuLingo vs cuddly-journey (Shirajuki)
YuzuLingo permanece no navegador. Você cobre as legendas embutidas no vídeo que já está assistindo, incluindo YouTube, Bilibili e outros reprodutores da web. Não há script para rodar e nenhum arquivo de vídeo para começar. Ative o Interact para ler a linha embutida no seu dispositivo, com furigana ou pinyin quando a língua os tiver. Mostre esse texto sempre, ao passar o mouse, ou enquanto mantém uma tecla de atalho.
cuddly-journey é o projeto da Shirajuki, no repositório cuddly-journey. O README marca como WIP. O objetivo é um SRT de um vídeo com legendas codificadas, e depois uma faixa de áudio dublada a partir desse SRT. Scripts autônomos realizam essas etapas: hard_subs_to_srt.py pega um vídeo, um SRT de saída e um SRT auxiliar, usando o Tesseract. process_tts.py limpa um SRT. tts-edge.py cria pedaços de TTS, e outro script transforma esses pedaços em um arquivo de áudio. O README diz que o script de extração só suporta 1280x720 por enquanto. Um editor web, uma caixa de recorte, correção de frases em LLM, Docker e o guia ainda estão como TODO ou TBA. Ele precisa do Python 3, Tesseract para seu idioma-alvo e FFmpeg. O README credita o video-subtitle-extractor para o binário VideoSubFinderCli. O último commit foi há cerca de 2 anos, e não há release.
Onde cada um se encaixa
| Recurso | YuzuLingo | cuddly-journey |
|---|---|---|
| Instale no navegador, nenhum script para rodar | ||
| Cubra legendas embutidas enquanto um vídeo da web toca | ||
| Nenhum arquivo de vídeo para começar | ||
| Leia essa linha enquanto o vídeo toca, no seu dispositivo | ||
| Furigana ou pinyin nessa linha | ||
| Mostre esse texto sempre, ao passar o mouse, ou enquanto mantém uma tecla de atalho | ||
| Extraia legendas codificadas de um vídeo local para um SRT | ||
| Gere áudio dublado a partir desse SRT | ||
| Qualquer tamanho de vídeo, não apenas 1280x720 | ||
| OCR permanece no dispositivo | ||
| Adicione a linha a um baralho do Anki |