YuzuLingo vs video-to-text-japanese (katkaypettitt)
YuzuLingo se queda en el navegador. Tienes subtítulos incrustados en el video que ya estás viendo, incluyendo YouTube, Bilibili y otros reproductores web. No hay un cuaderno que ejecutar ni un archivo de video desde el cual empezar. Activa Interact para leer la línea incrustada en tu dispositivo, con furigana o pinyin cuando el idioma los tenga.
video-to-text-japanese es un par de cuadernos Jupyter de katkaypettitt, en el repositorio video-to-text-japanese. Le das un video local y transcribe el discurso japonés con IBM Watson Speech to Text. Una ligera limpieza agrega puntuación y elimina palabras de relleno. Un cuaderno es para videos de más de unos 15 minutos, y otro es para archivos más cortos. Necesitas una cuenta de IBM Cloud, una clave API y ffmpeg. Dicen que Watson incluye 500 minutos gratis al mes. La hoja describe un pipeline que lee fotogramas de video y extrae japonés hablado y visual. El README no describe OCR de la imagen. El README tiene fecha de abril de 2021. El último commit fue hace unos 3 años, y no hay lanzamientos. Licencia MIT.
Dónde encaja cada uno
| Función | YuzuLingo | Video to Text (Japanese) |
|---|---|---|
| Instalar en el navegador, no hay cuaderno que ejecutar | ||
| Cubrir subs incrustados mientras se reproduce un video web | ||
| No hay un archivo de video desde el cual empezar | ||
| Leer esa línea incrustada mientras se reproduce el video, en tu dispositivo | ||
| Furigana o pinyin en esa línea | ||
| Mostrar ese texto siempre, al pasar el ratón, o mientras mantienes una tecla de acceso rápido | ||
| Transcribir japonés hablado desde un archivo de video | ||
| El speech-to-text se queda en el dispositivo | ||
| Agregar la línea a un mazo de Anki |