YuzuLingo対Tdarr字幕OCR(thewolfman56)
YuzuLingoはブラウザ内に留まります。すでに視聴しているYouTube、Bilibili、その他のウェブプレイヤーで、埋め込まれた字幕をカバーします。セットアップするDockerやTdarrは不要で、ビデオファイルのダウンロードもありません。インタラクトをオンにすると、言語にふりがなやピンインがあるときに、デバイスで埋め込まれた行を読むことができます。そのテキストを常に表示するか、ホバーしている間、またはホットキーを押している間に表示します。
Tdarr字幕OCRは、tdarr-subtitle-ocrリポジトリ内のthewolfman56のDockerサイドカーです。Tdarrはライブラリファイルからイメージ字幕を取り出し、このサービスはSRTを書き込みます。NVIDIA CUDA、Intel OpenVINO、またはSubtitle Editを使用できます。Bearerトークンと共有フォルダを設定します。デフォルトのイメージには英語のTesseractデータのみが含まれています。より多くの言語は追加のTesseractデータを必要とします。バージョン0.1.0。再生中のウェブビデオに対して行をカバーすることはできません。
各自の適所
| 機能 | YuzuLingo | Tdarr Subtitle OCR |
|---|---|---|
| ブラウザにインストール、DockerやTdarrを設定しません | ||
| ビデオファイルのダウンロードは不要 | ||
| YouTube、Bilibili、その他のウェブプレイヤーで埋め込まれた字幕をカバー | ||
| デバイス上でビデオ再生中にその行を読む | ||
| その行にふりがなやピンインを表示 | ||
| 常にそのテキストを表示、ホバー中またはホットキーを押している間に表示 | ||
| 英語 | ||
| 追加の言語ファイルなしで日本語、韓国語、中国語、スペイン語 | ||
| PGS、VobSub、または他の画像字幕をSRTに変換 | ||
| NVIDIA CUDAまたはIntel OpenVINO | ||
| OCRはデバイス上に留まります | ||
| その行をAnkiデッキに追加 |