YuzuLingo vs video-to-text-japanese (katkaypettitt)
YuzuLingoはブラウザに留まります。YouTube、Bilibili、その他のウェブプレイヤーで、すでに視聴している動画の埋め込まれた字幕をカバーします。実行するノートブックは必要なく、開始するビデオファイルも必要ありません。インタラクトをオンにして、デバイス上で埋め込まれた行を読みます。言語に振り仮名やピンインがある場合はそれも表示します。そのテキストは常に、ホバー中、またはホットキーを押している間に表示できます。
video-to-text-japaneseは、katkaypettittのJupyterノートブックのペアで、リポジトリvideo-to-text-japaneseにあります。ローカルビデオを指定すると、IBM Watson Speech to Textを使用して日本語の音声を文字起こしします。軽いクリーンアップで句読点を追加し、フィラー単語を削除します。一つのノートブックは約15分以上の動画用で、もう一つは短いファイル用です。IBM Cloudアカウント、APIキー、ffmpegが必要です。彼らはWatsonが月に500分の無料時間を含むと言っています。シートには、ビデオフレームを読み取って視覚的および音声的な日本語を抽出するパイプラインが記載されています。READMEには画像のOCRについては記載されていません。READMEの日付は2021年4月で、最後のコミットは約3年前で、リリースはありません。MITライセンス。
各ツールの適所
| 機能 | YuzuLingo | Video to Text (Japanese) |
|---|---|---|
| ブラウザにインストール、実行するノートブックは必要ありません | ||
| ウェブ動画が再生中に埋め込まれた字幕をカバーします | ||
| 開始するビデオファイルは必要ありません | ||
| 動画再生中に、その埋め込まれた行をデバイス上で読みます | ||
| その行に振り仮名やピンインを表示 | ||
| そのテキストを常に、ホバー中またはホットキーを押している間に表示 | ||
| ビデオファイルから話される日本語を文字起こし | ||
| 音声からテキストはデバイス上に留まります | ||
| その行をAnkiデッキに追加 |