RealSub
RealSub よくある質問(FAQ)
English · 简体中文 · 繁體中文 · 日本語
App 1.0.1 / 最終更新 2026-10-04。サードパーティサービスの無料枠・モデル名・エンドポイントは
変更されることがあります。必ず提供元の最新情報をご確認ください。
Q1. 中国本土のネットワークで翻訳は使えますか?
- 標準の「ローカル」翻訳はお使いの PC の中で完結し、ネットワークを通りません。 中国本土でもそのまま使えます(無料のローカル翻訳モデル DLC を入れるだけです)。
- 「Microsoft 翻訳」も中国本土から利用できます(ローカル翻訳モデルが未インストールのときに自動で使われます)。2026-08-13 に本土のノードから全工程を実測し、約 1.2 秒で訳文が返ることを確認しています。追加設定は不要です。
- 中国本土では「Google 翻訳」を選ばないでください。 実測でタイムアウトし、失敗し続けます。
- 上級者向けに「ローカル / LAN サーバー」を選べます。 自分の PC または LAN 内で動かしている OpenAI 互換の翻訳サーバー(Ollama、LM Studio、llama-server など)のアドレスを入力します。アカウントも API キーも不要です。受け付けるのはローカルと LAN のアドレスだけで、インターネット上のアドレスは拒否されます。RealSub は登録や支払いが必要な第三者サービスを一切組み込んでいません。
- 翻訳ソースに失敗した場合は自動的に Microsoft 翻訳へ切り替わります。文字起こしが止まることはありません。認識は完全オフラインで動くため、ネットワークが無くても字幕は出続けます。
Q2. 字幕が出ないのはなぜ?
可能性の高い順に確認してください。
- 再生しているのが歌唱・純粋な音楽、または無線/ラジオ風の加工がかかった声である。 これらには現時点では字幕が出ません。
- 音声ソースの選択が違う。「設定 → 文字起こし → 音声ソース」で特定のアプリを選んでいる場合、そのアプリの音だけが対象になります。「システム全体(デフォルト)」に戻すと全体を取り込みます。
- 目的のアプリが一覧に無い。 Windows は、そのアプリが一度でも音を出して初めて音声セッションを作ります。まず音を鳴らしてから一覧を更新してください。またアプリ単位の取り込みには Windows 10 バージョン 2004 以降が必要です。
- システム音量が 0、アプリがミュート、または音量が非常に小さい。 ミュート中は取り込める音声がありません。音量が小さい場合は本アプリが自動で増幅し(最大 20 倍)、お知らせを一度だけ表示します。最良の認識精度を得るには、Windows の音量か再生アプリの音量を上げてください。なお、Windows のサウンド設定で出力デバイスの「追加のデバイスのプロパティ」(Windows 11 では「サウンドの詳細設定」→ 該当デバイス → プロパティ)を開き、「拡張」タブで「ラウドネス等化」を有効にすると、出力レベルのばらつきを抑えられます。
- 文字起こしが開始されていない。 トレイメニューが「開始」か「停止」かを確認するか、
Ctrl+Alt+S で切り替えてください。
- 字幕ウィンドウが非表示、または画面外にある。
Ctrl+Alt+H で表示を切り替えるか、「設定 → ホットキーとその他 → ウィンドウ」の「ウィンドウ位置をリセット」を使ってください(トレイメニューにも同じ項目があります)。
- 訳文の行だけが出ていない。 無料版に翻訳は含まれません(原文の字幕は通常どおり表示されます)。翻訳はフルバージョン DLC で解放されます。
解決しない場合は、トレイメニューの「診断情報をエクスポート…」で診断 zip を作成し、状況の説明とあわせてサポート宛にお送りください。
Q3. フルバージョン DLC は買うべきですか?
まず無料版をお使いになってからご判断ください。 これは形式的な案内ではなく、実際のおすすめです。
- 本体は無料で、リアルタイム文字起こし字幕がフル機能で使えます。回数制限もありません。インストールすれば、重要な 3 点(あなたのコンテンツで認識精度が足りるか、お使いの GPU で快適に動くか、字幕バーの形が好みか)をその場で確認できます。
- 初回起動時から 7 日間の全機能体験(Steam アカウントごとに 1 回)が付き、その間は翻訳も履歴の書き出しも使えます。
- 体験期間の終了後は、自動的に無料版へ切り替わります。
- 納得できてから DLC を購入する——この順番なら「買ってから合わないと分かった」返金はほとんど起きません。
すでに返金をお決めでしたら、それで構いません。ただ数分だけ無料版をお試しください。よくある「想定外」(歌には字幕が出ない、一部の GPU では高速化されない)はストアページの「できないこと」に明記しています。
Q4. どんな GPU が必要ですか?NVIDIA GPU が無い場合は?
- NVIDIA GTX 10 シリーズ以降、VRAM 2 GB から動作します(4 GB 以上ならより安定)。 既定の認識モデルは 2 GB 強を使用するため、VRAM がちょうど 2 GB のカードでは他のアプリと併用したときに厳しくなることがあります。VRAM 不足やドライバーの不具合などで GPU 側のモデル読み込みに失敗した場合は、自動的に CPU モードへ切り替わります。 事前に設定を変更する必要はありません。
- 本製品は NVIDIA GPU での動作を強く推奨します。 その環境でこそ本来の性能を発揮します。その他の GPU は Vulkan を使いますが、これはベストエフォートです。初回起動時に数十秒の性能テストを行い、合格した場合のみ有効になります。一部の機種で動作確認済みですが、すべてのカードを保証するものではありません。テストに不合格の場合や実行中に Vulkan がエラーになった場合は自動的にフォールバックし、トレイ通知でお知らせしたうえで、設定の実行デバイスを実際に動作しているものへ書き換えます。設定からいつでも「GPU 性能を再検出」を実行できます。
- 実行デバイスは 4 種類:「自動」/「GPU(NVIDIA)」/「AMD / Intel GPU(Vulkan)」/「CPU」。 自動は NVIDIA を優先し、次に Vulkan を試し、最後に CPU です。Vulkan はベストエフォートのため、一部の GPU では高速化されません。
- NVIDIA GPU が無く Vulkan も利用できない場合、または GPU の初期化・モデルの読み込みに失敗した場合、RealSub は自動的に CPU モードに切り替わります(タスクトレイの通知と字幕のステータス行でお知らせします)。CPU モードでは軽量で高速な認識エンジン(SenseVoice)を使うため、字幕は遅れずに追従し、「生成中」のプレビュー行や文の区切りもそのまま使えますが、認識精度は NVIDIA GPU より低くなります。 DLC を購入する前に、まず無料版をお使いの PC でお試しください。
- CPU 側の必須要件は 過去 10 年以内の 4 コア CPU かつ AVX2 対応です。
- 実行デバイスは「設定 → 文字起こし」で「自動」/「GPU(NVIDIA)」/「AMD / Intel GPU(Vulkan)」/「CPU」に固定できます。「GPU 性能を再検出」で Vulkan の判定をやり直すこともできます。
Q5. インターネットは必要ですか?音声はアップロードされますか?
- 音声はすべてお使いの PC 内で処理され、外に出ることはありません。 認識モデル(Whisper)と音声区間検出モデル(Silero VAD)は同梱されており、認識にネットワークは不要です。
- 標準のローカル翻訳もネットワークを使いません。 翻訳は PC 内で完結し、字幕テキストは外に出ません。Microsoft 翻訳や Google 翻訳などのオンライン翻訳サービスを使うときだけ、認識された字幕テキスト(テキストのみ)がそのサービスへ送られ、訳文が返ります。
- テレメトリ、アカウント、利用統計、自動クラッシュ報告はいずれもありません。診断 zip は手動で書き出したときにのみ作成され、ローカルに保存されます。zip 内の API キー・Windows のユーザー名・ファイルパスは自動的にマスクされます。
- 詳細は同梱およびストアページからリンクされたプライバシーポリシーをご覧ください。
Q6. 対応している言語は?
- 認識できる音声:日本語・英語・中国語(簡体字)・中国語(繁体字)。「自動」を選べば判定に任せられます(粘着的に判定するため頻繁に切り替わりません。自動判定で中国語になった場合の出力は簡体字です。繁体字が必要なときは「中国語(繁体字)」を明示的に選んでください)。
- 翻訳先:日本語・英語・簡体字中国語・繁体字中国語。
- インターフェース言語:日本語・英語・簡体字中国語・繁体字中国語(既定はシステム言語に追従。台湾・香港・マカオのシステムでは繁体字)。
- この 3 つは互いに独立しています。たとえば日本語インターフェースで英語音声を認識し、日本語へ翻訳できます。
- 文字起こしモデルと翻訳モデルは理論上さらに多くの言語の組み合わせに対応できますが、品質を保つため、現時点では十分に検証済みの言語のみを提供しています。最新の一覧はアプリ内の設定画面をご確認ください。
Q7. 7 日間の体験期間が終わるとどうなりますか?
自動的に無料版へ切り替わります。
- 使えるもの:リアルタイム文字起こし字幕のすべて(認識言語、同梱モデル、字幕バーの外観、ホットキー、アプリ単位の取り込み)と、すでに保存済みの履歴の閲覧。
- 使えなくなるもの:翻訳(訳文の行)、新しい履歴と録音の保存、SRT / TXT の書き出し。
- フルバージョン DLC を購入すると、その場で元に戻ります。再インストールも再起動も不要です(すぐ反映されない場合は購入ダイアログの「購入済み?更新する」をお使いください)。
- 体験期間は Steam アカウントに紐づいています。アプリの再インストール、データの削除、別の PC への変更では体験期間はリセットされません。
Q8. 書き出した字幕はそのまま動画に使えますか?
SRT 字幕または TXT テキストとして書き出せます(フルバージョンが必要)。ご注意ください。
- タイムスタンプはあなたが聴いていた時刻が基準で、動画ファイル自体のタイムラインではありません。最初から一時停止やシークをせずに再生した場合はほぼ一致しますが、そうでなければ自分でずらす必要があります。
- 短い区間の結合や重複の除去により、個々の字幕の開始・終了が 1〜2 秒ずれることがあります。
- 内容は機械認識・機械翻訳の結果です。公開前に必ず人手で校正してください。
Q9. なぜ翻訳は原文より遅れて表示されるのですか?
標準のローカル翻訳では、訳文は原文とほぼ同時に表示されます。以下は Microsoft 翻訳などのオンライン翻訳サービスを使う場合の説明です。
文単位で翻訳する仕組みによるもので、ネットワークの不具合ではありません。原文の字幕は話している最中から表示されますが、翻訳は文の区切りが確定してから依頼し、結果が返るまでさらに 1〜2 秒かかります。
- 通常の会話:文が終われば自然な間があるため、翻訳の遅れはふつう 2〜3 秒程度です。
- ほとんど間を置かない連続した話し方(解説・講演・配信・早口の動画):区切りが見つからない場合、最長で約 10 秒待ってから強制的に区切るため、翻訳が目に見えて遅れます。
原文(白/グレー)の行はリアルタイムのままで、影響を受けません。翻訳が長時間まったく表示されない・頻繁に欠ける場合のみ、翻訳サービスへの接続に問題がある可能性があります。「設定 → 翻訳」で別の翻訳ソースをお試しください。
Q10. プレーヤーを全画面にすると字幕が消えるのですが?
字幕ウィンドウは毎秒、他のウィンドウに覆われていないかを確認し、覆われている場合にだけ「最前面」を再申請します。通常の全画面再生(PotPlayer、VLC、mpv、ブラウザの全画面、Netflix などのアプリ)では 1 秒以内に最前面へ戻ります。
それでも表示されない場合は、プレーヤーが排他的フルスクリーン(PotPlayer の「Direct3D 排他モード」、madVR の fullscreen exclusive、mpv の --d3d11-exclusive-fs など)を使っている可能性が高いです。排他的フルスクリーンでは、どんなウィンドウも映像の上に重ねられず、Windows 自体の音量ポップアップすら表示されません。音量を変えてもシステムの音量バーが出ないなら、この状態です。プレーヤーの設定で排他モードをオフにするか、ボーダーレスウィンドウの全画面に切り替えてください。
もう一つ、Windows 10 でだけ起こるケースがあります。標準アプリの「映画 & テレビ」のようなストアアプリが起動した時点ですでに全画面になっている場合、Windows はその全画面表示を通常の最前面ウィンドウより高い表示レイヤーに置くため、字幕ウィンドウを重ねられません。いったん全画面を解除して、もう一度全画面にすれば表示され、それ以降は字幕が最前面に保たれます。
Q11. 「ローカル / LAN サーバー」には何を入力しますか?
自分の PC または LAN 内で OpenAI 互換の翻訳サーバーをすでに動かしている人向けの選択肢です。アカウントもキーも不要です。受け付けるのはローカルと LAN のアドレスだけ(localhost、127.x、10.x、192.168.x、172.16〜31.x)で、インターネット上のアドレスは拒否されます。
| サーバー |
API アドレス(/v1 まで) |
モデル名 |
備考 |
| Ollama |
http://127.0.0.1:11434/v1 |
ollama pull 済みのモデル名(例:qwen2.5:7b) |
必須。間違えると「model not found」になります |
| LM Studio |
http://127.0.0.1:1234/v1 |
LM Studio に表示される識別子、または空欄 |
空欄なら読み込み中のモデルを使用。先に LM Studio でローカルサーバーを起動 |
| llama-server(llama.cpp) |
http://127.0.0.1:8080/v1 |
任意、空欄可 |
モデルは 1 つだけなので名前は無視されます |
| LAN 内の別の PC |
http://192.168.1.20:11434/v1 |
上記と同じ |
127.0.0.1 をその PC の LAN IP に置き換え、サーバーが 0.0.0.0 で待ち受けていることを確認 |
確認方法:アドレスとモデル名を入力したあと、人が話している動画を再生し、訳文の行が出れば成功です。接続できない、またはモデル名が間違っている場合は、字幕バーに翻訳ソースの失敗が表示され、自動的に Microsoft 翻訳へ戻ります。翻訳品質は選んだモデル次第で、7B 以上の汎用モデルなら日→中はおおむね実用的、小さなモデルは明らかに硬くなります。
Q12. 起動後「読み込み中…」のまま進みません。固まっていますか?
固まってはいません。文字起こしをオフラインで行うため、RealSub は音声認識モデルと GPU ランタイムをローカルに同梱しており、コールドスタート(PC 起動後の最初の起動)のたびにディスクから約 4 GB を読み込みます。
- 内蔵 SSD:通常 30 秒以内
- 内蔵 HDD:1 分ほどかかることがあります
- USB 外付けドライブ / USB メモリ:数分かかることがあり(ある外付けドライブでの実測で 2 分超)、おすすめしません
読み込み中は字幕バーに現在の段階と経過秒数が表示されます。数字が進んでいれば正常です。同じ Windows セッション内での 2 回目以降の起動は、ファイルがメモリにキャッシュされているため大幅に速くなります。
速くするには、Steam ライブラリを内蔵 SSD に置いてください。Steam の「設定 → ストレージ」から、再ダウンロードなしでインストール済みコンテンツを移動できます。
Q13. アップデート後の起動が遅い / GPU のテストがやり直された / GPU があるのに CPU で動いているのはなぜ?
1.0.1 へのアップデートでは、次の 3 点が変わります。
- アップデート後の最初の起動で、GPU 性能テストを 1 回だけやり直します。 このバージョンでテストの方法が変わったため、旧バージョンで保存した結果は使われず、その 1 回だけ起動が十数秒〜数十秒長くなります。2 回目以降は通常どおりです。新しいテストは基準も厳しくなっており、以前ぎりぎり合格していた性能の低い AMD / Intel GPU や内蔵 GPU は、今回 CPU モードと判定されることがあります。その場合は「CPU モードに切り替えました」と通知され、実行デバイスの設定も「CPU」に変わります。これは故障ではなく意図した動作で、こうした PC では CPU モードの新しいエンジンのほうが GPU より遅れずに追従します(Q4 参照)。NVIDIA GPU には影響ありません。
- 旧バージョンが一度のエラーで使わなくなった GPU も、自動的にもう一度試されます。 旧バージョンでは実行中のエラー 1 回で GPU を以後ずっと使わなくなることがありましたが、その記録はアップデートで無効になります。(1.0.1 以降、実行中のエラーで CPU に切り替わるのはそのセッションの間だけで、RealSub を再起動すれば GPU に戻ります。)
- ただし、すでに「CPU」になっている実行デバイスの設定は自動では戻りません。 旧バージョンが実行デバイスを「CPU」に変更していた場合(当時「CPU モードに切り替えました」と通知されたはずです)、それはお客様の設定として扱われ、アップデートでは変更しません。GPU をもう一度試すには、「設定 → 文字起こし」で実行デバイスを「自動」に戻してください。テストに合格すれば GPU が使われ、不合格なら CPU モードに戻って通知されるだけで、ほかに影響はありません。