Live Recording Transcription であらゆる会議をテキスト化
RiverScript Desktop client を使えば、すでに録音済みの会議を文字起こししたり、会議の進行中にシステム音声を録音して、あとからテキストに変換したりできます。RiverScript は、どのアプリから出ている音であっても、お使いのコンピューターで再生されるあらゆる音をキャプチャします。つまり、ウェビナーに単なる参加者として参加するだけでも、ホストでなくても完全な文字起こしを取得できます。
RiverScript には Web 版もありますが、会議の文字起こしにはデスクトップアプリの使用をおすすめします。大きく長い録音を 3〜5 倍高速に処理でき、Live Recording Transcription によりコンピューター内部の音声もキャプチャできます。ブラウザでは、ウェブサイトにこの種の機能を提供することはできません。
RiverScript は、AI モデルを使って Zoom、Teams、Google Meet、そして事実上あらゆる会議を文字起こしするための完全なワークフローです。また、文字起こしを 100 言語に翻訳し、録音全体の要約を生成することもできます。文字起こしはスペイン語、フランス語、その他対応言語へ翻訳できます。さらに AI チャットを使って、録音内の重要な情報を探すこともできます。何が話されたのか質問すれば、内容に基づいて回答します。
この client は Mac と Windows の両方で動作します。ダウンロードページから入手できます。
開始するには、まず Windows と Mac 向けガイドで、RiverScript のインストール方法とシステム音声の録音方法をご確認ください。
Live Recording でグループ通話を録音する前、または既存の音声ファイルや動画ファイルを文字起こしのためにアップロードする前に、必要な結果が何かを決めてください。プレーンテキストなのか、タイムスタンプ付きの文字起こしなのかです。以下のガイダンスを参考に適切な設定を選び、その後で録音を開始するか、ファイルをアップロードしてください。

II. インタビューやフォーカスグループセッションを文字起こしする予定ですか? 録音には、聞き分けたい複数の話者が含まれていますか? さらに、それぞれに名前のラベルを付けたいですか? 最終的な文字起こしを PDF、TXT、または DOCX ファイルとして保存したいですか?
これらのいずれかに当てはまる場合は、Result フィールドで Text only を選択し、その後 Detect speakers を有効にしてください。録音を開始する前、またはファイルをアップロードする前に、チェックボックスが選択されていることを確認してください。
Detect speakers オプションは Premium プランのユーザーのみ利用可能です。

III. Apple Podcasts、Spotify、または SoundCloud のようなポッドキャストプラットフォームで文字起こしを使いたいですか? あるいは YouTube チャンネルに字幕としてアップロードしたいですか? キャプションが必要ですか? 最終ファイルを VTT または SRT 形式で欲しいですか?
これらの用途では、Result フィールドで Timecodes を選択してください。
IV. 理想の結果は II と III の中間ですか? 字幕用のタイムスタンプと、diarization とも呼ばれる話者検出の両方が必要ですか? 最終結果を VTT または SRT 形式にしたいですか? それとも PDF、TXT、または DOCX ファイルとしても保存したいですか?
その場合は、Result フィールドで Timecodes を選択し、その後 Detect speakers オプションを有効にしてください。録音を開始する前、またはファイルをアップロードする前に、チェックボックスが選択されていることを確認してください。
Detect speakers オプションは Premium プランのユーザーのみ利用可能です。

どのような結果が必要でも、いつでも PDF、TXT、または DOCX ファイルとしてダウンロードできますし、エディターからそのままコピーして任意の場所に貼り付けることもできます。また、AI 品質の翻訳で文字起こしを多くの言語に翻訳することもできます。さらに、AI チャットに Google Meet セッションの要約を依頼したり、用語や引用を抽出したり、特定の名前が出てくるすべての箇所を見つけたりすることもできます。
また、Share ボタンを使って、文字起こしや翻訳を誰とでも直接共有できます。ただし、VTT と SRT のダウンロードは、Result フィールドで Timecodes を選択した場合にのみ利用できます。
Live Recording Transcription 中は、画面の向こう側の人たちの音声だけをシステム音声で録音してあとから文字起こしすることも、自分のマイクも含めて録音することもできます。両方の音声ソースを有効にすると、自動的に 1 つのトラックにミックスされます。マイク録音は Live Recording 中いつでもオン・オフできます。詳しくは こちら のガイドをご覧ください。
RiverScript は、別の参加者として通話に参加する旧式のサードパーティ製ボットや会議アシスタントとは異なり、完全なオールインワン AI ソフトウェアです。これらのツールの仕組みについては こちら で詳しく読めます。
RiverScript は、ホストだけでなく、どの参加者でも高品質な会議文字起こしを取得できるように設計されています。通話にどのアプリを使っているか、何を録音したいかは関係ありません。RiverScript はお客様のアカウントを操作したり、代理で会議に参加したり、ブラウザに何かをインストールしたりしません。RiverScript はお客様自身のコンピューターで実行し、いつオンにするかも自分で決められます。
RiverScript のエンジニアは、ElevenLabs、OpenAI、Deepgram の音声認識モデルを同期させるハイブリッド文字起こしアーキテクチャを構築しました。これにより、市場のほとんどのソリューションでは提供できないレベルの文字起こし精度を実現できます。生のテキストが延々と並ぶだけではなく、適切な文法と句読点、話者分離、そして 100 言語への ChatGPT 品質の翻訳を備えた高品質な文字起こしを得られます。
RiverScript はまた、いわゆる「service quality improvements」― つまり AI モデルの学習 ― のためにお客様の文字起こしを使用することもありません。文字起こしは Hetzner Cloud の Helsinki, Finland にあるデータセンターに保存され、アクセスできるのはユーザー本人のみで、いつでも削除できます。音声ファイルは 7 日後に自動削除されます。RiverScript Desktop client を使用する場合、録音した音声ファイルやアップロードした音声ファイルはお使いのコンピューターにも保存されます。
すでにボットやブラウザ拡張機能として動作する transcript generator を使っているなら、その Privacy Policy を確認してみてください。その会社が AI 学習のためにお客様のコンテンツを使用する権利を留保していることが判明する可能性は高いです。無制限の無料文字起こしをうたうボットやアシスタントでは、状況はさらに悪くなります。そうしたサービスの代償として、実際にはお客様の文字起こしや音声を差し出している可能性が高いでしょう。なぜなら、無制限の無料文字起こしなど存在しないからです。RiverScript はお客様のデータを搾取せず、サービス提供以外の目的で使用することもありません。
RiverScript Desktop client をインストール。ゲストとして会議を文字起こし。
