Transcriptinatorは音声を録音またはインポートし、文字起こしを行い、話者を特定し、オプションで発言内容を実用的なメモに変換するお手伝いをします。機密情報はすべてデバイス内に保存されます。
最初から最後までデバイス内で完結。音声データはスマートフォンから外部に送信されることはありません。文字起こしはオープンソースのWhisperモデルを使用してローカルで実行されます。話者識別にはpyannoteダイアライゼーションと3D-Speaker埋め込みモデルを使用します。
これらもローカルで実行されます。Transcriptinatorは機内モードでも使用できます。ネットワーク接続が必要なのは、モデルの初回ダウンロードのみです。
単なる音ではなく、声を学習します。「同僚のダナです」のように一度話者の名前を登録すれば、Transcriptinatorは今後ダナが話すすべての録音で自動的にその人物を特定します。音声プロファイルはデバイス内にのみ保存され、アップロードされることはありません。
品質レベルを選択してください。 3つの文字起こしレベルをご用意しています:高速(Whisperベース、約200MB)、バランス(Whisperスモール、約600MB)、高精度(Whisperミディアム、約1.5GB)。グローバル設定を行うことも、
ワンタップで個々の録音を異なるレベルで再文字起こしすることも可能です。
独自のルールを作成できます。話し言葉を構造化された抽出カードに変換し、後で活用できます。「猫を撫でて」と言えばToDoリストが作成され、「火曜日の3時に会いましょう」と言えばカレンダーイベントが作成されます。
マッチングモードは2種類あります:
- オフライン(文字通りのフレーズ)— 決定論的で、APIキーは不要、デバイス上で完全に動作します。
- AI(意味記述)— LLMを設定すると、平易な英語の説明で言い換えを自動的に検出します。
AIはオプションです。独自のキーをご用意ください。文書分類、要約、ToDo、カレンダーイベント、リマインダー、決定事項、質問、メモのスマート抽出には、以下の3つのプロバイダーのいずれかを接続してください。
- Anthropic (Claude)
- OpenAI (ChatGPT)
- Google (Gemini)
APIキーはお客様ご自身でご用意ください。キーはデバイスに安全に保存され、当社のサーバーやバックアップには一切保存されません。同意はオプトイン方式で、いつでも撤回可能です。プロバイダーに送信されるのはテキストの文字起こしデータのみです。
音声データや話者埋め込みデータは一切送信されません。月間使用量合計と録音ごとのトークン数はアプリ内に表示されるため、常に利用状況を把握できます。
抽出されたデータには必ず出典が明記されます。ToDo、カレンダーイベント、リマインダーのカードをタップすると、音声の該当箇所にジャンプできます。抽出されたデータには発言内容がそのまま含まれ、
元の音声セグメントへのリンクも表示されるため、操作を行う前に確認できます。
Transcriptinatorの得意なこと
- 2~6人の発言者による会議の議事録作成
- 長時間のインタビュー、講義、説教
- 録音だけでなく、文字起こしが必要なボイスメモ
- フィールドレコーダーからのインポート(WAV、IMA ADPCM、MP3、M4A、OGG、FLAC形式)
- カスタムルールによるワークフローの構築
できないこと
- 通話中のリアルタイム字幕表示 ― すべて録音後に処理されます
- セキュリティのための話者認証 ― 音声照合はラベル付けの利便性を高めるためのものであり、認証ではありません
- クラウド同期 ― 意図的に行っています。録音データはスマートフォンに保存されます
無料、広告なし、追加料金なし。Transcriptinatorは無料で、今後も無料です。広告なし、アプリ内課金なし、プレミアムプランなし。AI機能は完全にオプションです。アプリは外部サービスなしで完全に動作します。
発行元:Cherry Blossom Development, LLC
あらゆる録音機器からの音声を文字起こしし、話者を特定し、分類します。