アカウントなしでお試し

どんな音声もテキストにする

録音をドロップするだけで、タイムスタンプ・話者分離・要約付きの文字起こしが手に入ります。アカウント不要、インストールも不要です。

ここにファイルを置いてください

MP3、WAV、M4A、MP4、MOVなど · 最大10GB

  • 話し言葉から名前を拾って、話者を分けて表示
  • タイムスタンプをクリックすれば、その音声の位置へジャンプ
  • 要点・決定事項・タスクをまとめた要約
  • MP3
  • WAV
  • M4A
  • AAC
  • OGG
  • FLAC
  • WMA
  • AIFF

このツールでできること

1時間の音声を手で文字起こしすると、およそ4時間かかります。Audio Transcriptor なら約3分。しかも出てくるのは文字の壁ではなく、話者ごとに分かれ、タイムスタンプが付き、検索もブラウザー上での修正もできるテキストです。

MP3、WAV、M4A、AAC、OGG、FLACなど、録音したままの形式で、1ファイル10 GBまで対応します。言語は自動で判別するので、設定は必要ありません。

他にはない、細かな配慮

  • 90以上の言語を自動で判別します。言語を指定する必要はありません。
  • 録音中のあいさつから名前を読み取り、話者を分けて名前も付けます。
  • この文字起こしだけでなく、持っているすべての文字起こしを横断して検索できます。
  • ファイルはEU圏内のサーバーに保管され、ご指定のタイミングで削除されます。

使い方

  1. 1

    音声をドロップ

    パソコンから選ぶこともできます。10 GBまで、一度に何ファイルでも大丈夫です。

  2. 2

    文字起こしを実行

    録音時間のおよそ5%で完了します。1時間の会議なら3分ほどです。

  3. 3

    読む・直す・ダウンロード

    気になる箇所はクリックして修正し、DOCX、PDF、SRT、CSV、JSONでダウンロードできます。

こんな場面で使われています

インタビュー

質問と回答を声で分け、引用の確認用に時刻も残ります。

会議

要約に決定事項とタスクが並ぶので、議事録を書く手間がなくなります。

ポッドキャスト

文字起こしが、番組のメモにも、記事にも、字幕にもなります。

詳しく

文字起こしの出来を左右するもの

3つあり、どれもアクセントではありません。1つ目はマイクの距離です。テーブルの真ん中に置いたスマホは、話している人の前に置いた同じスマホよりも、はるかに多くの部屋の雑音を拾い、その雑音が存在しない言葉になります。2つ目は、人の声が重なるかどうかです。2人の声が同時に入ると、どんなシステムも、人間でさえも、両方は聞き取れません。

3つ目は、固有の語彙です。会社名、姓、業界の略語がいちばん間違いやすいのは、あなたの録音以外のどこにも出てこないものだからです。テキストの修正機能で2分あれば直せて、精度が本当に上がるのはそこです。サービスを変えても上がりません。

テキストでできること

まず検索です。もっともよく使われます。録音を聞き直さなくても、特定の話題が何分頃に出たかが分かります。話者が分かれていれば、誰が話しているかで絞り込むこともでき、1時間のインタビューなら作業が半分になります。

そしてここから書き出すこともできます。共有用のドキュメント、動画の下に付けるSRT、参加者ごとの発言時間を分析するスプレッドシート。いずれも文字起こしをやり直す必要はなく、必要なだけ、必要な形式で書き出せます。

質問

お手元にあるのが動画だったら?

アップロードするだけで、タイムスタンプ付きの文字起こし、名前付きで分けられた話者、要点をまとめた要約をお返しします。アカウントなしで始められます。