使い方

録音から、信頼できるテキストへ

短く言えば3つのステップです。こちらは詳しい説明です。各段階でファイルがどうなるか、お約束できること、できないこと。

3つのステップを詳しく

  1. 01

    ファイルをドロップ

    ページにドラッグするか、パソコンから選びます。アプリを経由せず、ストレージに直接アップロードされるので、2時間の録音でも途中で止まりません。

    • 進捗バーには、実際にお使いの端末から送られたバイト数が表示されます。推定ではありません。
    • タブを閉じても構いません。大切なのはアップロードで、それは自動で完了します。
    • ファイルがすべて届くまで、処理は始まりません。
  2. 02

    音声を聞き取ります

    音声の実際の長さを測定し、言語を検出し、誰が何を話したかを分けて、すべての単語にタイムスタンプを付けてテキストにします。

    • 話者は「話者A」「話者B」として表示されます。名前は一度付ければ、全体のテキストに反映されます。
    • タイムスタンプは段落ごとではなく単語ごとです。だからプレーヤーが読み上げに追従します。
    • 表示される進捗は、時計が回っているだけではなく、実際の作業から来ているため、きちんと進みます。
  3. 03

    修正して、持ち帰ります

    任意の行をクリックして修正します。元のテキストは下に残るので、修正しても失うものはなく、検索もお客様の修正版に更新されます。

    • タイトルだけでなく、テキストの中を検索できます。
    • DOCX、PDF、SRT、CSV、JSONに書き出せます。SRTはタイミングを保つので字幕づくりに使えます。
    • 録音が会議なら、要点とタスクをまとめた要約をご依頼いただけます。

内部のしくみ

見えないところで行っていること

使える文字起こしと、文字の壁との違いのほとんどを説明する、3つの判断です。

音声は私たちが測定します

請求される分数は、文字起こしプロバイダーに尋ねるのではなく、ファイルを読み取って求めています。両者が食い違ったときは、ファイルの実際の長さ分だけをお支払いいただきます。

元の結果をそのまま保存します

モデルが返した結果は、手を加える前の状態で保管しています。段落の組み立て方を改善したときは、二重に請求することなく、過去の文字起こしを作り直せます。

話者は専用の場所に保存されます

名前は行ごとに繰り返されず、1回だけ保存されます。だから変更は一瞬で、2つの行が誰が話したかについて食い違うことはありません。

形式と上限

お送りいただけるもの

音声

MP3、WAV、M4A、AAC、FLAC、OGG、OPUS

動画

MP4、MOV、WEBM、MKV、AVI

最大サイズ
1ファイルあたり10GB
最大の長さ
1録音あたり10時間
言語
90以上、自動検出
話者
同じ録音内で最大32人

動画も問題ありません。音声トラックだけを読み取るので、映像の分は課金されません。

精度

期待できること、正直に

クリーンなスペイン語や英語の音声では、単語単位で約98%です。背景ノイズ、話の重なり、強いアクセントがある場合、通常は92%から96%の範囲になります。

精度が上がること

  • 話している人の近くにマイクを置く。安価なものでも構いません。
  • 順番に話してもらう。重なりがいちばん精度を下げます。
  • 言語がわかっているなら、自動のままにせず指定する。

精度が下がること

  • 部屋の反対側からスマートフォンで録音する。
  • 会話の後ろで音楽やテレビが流れている。
  • 混雑する時間帯のカフェで4人が話している。

あなたの録音

音声が保存される場所

EU域内で

ファイルとテキストはEUのサーバーに保存され、文字起こし自体もEU域内で行われます。

自動で削除されます

プランごとに保存期間があります。期間が過ぎると、覚えておかなくても、音声とテキストは削除されます。

お客様のものです

録音を使って何かを学習することはありません。文字起こしを削除すると、音声も同じ日に一緒に削除されます。

実際の録音でお試しください

毎月120分まで無料。カードも、誰かとの打ち合わせも不要です。