オンデバイスのオーディオモデル
音声のための小さなオンデバイスモデル。スタジオ音質、フィラー除去、言語の特定、話者の判別。何もアップロードしません。
どのオーディオモデルも、スマートフォンにすでに載っているチップ上で動くので、5 分の録音が数秒で終わり、音声がデバイスの外に出ることはありません。分単位の課金も、アップロードも、順番待ちもありません。
利用可能なモデル
Clear音声強調
オンデバイスの音声強調。録音に、ポッドキャストスタジオのような温かく近接収音した音を。処理はすべて端末上で。
Uhmフィラー検出
オンデバイスのフィラー検出。すべての um、uh、hmm を 20 ms 以内で印付け。1 時間の音声を 12 秒で。
Align単語タイムスタンプ
オンデバイスの単語タイムスタンプ。どの文字起こしにも対応し、カット・字幕・ハイライトを単語単位で。誤差は半分、0.7MB。
Clipsクリップ選択
オンデバイスのクリップ選択。文字起こしから、長い録画をランク付けされたショートとハイライトに。iPhone や Mac で。
Ear話し言葉の言語検出
オンデバイスの話し言葉の言語識別。99 言語に対応し、短い音声から、文字起こしを始める前に言語を特定します。
Voz音声認識
オンデバイスの音声認識。iPhone で 10 分の音声を 2 秒で文字起こし。Whisper の 4.7 倍速く、正確な単語タイムスタンプ付き。
まもなく提供
料金
すべてのモデルは、SDK ごとに月間アクティブデバイス 100k 台まで無料です。各ユーザーがモデルを実行する回数に制限はありません。