iOS・macOS 向けのオンデバイス AI モデル
小さな特化型モデルを iOS と macOS のデバイス上で動かす、そのまま組み込める Swift パッケージ。Core ML 上で数行のコードで動きます。
提供中の Desert Ant Labs のモデルはすべて、Core ML の上に作られた Swift パッケージとして提供されます。全体を通して async/await を使い、API は AVFoundation の一部のように読めます。
Xcode でパッケージを追加し、モデルを呼び出すだけ。すべてが端末上で動くので、音声、画像、テキストがデバイスの外に出ることはありません。
利用可能なモデル
アプリに同梱する 12MB の Core ML モデルによる、27 言語にわたる可逆的な PII マスキング。
テキストからの絵文字提案を 2 ms 未満で。キー入力のたびに動かせる小ささです。
101 言語のどんなテキストからもコンテンツのトピックを。74MB の Core ML モデル、または英語専用の 15MB ビルドで。
1 回の呼び出しで PencilKit の図形スナップを。0.2MB の Core ML モデルで、ダウンロード不要です。
Core ML 上の DeepFilterNet 3 による音声強調。iPhone 16 Pro で実時間の 302 倍、5 分のクリップを 1 秒で。
波形から直接、フレーム単位で正確なフィラー検出。文字起こしは不要です。
短いテキストの言語識別を 84 言語で。アプリに同梱する 2MB のモデルで。
どんな文字起こしにもより正確な単語タイミングを、誤差は半分。0.7MB の Core ML モデルで。まず Apple Speech に対応。
文字起こしから、ランク付けされたショートとハイライトを。Core ML で 25 分の動画を 9 秒で。
99 言語にわたる話し言葉の言語識別を、30 秒の音声から。Core ML 上で。
どんな文章にも、タイトルと 1〜2 文の説明を。MLX を通じて Apple silicon 上で。
単語タイムスタンプ付きの音声認識、25 言語。すべて Neural Engine 上で動き、iPhone で 10 分の音声を 2 秒で。
まもなく提供
料金
すべてのモデルは、SDK ごとに月間アクティブデバイス 100k 台まで無料です。各ユーザーがモデルを実行する回数に制限はありません。