すべてのプロダクトに、小脳を。
Desert Ant Labs はオンデバイス AI ラボです。あなたのタスクに最速のモデルを、人々がすでに持つ何十億台ものデバイス上で動くように作ります。超高速で、プライベートで、呼び出しごとの費用はありません。すべてのプロダクトに、小脳を。
アプリのための知能レイヤー
小脳は文字どおり「小さな脳」で、首の近くにあり、脳幹とつながっています。大きさは脳全体の 10 分の 1 ほどですが、ニューロンの 5 分の 4 がそこにあります。小脳が担うのは、素早い動作と制御の働きです。バランス、タイミング、協調運動、そして一度覚えたら意識しなくなる技能。そこでは何も推論しません。その価値は速さと確実さにあり、脳の残りの部分は考えることに専念できます。
ソフトウェアも、同じレイヤーがあれば良くなります。大きな推論モデルはクラウドで動き、絶え間ない作業もそこで動かせます。音声を整える、写真を読む、メッセージからデータを取り出す、といった作業です。私たちはまず、高速で特化したローカルモデルから始めます。一つの仕事のために作られたそれらは、価格、速度、性能でクラウドの推論に引けを取りません。クラウドと組み合わせれば、既定でプライベートかつ無償で動く、より良いプロダクトを作れます。仕事ごとに適したモデルを使い、必要なときにクラウドへ回す。私たちが作るのは、そのレイヤーです。
データセンターより、人々のポケットの中のほうが計算資源は多い
世界では、高性能なスマートフォン、タブレット、ノート PC が年に 10 億台以上出荷され、その多くにはまさにこの種の処理のために作られたチップが載っています。すでに支払い済みで、1 日の大半は遊んでいます。そこでモデルを動かせば、経済性は逆転します。呼び出しごとの費用も、往復通信もなく、データがデバイスの外に出ることもありません。
私たちが作るもの
最大のモデルではなく、その仕事に最速のモデルを。それぞれが一つのタスクと速さに合わせて調整され、呼び出しごとの費用がかからない、多数の小さなモデルです。どれにも Swift、Kotlin、JavaScript 向けのネイティブ SDK が付き、面倒な処理を引き受けるので、モデルは数行のコードでプロダクトに組み込めます。独自のものをより速く作れて、かつては丸ごと買っていたプロダクトが、一つの部品になります。
- タスクに特化
- タスクに特化したモデルを、スマートフォンとデスクトップの計算資源に合わせて最適化しています。
- 圧倒的に高速
- あらゆる操作、あらゆるキー入力、あらゆるフレームに間に合う速さで、呼び出しごとの費用はありません。
- クリーンなデータ
- ライセンス済みおよび公開されているデータで学習しているため、どのモデルも法的リスクを負うことなく商用利用できます。
私たちはプロダクトから始める
私たちはプロダクトを起点にし、エンドユーザー体験が最良になるようモデルを設計します。モデルとは、千ものプロダクト上の判断です。何から学ぶか、入力と出力の形はどうするか、どこで精度を速度と引き換えにするか。人が触れるあらゆるものを設計するときと同じやり方で、その判断を下します。消費者向けアプリを何年も世に出してきた経験からです。
これからの 10 年で、より多くのインターフェースがより多くの人の手で作られ、モデルはプロダクトの裏に隠れた一要素ではなくなります。プロダクトの感覚を備え、すぐに組み込めるモデルこそ、それらのプロダクトが動く土台になります。
公開されていて、無料で始められる
すべてのモデルとそのベンチマークは Hugging Face で、SDK は GitHub で公開されています。SDK ごとに月間アクティブデバイス 100k 台まで無料です。これらで何かを作っている方、あるいは一緒に作りたい方は、ご連絡ください。