Desert Ant Labs

Modelli di AI on-device per iOS e macOS

Pacchetti Swift pronti all'uso che eseguono modelli piccoli e specializzati sul dispositivo, su iOS e macOS, in poche righe di codice su Core ML.

Ogni modello Desert Ant Labs disponibile è distribuito come pacchetto Swift costruito su Core ML, con async/await ovunque e un'API che sembra uscita da AVFoundation.

Aggiungi il pacchetto in Xcode e richiama il modello. Tutto gira sul dispositivo, così audio, immagini e testo non lo lasciano mai.

Modelli disponibili

RedactMascheramento di PII

Mascheramento reversibile di PII in 27 lingue, da un modello Core ML da 12 MB incluso nell'app.

EmoSuggerimenti di emoji

Suggerimenti di emoji dal testo in meno di 2 ms, abbastanza piccolo da girare a ogni battitura.

GistEtichettatura tematica dei contenuti

Temi dei contenuti da qualsiasi testo, in 101 lingue, da un modello Core ML da 74 MB, o una build da 15 MB solo inglese.

ShapesRiconoscimento di forme

Aggancio alle forme in PencilKit con una sola chiamata, da un modello Core ML da 0,2 MB, senza download.

ClearMiglioramento del parlato

Miglioramento del parlato con DeepFilterNet 3 su Core ML: 302x rispetto al tempo reale su un iPhone 16 Pro, una clip di 5 minuti in 1 s.

UhmRilevamento delle parole riempitive

Rilevamento delle parole riempitive preciso al frame direttamente dalla forma d'onda, senza trascrizione.

TongueIdentificazione della lingua

Identificazione della lingua per testo breve, tra 84 lingue, da un modello di 2 MB incluso nell'app.

AlignTimestamp per parola

Tempi delle parole più precisi per qualsiasi trascrizione, metà dell'errore, da un modello Core ML da 0,7 MB. Prima su Apple Speech.

ClipsSelezione delle clip

Short e momenti salienti da una trascrizione, ordinati, un video di 25 minuti in 9 s su Core ML.

EarRiconoscimento della lingua parlata

Identificazione della lingua parlata tra 99 lingue da 30 secondi di audio, su Core ML.

TitleTitoli e descrizioni

Un titolo e una descrizione di una o due frasi per qualsiasi testo, su Apple silicon tramite MLX.

VozRiconoscimento vocale

Da voce a testo con timestamp per parola, 25 lingue, interamente sul Neural Engine: 10 minuti di audio in 2 s su un iPhone.

Presto disponibili

Prezzi

Ogni modello è gratuito fino a 100k dispositivi attivi mensili per SDK. Inferenza illimitata per utente.