On-device AI-modellen voor iOS en macOS
Drop-in Swift-packages die kleine, gespecialiseerde modellen op het apparaat draaien, op iOS en macOS, met een paar regels code op Core ML.
Elk beschikbaar model van Desert Ant Labs wordt geleverd als een Swift-package op basis van Core ML, overal met async/await en met een API die leest als een onderdeel van AVFoundation.
Voeg de package toe in Xcode en roep het model aan. Alles draait op het apparaat, dus audio, beelden en tekst verlaten het apparaat nooit.
Beschikbare modellen
Omkeerbare PII-redactie in 27 talen, uit een Core ML-model van 12 MB dat in de app wordt meegeleverd.
Emoji-suggesties uit tekst in minder dan 2 ms, klein genoeg om bij elke toetsaanslag te draaien.
Content-onderwerpen uit elke tekst in 101 talen, uit een Core ML-model van 74 MB, of een build van 15 MB voor alleen Engels.
PencilKit snap-to-shape in één aanroep, uit een Core ML-model van 0,2 MB, geen download.
DeepFilterNet 3-spraakverbetering op Core ML: 302x realtime op een iPhone 16 Pro, een clip van 5 minuten in 1s.
Frame-precieze detectie van vulwoorden rechtstreeks uit de golfvorm, geen transcript.
Taalherkenning voor korte tekst, in 84 talen, uit een model van 2 MB dat in de app is gebundeld.
Strakkere woordtimings voor elk transcript, de helft van de fout, uit een Core ML-model van 0,7 MB. Apple Speech eerst.
Shorts en highlights uit een transcript, gerangschikt, een video van 25 minuten in 9s op Core ML.
Herkenning van gesproken taal in 99 talen uit 30 seconden audio, op Core ML.
Een titel en een beschrijving van een of twee zinnen bij elke passage, op Apple silicon via MLX.
Spraak naar tekst met woordtijdstempels, 25 talen, volledig op de Neural Engine: 10 minuten audio in 2s op een iPhone.
Binnenkort beschikbaar
Markeer naakt vóór uploaden of tonen.
Haal getypeerde JSON uit elke tekst.
Tag en rangschik afbeeldingen.
Label wie wat zei in audio en video.
Vind mensen in foto's, privé op het apparaat.
Prijzen
Elk model is gratis voor maximaal 100k maandelijks actieve apparaten per SDK. Onbeperkte inference per gebruiker.