On-device audiomodellen
Kleine modellen voor spraak, op het apparaat: studiogeluid, vulwoorden weggeknipt, de taal benoemd, wie wat zei. Niets geüpload.
Elk audiomodel draait op de chip die al in de telefoon zit, dus een opname van vijf minuten is in seconden klaar en de audio verlaat het apparaat nooit. Geen rekening per minuut, geen upload, geen wachtrij.
Beschikbare modellen
Spraakverbetering op het apparaat die je opname de warme, dichtbije klank van een podcaststudio geeft, volledig op het apparaat.
Detectie van vulwoorden op het apparaat die elke eh, uhm en hmm tot op 20 ms markeert: een uur audio in 12s.
Woordtijdstempels op het apparaat, voor elke transcriber. Knip, ondertitel en markeer op het woord, met de helft van de fout, uit een model van 0,7 MB.
Een snel model voor clipselectie dat een lange opname omzet in gerangschikte shorts en highlights, uit een transcript. Op het apparaat, op iPhone of Mac.
Herkenning van gesproken taal op het apparaat, in 99 talen, uit een korte flard audio, voordat de transcriptie begint.
Transcribeer 10 minuten audio in 2s op een iPhone, 4,7x sneller dan Whisper, met precieze woordtijdstempels.
Binnenkort beschikbaar
Prijzen
Elk model is gratis voor maximaal 100k maandelijks actieve apparaten per SDK. Onbeperkte inference per gebruiker.