Modèles d'IA sur l'appareil pour iOS et macOS
Des packages Swift prêts à l'emploi qui exécutent des modèles petits et spécialisés sur l'appareil, sur iOS et macOS, en quelques lignes de code sur Core ML.
Chaque modèle Desert Ant Labs disponible est livré sous forme de package Swift bâti sur Core ML, avec async/await de bout en bout et une API qu'on croirait tirée d'AVFoundation.
Ajoutez le package dans Xcode et appelez le modèle. Tout s'exécute sur l'appareil : l'audio, les images et le texte ne le quittent jamais.
Modèles disponibles
Masquage réversible des données personnelles en 27 langues, depuis un modèle Core ML de 12 MB embarqué dans l'app.
Suggestions d'emoji à partir du texte en moins de 2 ms, assez petit pour tourner à chaque frappe.
Thèmes de contenu à partir de n'importe quel texte en 101 langues, depuis un modèle Core ML de 74 MB, ou une version anglais seul de 15 MB.
Alignement des formes PencilKit en un seul appel, depuis un modèle Core ML de 0,2 MB, sans téléchargement.
Amélioration de la voix DeepFilterNet 3 sur Core ML : 302x en temps réel sur un iPhone 16 Pro, un clip de 5 minutes en 1 s.
Détection des mots de remplissage précise à la trame, directement depuis la forme d'onde, sans transcription.
Identification de langue pour texte court, parmi 84 langues, depuis un modèle de 2 MB intégré à l'app.
Horodatages de mots plus serrés pour toute transcription, deux fois plus précis, depuis un modèle Core ML de 0,7 MB. Apple Speech d'abord.
Shorts et temps forts à partir d'une transcription, classés, une vidéo de 25 minutes en 9 s sur Core ML.
Identification de la langue parlée parmi 99 langues à partir de 30 secondes d'audio, sur Core ML.
Un titre et une description d'une ou deux phrases pour tout passage, sur Apple silicon via MLX.
Reconnaissance vocale avec horodatages de mots, 25 langues, entièrement sur le Neural Engine : 10 minutes d'audio en 2 s sur un iPhone.
Bientôt disponibles
Signalez la nudité avant l'envoi ou l'affichage.
Extrayez du JSON typé de n'importe quel texte.
Taguez et classez les images.
Étiquetez qui a dit quoi dans l'audio et la vidéo.
Retrouvez les personnes sur les photos, en privé sur l'appareil.
Tarifs
Chaque modèle est gratuit jusqu'à 100k appareils actifs mensuels par SDK. Inférence illimitée par utilisateur.