Modelos de IA no dispositivo para iOS e macOS
Pacotes Swift prontos a usar que correm modelos pequenos e especializados no dispositivo, em iOS e macOS, com poucas linhas de código sobre o Core ML.
Todos os modelos disponíveis da Desert Ant Labs são distribuídos como pacotes Swift construídos sobre o Core ML, com async/await de ponta a ponta e uma API que parece parte do AVFoundation.
Adicione o pacote no Xcode e chame o modelo. Tudo corre no dispositivo, então áudio, imagens e texto nunca saem dele.
Modelos disponíveis
Ocultação reversível de PII em 27 línguas, a partir de um modelo Core ML de 12 MB embutido no app.
Sugestões de emoji a partir de texto em menos de 2 ms, pequeno o bastante para correr a cada tecla.
Temas de conteúdo a partir de qualquer texto, em 101 línguas, de um modelo Core ML de 74 MB, ou uma build de 15 MB só em inglês.
Encaixe em formas no PencilKit com uma única chamada, a partir de um modelo Core ML de 0,2 MB, sem transferências.
Melhoria de fala DeepFilterNet 3 no Core ML: 302x o tempo real num iPhone 16 Pro, um clipe de 5 minutos em 1 s.
Deteção de bordões de alta resolução temporal diretamente na forma de onda, sem transcrição.
Identificação de língua para texto curto, entre 84 línguas, de um modelo de 2 MB incluído na app.
Marcações de palavra mais justas para qualquer transcrição, metade do erro, a partir de um modelo Core ML de 0,7 MB. Apple Speech primeiro.
Shorts e destaques a partir de uma transcrição, classificados, um vídeo de 25 minutos em 9 s no Core ML.
Identificação de língua falada em 99 línguas a partir de 30 segundos de áudio, no Core ML.
Um título e uma descrição de uma ou duas frases para qualquer trecho, no Apple silicon via MLX.
Fala em texto com marcações por palavra, 25 línguas, inteiramente no Neural Engine: 10 minutos de áudio em 2 s num iPhone.
Disponíveis em breve
Sinalize nudez antes do carregamento ou da exibição.
Extraia JSON tipado de qualquer texto.
Marque e classifique imagens.
Marque quem disse o quê em áudio e vídeo.
Encontre pessoas em fotos, de forma privada no dispositivo.
Preços
Cada modelo é gratuito para até 100 mil dispositivos ativos mensais por SDK. Inferência ilimitada por utilizador.