Desert Ant Labs

Clear.

Melhoria de vozDisponível

Melhoria de voz no dispositivo que dá à sua gravação o som quente e captado de perto de um estúdio de podcast, processado 100% no dispositivo.

Demonstração

Som de estúdio, sem a fatura da nuvem.

O Adobe Podcast, o Dolby e o Auphonic cobram por minuto e exigem que o áudio ou o vídeo seja enviado aos servidores deles. O Clear processa um clipe de 5 minutos em 1 s num iPhone 16 Pro, no próprio dispositivo.

Grave com o microfone de um portátil ou de um telemóvel, numa sala sem tratamento e com trânsito lá fora, e o resultado soa captado de perto: médios-graves quentes, a voz à frente, sem ruído de fundo. Com presets de saída para o volume do Spotify, do Apple Podcasts e do YouTube.

O Clear está disponível em duas variantes: clear-studio e clear-natural. A Studio, predefinida, limpa até quase o silêncio. A Natural mantém o som da sala, a respiração e a textura dos lábios, para salas tratadas e locução proposital.

5 minutos de áudio em 1 s.

302x o tempo real num iPhone 16 Pro e 345x num MacBook Pro M5: aprimorar, masterizar e recodificar um clipe de 60 segundos, melhor de três, no dispositivo.

302x
Tempo real
iPhone 16 Pro, do aprimoramento à recodificação
9,0 MB
Modelo Core ML
cálculo em fp16 com paleta de pesos de 6 bits
48 kHz
Saída

clear-studio, aprimorar, masterizar e recodificar num clipe de 60 segundos, melhor de três

DispositivoFator de tempo real
iPhone 16 Pro302x
MacBook Pro (M5)345x

Medições internas na build Core ML distribuída: um clipe mono de 5 minutos a passar por aprimoramento, masterização e recodificação, iOS 27.0. O model card relata 302x num iPhone 16 Pro e 345x num MacBook Pro (M5) para um clipe de 60 segundos, melhor de três. A velocidade no Android e no navegador ainda não foi medida, e não publicamos uma nota de qualidade de áudio comparada às ferramentas em nuvem.

Masterização de podcast e vídeo.

Elimine a sala, não só o chiado

A maioria dos redutores de ruído para no chiado. O Clear tira também as reflexões, então um podcast, vídeo ou reunião gravado em casa ou numa sala de conferência soa captado de perto, e não encaixotado.

Sem carregamento, sem fatura por minuto

Limpeza de estúdio como funcionalidade não tem cobrança por uso para os utilizadores. A melhoria corre no dispositivo, então não há uma conta de áudio em nuvem que cresce a cada minuto de áudio processado.

Salve uma gravação feita numa sala péssima

Limpe notas de voz e chamadas gravadas antes de seguirem para transcrição ou para um arquivo, para que uma chamada feita na cozinha continue a ser transcrita sem problemas.

Conserte uma gravação de uma hora no telemóvel

O caminho de ficheiro processa em fluxo, pedaço por pedaço, ao escrever no disco, então uma gravação de uma hora usa a mesma memória que um clipe de dez segundos. O ficheiro aprimorado aparece ao lado do original.

Inspiração

Ideias para construir com o Clear. Copie um prompt para o seu agente de código e comece.

Clear

Add a one-tap 'clean audio' button that removes noise and room echo.

Clear

Master a podcast episode to platform loudness, on the device.

Clear

Rescue a recording made in a noisy, untreated room.

Clear

Clean the audio on a phone video in one pass.

ClearVozClips

Record, clean, transcribe, and clip: a whole creator pipeline, offline.

ClearVoz

Build a voice-notes app that cleans the audio and transcribes it offline.

ClearVozUhm

A clean, filler-free transcript from a raw, noisy recording.

Clear

A Shortcut that cleans up any audio file's sound.

Ver todas as 10 ideias

O que o modelo faz

  • Treinado para um som de podcast rico, presente e captado de perto: médios-graves à frente, sem voz fina ou distante.
  • Redução de ruído e de reverberação a partir de um modelo DeepFilterNet 3 afinado. Um quarto sem tratamento ou um quarto de hotel sai mais perto de um estúdio tratado, sem reverberação acrescentada de volta.
  • Seguro na sibilância e sem artefatos: nada de picos ásperos em S, T e F, nem bombeamento ou ruído musical. Respirações e plosivas ficam intactas.
  • Predefinições de volume: Apple Podcasts, Spotify, YouTube, EBU R128 (normalização LUFS / EBU R128). A saída é de 48 kHz.
  • Decodifica qualquer ficheiro de áudio que o AVFoundation consiga ler, e a extensão de saída escolhe a codificação: .wav para PCM de 16 bits, .m4a, .mp4 ou .aac para AAC, .caf ou .aiff para PCM. Sem um sistema de ficheiros, enhance(bytes:) retorna bytes WAV.
  • Duas variantes: clear-studio para uma limpeza silenciosa de estúdio, clear-natural para preservar o som da sala. Os pesos são transferidos do Hub no primeiro uso e guardados em cache. Controlos Strength e Mastering nas duas, para ajustar ao gosto.

Primeiros passos

Adicione melhoria de voz ao seu app iOS or macOS, Android or web em poucas linhas de código. Docs do Clear.

iOS, macOS
Instalação
// Swift Package Manager
.package(url: "https://github.com/Desert-Ant-Labs/desert-ant-core", from: "3.1.0")
// target dependency
.product(name: "Clear", package: "desert-ant-core")
Exemplo - Swift
import Clear

let clear = Clear()
let result = try await clear.enhance(path: "in.wav", to: "out.wav")
print(result.realtimeFactor, result.measuredLUFS ?? 0)
Crie com um prompt
Add Clear from Desert Ant Labs to this Swift project (iOS, macOS).

What it does: som de estúdio no dispositivo para gravações de voz.

SDK:

Swift (iOS, macOS)
Repo: https://github.com/Desert-Ant-Labs/desert-ant-core#readme
// Swift Package Manager
.package(url: "https://github.com/Desert-Ant-Labs/desert-ant-core", from: "3.1.0")
// target dependency
.product(name: "Clear", package: "desert-ant-core")

Reference:
- Model page: https://desertant.com/models/clear/
- Full catalog and other models: https://desertant.com/llms.txt

Add the SDK, then follow its README for the exact API and current version. Do not invent API names or method signatures; confirm them against the README.
Android
Instalação
// build.gradle.kts (Maven Central)
implementation("ai.desertant:clear:3.1.0")
Exemplo - Kotlin
import ai.desertant.clear.Clear

Clear(context).use { clear ->
    val result = clear.enhance(samples, 48_000.0)   // 48kHz mono out
    result.measuredTruePeakDbfs
}
Crie com um prompt
Add Clear from Desert Ant Labs to this Kotlin project (Android).

What it does: som de estúdio no dispositivo para gravações de voz.

SDK:

Kotlin (Android)
Repo: https://github.com/Desert-Ant-Labs/desert-ant-core#readme
// build.gradle.kts (Maven Central)
implementation("ai.desertant:clear:3.1.0")

Reference:
- Model page: https://desertant.com/models/clear/
- Full catalog and other models: https://desertant.com/llms.txt

Add the SDK, then follow its README for the exact API and current version. Do not invent API names or method signatures; confirm them against the README.
Web, Node.js
Instalação
npm i @desert-ant-labs/clear @litertjs/core   # browser
npm i @desert-ant-labs/clear                  # Node
Exemplo - TypeScript
import { Clear } from "@desert-ant-labs/clear";

const clear = await Clear.load();
const result = await clear.enhance(samples, 48_000);   // Float32Array in, 48kHz out
await clear.enhance(samples, 48_000, { targetLUFS: "spotify" });
Crie com um prompt
Add Clear from Desert Ant Labs to this JavaScript / TypeScript project (Web, Node.js).

What it does: som de estúdio no dispositivo para gravações de voz.

SDK:

JavaScript / TypeScript (Web, Node.js)
Repo: https://github.com/Desert-Ant-Labs/desert-ant-core#readme
npm i @desert-ant-labs/clear @litertjs/core   # browser
npm i @desert-ant-labs/clear                  # Node

Reference:
- Model page: https://desertant.com/models/clear/
- Full catalog and other models: https://desertant.com/llms.txt

Add the SDK, then follow its README for the exact API and current version. Do not invent API names or method signatures; confirm them against the README.

Especificações

Velocidade
302x o tempo real num iPhone 16 Pro
Modelo
DeepFilterNet 3 afinado
Tamanho no dispositivo
9,0 MB Core ML e 24 MB ONNX, por variante
Plataformas
iOS 18+, macOS 15+, tvOS 18+, visionOS 2+ (Core ML); Android 7+ (LiteRT); o navegador (WebAssembly e LiteRT.js); Node

O Clear foi feito para a voz. A música, os efeitos e outros sons que não sejam voz são puxados para baixo como ruído, por isso corra o Clear numa faixa de voz e não numa mistura final.

O Clear também não separa fontes: duas pessoas a falar por cima uma da outra continuam sobrepostas. O clear-studio limpa com força suficiente para retirar a respiração e o ambiente da sala, por isso escolha o clear-natural numa sala tratada.

FAQ

O que é o Clear?

Melhoria de voz no dispositivo que dá à sua gravação o som quente e captado de perto de um estúdio de podcast, processado 100% no dispositivo.

O Clear é executado no dispositivo?

Sim. O Clear é executado no dispositivo, sem qualquer chamada a servidores, por isso os dados ficam com o utilizador.

Que plataformas suporta o Clear?

O Clear é distribuído como um SDK nativo no dispositivo para Swift, Kotlin, JavaScript / TypeScript.

Quanto custa o Clear?

Cada modelo é gratuito para até 100 mil dispositivos ativos mensais por SDK. Inferência ilimitada por utilizador. Contacte-nos para licenças personalizadas.

Qual é a precisão ou a rapidez do Clear?

302x o tempo real num iPhone 16 Pro e 345x num MacBook Pro M5: aprimorar, masterizar e recodificar um clipe de 60 segundos, melhor de três, no dispositivo.

Recursos