Schemer.
Extração de dados tipados no dispositivo: de qualquer texto, conforme o seu esquema, com um campo vazio quando o texto nada diz.
Demonstração
Extraia JSON tipado de qualquer texto.
Escreva «Almoço com a Priya quinta que vem à 1» e o evento vem tipado: a data resolvida pelo relógio do dispositivo, a duração como número, o título como string. Sem etapa de parsing, sem validação de schema, sem loop de retry.
Nada é inventado também. O Schemer deixa um campo ausente vazio em 91% das vezes; LLMs guiados por prompt ficam entre 18% e 43%. As strings extraídas são substrings literais da entrada, com deslocamentos de caractere, então auditar é uma verificação de substring. O Schemer trabalha a partir de JSON Schema puro, o formato que OpenAI e Gemini aceitam, em qualquer um de 13 línguas.
0,800 em esquemas que nunca viu.
O Schemer obtém 0,800 em schemas que nunca viu, com 211M de parâmetros e 111 MB. Os únicos modelos que pontuam mais alto são 40 vezes o tamanho dele, ou mais.
Avaliação interna em 9 021 registos reservados; os concorrentes correm no mesmo conjunto reservado.
De linguagem natural a entrada de calendário
Transforme «Almoço com a Priya na próxima quinta às 13h, cerca de uma hora» num evento tipado: título, data e hora de início, duração e recorrência. É executado num teclado ou numa app de notas, no dispositivo e offline.
Mensagens em registos estruturados
Transforme uma mensagem de chat, um e-mail ou uma nota digitalizada num lead de CRM, um pedido ou uma fatura. Nomes, e-mails, valores e datas chegam descodificados para o seu tipo real, um campo ausente chega como null, e o registo fica pronto para guardar sem uma etapa de parsing.
Agentes e preenchimento de formulários no dispositivo
Dê a um agente local um JSON Schema e texto livre, e o JSON tipado resultante dispara uma ação ou preenche um formulário. Sem LLM na nuvem, sem custo por chamada.
O que o modelo faz
- Trabalha a partir de JSON Schema puro, o mesmo que OpenAI e Gemini aceitam, e escreve JSON tipado que o segue.
- Descodifica strings, números, booleanos, datas e horas, rótulos e arrays para os seus tipos reais.
- Deteção explícita de ausência: comunica um campo como em falta em vez de inventar um valor.
- Funciona em 13 línguas a partir de um único modelo, sem configuração por língua.
Especificações
- Modelo
- 211M (encoder mmBERT-base podado)
- Exatidão
- 0,800 (int8), 0,911 na deteção de ausência
- Tamanho no dispositivo
- 111 MB (int4 AWQ), 218 MB (int8)
- Formatos
- Core ML e ONNX, multiplataforma
O Schemer copia o que o texto diz; o Schemer não escreve. Peça um título abstrativo ou um juízo que exija conhecimento do mundo e um modelo muito maior vai ganhar-lhe.
O Schemer também não é um extrator de entidades: preenche os campos que declarou e não enumera todos os nomes do parágrafo. Os schemas aninhados são resolvidos pela camada em volta do modelo, não pelo modelo, e a qualidade aí foi medida em templates internos e não em prosa desorganizada do mundo real.
FAQ
O que é o Schemer?
Extração de dados tipados no dispositivo: de qualquer texto, conforme o seu esquema, com um campo vazio quando o texto nada diz.
O Schemer é executado no dispositivo?
Sim. O Schemer é executado no dispositivo, sem qualquer chamada a servidores, por isso os dados ficam com o utilizador.
O Schemer já está disponível?
O Schemer está em beta fechada. Peça acesso antecipado nesta página.
Quanto custa o Schemer?
Cada modelo é gratuito para até 100 mil dispositivos ativos mensais por SDK. Inferência ilimitada por utilizador. Contacte-nos para licenças personalizadas.
Qual é a precisão ou a rapidez do Schemer?
O Schemer obtém 0,800 em schemas que nunca viu, com 211M de parâmetros e 111 MB. Os únicos modelos que pontuam mais alto são 40 vezes o tamanho dele, ou mais.
Acesso antecipado
Diga-nos o que está a construir e ajudamo-lo a começar.