Schemer.
Extractie op het apparaat die getypeerde velden uit elke tekst haalt volgens je eigen schema, en een veld leeg laat waar de tekst niets zegt.
Demo
Haal getypeerde JSON uit elke tekst.
Schrijf “Lunch met Priya volgende week donderdag om 1 uur” en het event is getypeerd: de datum omgerekend naar de klok van het apparaat, de duur een getal, de titel een string. Geen parse-stap, geen schemavalidatie, geen retry-lus.
Er wordt ook niets verzonnen. Schemer laat een ontbrekend veld in 91% van de gevallen leeg; geprompte LLM's halen 18 tot 43%. Geëxtraheerde strings zijn letterlijke substrings van de invoer met tekenposities, dus controleren is een substring-check. Schemer werkt vanuit gewoon JSON Schema, de vorm die OpenAI en Gemini accepteren, in elk van 13 talen.
0,800 op schema's die het nooit heeft gezien.
Schemer scoort 0,800 op schema's die het nooit heeft gezien, met 211M parameters en 111 MB. De enige modellen die hoger scoren, zijn 40 keer zo groot of groter.
Interne evaluatie op 9.021 apart gehouden records; concurrenten draaien op dezelfde apart gehouden set.
Natuurlijke taal naar agenda-item
Zet “Lunch met Priya volgende week donderdag om 1 uur, ongeveer een uur” om in een getypeerd event: titel, startdatum en -tijd, duur en herhaling. Draait in een toetsenbord- of notitie-app, op het apparaat en offline.
Berichten naar gestructureerde records
Zet een chatbericht, e-mail of gescande notitie om in een CRM-lead, order of factuur. Namen, e-mailadressen, bedragen en datums komen binnen gedecodeerd naar hun echte type, een ontbrekend veld komt binnen als null, en het record is klaar om op te slaan zonder parse-stap.
On-device agents en formulieren invullen
Geef een lokale agent een JSON Schema en vrije tekst, en de getypeerde JSON die het terugkrijgt start een actie of vult een formulier vooraf in. Geen LLM in de cloud, geen kosten per aanroep.
Wat het model doet
- Werkt vanuit gewoon JSON Schema, dat wat OpenAI en Gemini accepteren, en schrijft getypeerde JSON die daarbij past.
- Decodeert strings, getallen, booleans, datetimes, labels en arrays naar hun echte types.
- Expliciete afwezigheidsdetectie: meldt een veld als ontbrekend in plaats van een waarde te verzinnen.
- Werkt in 13 talen vanuit één model, zonder configuratie per taal.
Specs
- Model
- 211M (gesnoeide mmBERT-base-encoder)
- Nauwkeurigheid
- 0,800 (int8), 0,911 afwezigheidsdetectie
- Grootte op het apparaat
- 111 MB (int4 AWQ), 218 MB (int8)
- Formaten
- Core ML en ONNX, cross-platform
Schemer neemt over wat de tekst zegt; Schemer schrijft niet. Vraag om een zelf geformuleerde titel of een oordeel waarvoor wereldkennis nodig is, en een veel groter model wint.
Schemer is ook geen entity extractor: het vult de velden die je hebt gedeclareerd en somt niet elke naam in de alinea op. Geneste schema's worden afgehandeld door de code om het model heen en niet door het model zelf, en de kwaliteit daarvan is gemeten op interne templates, niet op rommelige tekst uit de praktijk.
FAQ
Wat is Schemer?
Extractie op het apparaat die getypeerde velden uit elke tekst haalt volgens je eigen schema, en een veld leeg laat waar de tekst niets zegt.
Draait Schemer op het apparaat?
Ja. Schemer draait op het apparaat, zonder serveraanroep, dus de data blijft bij de gebruiker.
Is Schemer al beschikbaar?
Schemer is in besloten bèta. Vraag op deze pagina early access aan.
Hoeveel kost Schemer?
Elk model is gratis voor maximaal 100k maandelijks actieve apparaten per SDK. Onbeperkte inference per gebruiker. Neem contact op voor aangepaste licenties.
Hoe nauwkeurig of snel is Schemer?
Schemer scoort 0,800 op schema's die het nooit heeft gezien, met 211M parameters en 111 MB. De enige modellen die hoger scoren, zijn 40 keer zo groot of groter.
Early access
Vertel ons wat je bouwt, dan zetten we je op weg.