Wat we bouwen
- Gefinetunede modellen: LoRA- en QLoRA-training op open-weight modellen voor jouw domein, met een evaluatieharnas dat elke kandidaat vergelijkt met het basismodel op jouw eigen benchmark.
- Retrieval-systemen: self-hosted RAG over je documenten, antwoorden met bronvermelding, toegangscontrole op documentniveau en een volledig auditlog. Niets verlaat je perimeter.
- Document intelligence: OCR- en extractiepipelines die facturen, contracten en douanedocumenten omzetten in gevalideerde, gestructureerde data, met menselijke controle waar de zekerheid laag is.
- Inferentie-optimalisatie: quantisatie, distillatie, caching en serving met vLLM, zodat het model dat je uitrolt ook betaalbaar draait.
- Gesuperviseerde agents voor backoffice-werk: state-machine-agents met goedkeuringsstappen, actielogs en replay. Automatiseringsgraden die je kunt meten, geen demo's.
Hoe we werken
Elke AI-opdracht begint bij de evaluatieset, niet bij het model. We definiëren met jouw team wat goede output is, bouwen de benchmark en trainen pas daarna. Verslaat fine-tuning het basismodel plus retrieval niet op jouw data, dan zeggen we dat, en houd jij de benchmark.
Optimalisatie is een afweging die we expliciet maken: snelheid tegenover kwaliteit tegenover geheugen. Je ziet de cijfers per configuratie voordat er iets live gaat.
Modellen draaien waar je data staat: jouw cloudaccount, jouw cluster of ons EU-hostingplatform. We sturen je data niet door externe API's, tenzij jij daar bewust voor kiest.
Compliance zit in de bouw
Voor systemen die de AI-verordening als hoog risico aanmerkt, leveren we de technische documentatie, logging en monitoringsbewijzen samen met het systeem op. Je juristen krijgen een papierspoor, geen belofte.