Wat we bouwen
- Gefinetunede modellen: LoRA- en QLoRA-training op open-weight modellen voor jouw domein, met een evaluatieharnas dat elke kandidaat vergelijkt met het basismodel op jouw eigen benchmark.
- Retrieval-systemen: self-hosted RAG over je documenten, antwoorden met bronvermelding, toegangscontrole op documentniveau en een volledig auditlog. Niets verlaat je perimeter.
- Document intelligence: OCR- en extractiepipelines die facturen, contracten en douanedocumenten omzetten in gevalideerde, gestructureerde data, met menselijke controle waar de zekerheid laag is.
- Inferentie-optimalisatie: quantisatie, distillatie, caching en serving met vLLM, zodat het model dat je uitrolt ook betaalbaar draait.
- Gesuperviseerde agents voor backoffice-werk: state-machine-agents met goedkeuringsstappen, actielogs en replay, met een automatiseringsgraad die je kunt afzetten tegen de wachtrij die ze verving.
Hoe we werken
Elke AI-opdracht begint bij de evaluatieset, niet bij het model. We definiëren met jouw team wat goede output is, bouwen de benchmark en trainen pas daarna. Verslaat fine-tuning het basismodel plus retrieval niet op jouw data, dan zeggen we dat, en houd jij de benchmark.
Optimalisatie is een afweging die we expliciet maken: snelheid tegenover kwaliteit tegenover geheugen. Je ziet de cijfers per configuratie voordat er iets live gaat.
Modellen draaien waar je data staat: jouw cloudaccount, jouw cluster of ons EU-hostingplatform. We sturen je data niet door externe API's, tenzij jij daar bewust voor kiest.
Compliance zit in de bouw
Voor systemen die de AI-verordening als hoog risico aanmerkt, leveren we de technische documentatie, logging en monitoringsbewijzen samen met het systeem op. Je juristen krijgen het papierspoor terwijl het systeem gebouwd wordt, maanden voordat iemand erom vraagt.