Private & self-hosted AI
De volledige AI-stack — modellen, retrieval, transcriptie — draaiend op infrastructuur die u beheert.
Voor werk dat uw perimeter niet mag verlaten, zetten we de hele stack privé neer: open-source model-serving, spraakherkenning, vectorzoeken en retrieval, beveiligd netwerk en toegangsbeheer. Op uw hardware, in een EU-cloud of hybride. We draaien onze eigen productiesystemen op dezelfde manier — de runbooks komen uit ervaring, niet uit theorie.
- Gevoelige data verlaat nooit infrastructuur onder uw beheer
- Voorspelbare kosten bij volume in plaats van verrassingen per token
- AVG- en toezichtsgesprekken worden rechttoe rechtaan
Wat er meestal bij hoort
- Self-hosted model-serving, gedimensioneerd op uw werklast
- Private retrieval-stack: vectorzoeken over uw data
- Spraak- en documentpipelines binnen uw perimeter
- Beveiligingsontwerp, toegangsbeheer, monitoring en runbooks
Geschikt voor
- Gereguleerde sectoren: financiën, zorg, juridisch, overheid
- Bedrijven waarvan data in de EU moet blijven — of in het pand
- Teams voor wie inferentiekosten een eigen begrotingspost werden
Een aanpak die in operations is verankerd — niet in hype
- Soevereiniteitseisen, werklasten en dimensionering vastleggen
- De stack uitrollen en benchmarken op uw echte taken
- Overdracht met runbooks — of wij beheren het voor u
Wat we voor u kunnen bouwen
- Klinisch dicteren zonder cloud: consulten op de servers van het ziekenhuis getranscribeerd tot gestructureerde notities, zodat patiëntaudio het gebouw nooit verlaat
- Advocaten bevragen een volledig zaakdossier, met het beroepsgeheim intact, via een zoekserver in het eigen rack van het kantoor
- Een dealroom-analist voor M&A-teams die de dataroom leest op air-gapped hardware. Niets bereikt een derde partij, omdat niets dat kan
- Wanneer burgers een overheidsinstantie aanschrijven, stelt een assistent het conceptantwoord op en blijft elk dossier op soevereine infrastructuur
- Naast de productielijn beantwoordt een offline box vragen van operators vanuit uw machinehandleidingen en storingshistorie
- Levert u AI-features in een SaaS-product? Een privaat inference-cluster vervangt API-calls met tikkende teller zodra de factuur per token nergens meer op slaat
- Voor verzekeraars: een stack die claims samenvat en daarbij medische rapporten en ongevalsfoto's leest zonder een publieke API aan te raken
- Expediteurs krijgen een douanedocumentlezer die cognossementen en handelsfacturen classificeert binnen een EU-cloudtenant onder hun eigen beheer
- Een HR-assistent die vragen over beleid en salaris beantwoordt, terwijl personeelsdossiers uw netwerk nooit verlaten
- En wanneer u beide nodig heeft: een hybride routeringslaag houdt gevoelige queries op eigen modellen en stuurt routineverkeer naar cloudproviders
Veelgestelde vragen
- Zijn open-source-modellen echt goed genoeg voor serieus werk?
- Voor werk dat op uw bronnen steunt wel: vragen beantwoorden vanuit uw documenten, gestructureerde data uit formulieren halen, transcriptie, samenvatten. Daar houden de huidige open modellen zich uitstekend staande, en we benchmarken kandidaten op uw eigen data voordat u zich ergens aan verbindt. De eerlijke grens: op de zwaarste redeneertaken lopen de grootste propriëtaire modellen nog voorop. Waar dat ertoe doet, routeren we alleen die queries naar een in de EU gehoste API en houden we al het overige binnen uw eigen infrastructuur.
- Moeten we eerst een rack vol GPU's kopen voordat we iets te zien krijgen?
- Nee. We beginnen op gehuurde GPU-capaciteit in een EU-cloud, bewijzen de workload en verhuizen die naar uw eigen hardware zodra we weten wat er werkelijk nodig is. Een pilot kan al live zijn terwijl inkoop nog offertes vergelijkt. Vooral retrieval en transcriptie draaien op aanzienlijk bescheidener hardware dan de meeste kopers verwachten.
- Wie houdt dit draaiende na de overdracht? Wij hebben geen ML-team.
- Dat heeft u ook niet nodig. De stack bestaat uit standaard, gedocumenteerde onderdelen: containers, gangbare model-serving, gewone zoekinfrastructuur. We dragen monitoring, alerting en runbooks over die voor uw IT-team zijn geschreven, niet voor onszelf, en niets hangt af van een framework dat alleen wij begrijpen. Wilt u er liever helemaal niet aan zitten, dan draaien wij het voor u binnen een supportafspraak.
- Wanneer is self-hosting de verkeerde keuze?
- Vaker dan leveranciers toegeven. Mag uw data rechtmatig naar een beheerde, in de EU gehoste API en zijn uw volumes bescheiden, dan is een private stack operationele ballast die u niet nodig heeft, en dat vertellen we u in het eerste gesprek. Self-hosting verdient zich terug wanneer regelgeving, klantcontracten of zwaar en aanhoudend gebruik erom vragen. We bakenen liever de kleinere bouw af dan dat we u een platform overhandigen dat uw team met tegenzin onderhoudt.
Verbonden onderdelen van het aanbod
- AI-integratie — AI toegevoegd aan de software en systemen die u al gebruikt — geen extra tool ernaast.
- Advies in automatisering — Heldere aanbevelingen, vóór u budget, tijd of verandercapaciteit inzet.
- Softwareontwikkeling — Elke software, elke tool, elk commercieel format — om te bezitten, white label onder uw merk, of gerund als uw product.
Bespreek deze dienst: [email protected]