---
title: "Hoe wij productiebugs fixen met AI-agents · Polargate"
description: "Hoe Polargate echt oplevert met AI-agents: een agent triageert elk ticket en stelt een fix voor als diff, auditagents weerleggen elkaar, een mens merget."
url: https://polargate.ai/nl/insights/agentic-delivery-in-production
locale: nl
publisher: POLARGATE S.L.
---
- [Polargate](https://polargate.ai/nl)
- [Inzichten](https://polargate.ai/nl/insights)
- Hoe wij AI-agents gebruiken om productiebugs te fixen ai-agents

# Hoe wij AI-agents gebruiken om productiebugs te fixen

Hoe Polargate echt oplevert met AI-agents: een agent triageert elk ticket en stelt een fix voor als diff, auditagents weerleggen elkaar, een mens merget.
Gepubliceerd 2026-08-05 · Door [Pedro Ciordia](https://polargate.ai/nl/about)

Kort gezegd
Polargate doet klantonderhoud met AI-agents binnen een door mensen gecontroleerde pijplijn. Een ticket komt binnen in een multi-tenant ServiceDesk, een agent triageert het voor ongeveer 0,05 USD, een tweede agent stelt een fix voor als diff in een GitHub Actions-run, en een senior engineer beoordeelt, merget en deployt. De eerste volledige fix kostte 0,31 USD aan modelverbruik. Geen agent antwoordt klanten of deployt.
Bijna elk bureau in onze markt verkoopt AI als product: een chatbot, een assistent, een automatisering. Bijna niemand vertelt of AI ook hun eigen manier van opleveren raakt. Bij Polargate is dat wel zo, op een concrete en tamelijk saaie manier. Deze pagina beschrijft de machinerie die we echt draaien, met de cijfers die we echt hebben, inclusief de delen die niet werken.

## Wat er gebeurt als er een ticket binnenkomt

Polargate voert het onderhoud voor klanten uit via een multi-tenant ServiceDesk, sinds 17 juli 2026 in productie. Een klant stuurt een mail of opent een ticket in zijn portaal. Vanaf dat moment:

- De mail komt binnen via ons supportdomein, met DKIM- en DMARC-controles en ondertekende reply-tokens, zodat een antwoord vanuit de mailbox van de klant aan het juiste ticket hangt en aan geen enkel ander.
- Een triage-agent classificeert het ticket: wat voor wijziging het is, welke repository het raakt, hoe risicovol het lijkt en hoeveel uur het zou moeten kosten. Deze stap draait op een groot model en kost ongeveer 0,05 USD per ticket.
- Is het ticket kandidaat voor automatisering, dan start een fixtaak als GitHub Actions-run in de repository van die klant. De worker is één canonieke workflow in onze eigen repo, en elke klantrepo bevat een stub van vijftien regels die hem aanroept. De agent werkt via de Claude Code CLI met een harde limiet van 80 beurten.
- De taak stuurt een diff terug via een callback en stopt daar. Hij wacht.
- Een mens, vandaag de oprichter, beoordeelt die diff in Mission Control, onze interne console: goedkeuren, om een nieuw plan vragen, de uren- of risicoschatting bijstellen, een antwoord aan de klant opstellen of alles annuleren.
- Een mens merget en deployt de wijziging, achter de gebruikelijke poorten: typecheck, tests, build en de echte pagina bekijken op desktop en op een telefoon van 375 pixels. De verbruikte uren gaan af van het contract van de klant, dat twee potten kent, onderhoud en spoed, waarbij het overschot naar proactieve verbeteringen gaat in plaats van te verdampen. De klant ziet zijn plan, zijn verbruik en zijn facturen in het portaal. Onze interne kennisbank ziet hij nooit: die toegangsregel staat in de database, niet in een beleidsdocument.

### Eén ticket, twee uitvoerders

Elk ticket kan op twee manieren dicht: via de automatische baan, die API-krediet kost, of met de hand door een senior engineer in Claude Code, wat niets kost omdat het binnen een bestaand abonnement loopt. Dezelfde wachtrij, hetzelfde ticket, twee uitvoerders. In de praktijk gaan kleine, goed afgebakende wijzigingen automatisch, en gaat alles wat oordeel over het bedrijf van de klant vraagt met de hand.

## Parallelle audits, en een scepticus bij elke bevinding

Bouwwerk kent een andere lus. Zodra een wijziging geschreven is, waaieren auditagents uit per dimensie: correctheid, architectuur en hergebruik, interface en platformrichtlijnen, toegankelijkheid, responsive gedrag, prestaties, en beveiliging inclusief row level security. Daarna gaat elke ruwe bevinding naar een aparte agent met maar één taak: hem onderuithalen.
Die weerleggingsronde is geen versiering. Cijfers uit onze eigen runs:

- Onderzoek naar een pushcrash op Android: 14 agents, 20 ruwe bevindingen, 8 geverifieerd, en geen enkele overleefde het contact met de code. De echte oorzaak lag elders.
- Site van een golfclub, twee rondes voor de merge: 37 ruwe bevindingen en 4 bevestigd, daarna 26 ruw en 3 bevestigd.
- Hotelsite in augustus 2026: 55 agents over 6 gebieden, 48 bevindingen, 48 bevestigd, 0 weerlegd. Zestien waren echte bugs, waaronder maar één van de twee kamertypes in de geprerenderde HTML, Engelse routes met lang="es" en bezoekerstellers die op nul stonden.
- Intern operationeel platform: een audit met 74 agents leverde 59 bevestigde bevindingen op, opgelost via een uitwaaiering van 11 agents.
- Een offline-first mobiele app had 11 auditrondes nodig, met bevindingen 42, 28, 9, 15, 11 en 4. Twee lessen. Ruwe agentoutput heeft een hoog percentage vals alarm, dus pas de weerleggingsstap maakt hem bruikbaar. En het bevestigingspercentage schommelt enorm, van 48 op 48 in de ene codebase tot 4 op 37 in de andere. Een run die bijna alles bevestigt betekent meestal dat die code nog nooit geauditeerd was.
De stopregel is twee schone rondes achter elkaar zonder blockers. "Geverifieerd" betekent build, typecheck en tests groen plus de interface open in de browser, want groene poorten liegen: een tsconfig waarvan de root geen enkel bestand omvatte gaf een project maandenlang een geslaagde typecheck, en twee deploys gingen groen langs een lintstap die nooit een foutcode teruggaf.

## De kennisbank eronder

Een agent is zo goed als zijn context. Polargate houdt per entiteit een kennisbank in Postgres bij: tekstfragmenten met embeddings en een HNSW-index, afgebakend per entiteit en project, met een gedeelde globale bibliotheek die in elke zoekopdracht meegaat en een muur tussen klantkennis, interne kennis en persoonlijke kennis. Onze eigen tools komen erbij via een MCP-server met meer dan 100 tools: kennis lezen en schrijven, tickets, urensaldi, facturen, contacten, releases en de fixwachtrij.
In de praktijk kent de triage-agent de stack van de klant al, de genomen beslissingen en wat de vorige keer stukging. Het betekent ook dat de gebruikelijke faalwijze kennis is en geen model: als een voorgestelde fix verkeerd terugkomt, ontbrak er bijna altijd een feit in de kennisbank.

## Wat een fix kost

- Triage: ongeveer 0,05 USD per ticket.
- De eerste echte fix van begin tot eind via deze pijplijn, op een klantportaal in juli 2026, kostte 0,31 USD aan modelverbruik.
- Workerinfrastructuur: niets. GitHub Actions-minuten in repositories waar we toch al voor betalen. We hebben een aparte server overwogen en afgewezen als overmaat voor één of twee taken per week.
- In de database staat een dagelijkse uitgavenlimiet. Zodra die geraakt wordt, stopt de baan. Het modelverbruik per fix is dus een kwestie van centen. Dat is de eerlijke kop en tegelijk het minst interessante getal, want de kosten die tellen zijn de reviewtijd van een senior, en die gaat niet naar nul. Iemand die begrijpt wat het bedrijf van de klant sloopt moet de diff nog steeds lezen. Wat de agent wegneemt is het opstelwerk: de code lezen, het probleem reproduceren, een eerste versie schrijven, het antwoord voorbereiden. Dat maakt seniorkwaliteit haalbaar op een retainer vanaf 850 EUR per maand, waar een bureau met loonlijst meer zou moeten rekenen of er junioren op zou moeten zetten.

## Wat de agents niet mogen

Deze grenzen zitten vastgelast in de database, niet in een prompt:

- Nooit zelf een klant antwoorden. Elk bericht naar de klant wordt door een mens bekeken en verstuurd.
- Nooit deployen. Geen enkele agent heeft productiecredentials.
- Nooit de dagelijkse uitgavenlimiet overschrijden.
- Nooit destructieve migraties draaien of aan authenticatie, rollen of secrets komen. De algemene grens: omkeerbare beslissingen zijn voor de agent, onomkeerbare stoppen en vragen. Een mens beoordeelt en merget elke wijziging. Dat is geen geruststellende slotzin, het is de reden dat je dit systeem überhaupt op de productierepo van een klant kunt richten.

## Als je dit zelf wilt bouwen

- Begin bij de ticketdesk, niet bij de agent. Automatisering zonder ticketsysteem en zonder urenadministratie heeft nergens houvast.
- Bouw de weerlegger voordat je de auditor vertrouwt.
- Zet de limieten in data, niet in prompts. Een prompt is een suggestie, een databaseconstraint niet.
- Meet je valse groen. Een verificatiepoort die niet kan falen is erger dan geen poort.
- Begroot de menselijke review eerlijk. Dat is nu het dure deel, en het is het deel waarvoor de klant betaalt. Polargate werkt zo op Care-retainers vanaf 850 EUR per maand, en nieuwe trajecten beginnen met een Discovery Sprint tegen vaste prijs vanaf 4.900 EUR.

Op deze pagina

- 01 [Wat er gebeurt als er een ticket binnenkomt](#wat-er-gebeurt-als-er-een-ticket-binnenkomt)
- 02 [Parallelle audits, en een scepticus bij elke bevinding](#parallelle-audits-en-een-scepticus-bij-elke-bevinding)
- 03 [De kennisbank eronder](#de-kennisbank-eronder)
- 04 [Wat een fix kost](#wat-een-fix-kost)
- 05 [Wat de agents niet mogen](#wat-de-agents-niet-mogen)
- 06 [Als je dit zelf wilt bouwen](#als-je-dit-zelf-wilt-bouwen)

FAQ

## Vragen, beantwoord

Beoordeelt een mens elke wijziging die jullie AI-agents op mijn site maken? Ja, elke wijziging. Bij Polargate stopt de agent na het maken van een diff en wacht: een senior engineer leest hem, keurt hem goed of af, en merget en deployt met de hand, achter typecheck, tests, build en een blik op de live pagina. Geen agent heeft productiecredentials en geen agent mag zelf een klant antwoorden. Die grenzen staan in de database, niet in een prompt.
Wat kost het om een bug met een AI-agent te fixen? In modelverbruik: centen. Triage kost Polargate ongeveer 0,05 USD per ticket, en de eerste volledige fix via de pijplijn, op een klantportaal in juli 2026, kostte 0,31 USD. De worker draait op GitHub Actions-minuten waarvoor al betaald wordt. De echte kosten zijn de seniorreview erna, en die verdwijnt niet: dat is waar de klant voor betaalt.
Kan een AI-agent zelf code naar mijn productiesite deployen? Bij Polargate niet. De fixagent eindigt met het terugsturen van een diff ter beoordeling en stopt daar. Mergen en deployen zijn handmatige stappen van een mens, nadat typecheck, tests en build slagen en de pagina op desktop en telefoon is bekeken. Ook staat er een dagelijkse uitgavenlimiet in de database die de automatische baan stilzet.
Zijn AI-agents betrouwbaar genoeg om code te reviewen? Op zichzelf niet. In de audits van Polargate hebben ruwe bevindingen een hoog percentage vals alarm: één crashonderzoek leverde 20 ruwe bevindingen op, 8 geverifieerd, en geen enkele overleefde het contact met de code. Daarom gaat elke bevinding naar een tweede agent die hem alleen maar mag weerleggen, en worden alleen bevestigde bevindingen opgelost.
Wat verandert werken met agents aan een onderhoudscontract? Het verandert wat je geld koopt. Omdat het opstellen van een fix centen kost, gaat er van een Care-retainer van Polargate, vanaf 850 EUR per maand, meer naar seniorreview, proactieve verbeteringen en de pot met resterende uren in plaats van naar routinewerk. Het haalt de mens niet uit de lus en maakt het werk niet instant.

## Meer lezen

pricing

### Wat een website in Spanje kost, en waarom de bandbreedte zo groot is

Wat een website in Spanje in 2026 echt kost: de vier marktsegmenten, wat er in elk segment zit, waardoor een offerte oploopt en acht vragen voordat je tekent.
2026-09-03 Lees meer

[Wat een website in Spanje kost, en waarom de bandbreedte zo groot is](https://polargate.ai/nl/insights/what-a-website-costs-in-spain)

pricing

### Wat een website kost in Nederland in 2026

De vier prijsklassen voor een zakelijke website in Nederland, wat de prijs beweegt, de toegankelijkheidsdeadline en vaste prijs versus uurtarief.
2026-09-03 Lees meer

[Wat een website kost in Nederland in 2026](https://polargate.ai/nl/insights/what-a-website-costs-in-the-netherlands)

pricing

### Wat maatwerksoftware kost voor een mkb-bedrijf

Wat de prijs van maatwerk bepaalt: onbekende scope, koppelingen, datamigratie, rollen en wat er gebeurt als het stukgaat. Met de gepubliceerde prijzen van Polargate.
2026-09-07 Lees meer

[Wat maatwerksoftware kost voor een mkb-bedrijf](https://polargate.ai/nl/insights/what-custom-software-costs)

INITIATE

## Start de motor

Vertel ons in een paar korte vragen wat je bouwt. Een senior engineer antwoordt binnen twee werkdagen schriftelijk met een eerste inschatting van scope, planning en prijs.
[Start je project](https://polargate.ai/nl/start) · [Praat met ons](https://polargate.ai/nl/start#static-brief-heading)
