---
title: "Realtime spraakagenten · Polargate"
description: "Conversationele spraakagenten op je eigen backend: ze stellen vast wie er spreekt, lezen echte gegevens uit je database en schrijven terug naar dezelfde systemen…"
url: https://polargate.ai/nl/services/build/voice-agents
locale: nl
publisher: POLARGATE S.L.
---
- [Polargate](https://polargate.ai/nl)
- [Diensten](https://polargate.ai/nl/services)
- [Build](https://polargate.ai/nl/services/build)
- Realtime spraakagenten Build // Spraakagenten die het werk doen, niet alleen een antwoord voorlezen.

# Realtime spraakagenten

Conversationele spraakagenten op je eigen backend: ze stellen vast wie er spreekt, lezen echte gegevens uit je database en schrijven terug naar dezelfde systemen die je team gebruikt. Onze hotelagent draait 11 tot 12 servertools op dezelfde databasefuncties als de app. Gepubliceerd als pilot: nog geen live telefoonlijn, en om de beurt, geen full duplex.

Kort gezegd
Polargate bouwt spraakagenten die uitvoeren in plaats van alleen informeren. De agent in ons eigen hospitality-product logt de gast in via spraak, leest de echte restaurantkaart uit de database, neemt roomservicebestellingen op, maakt, wijzigt en annuleert reserveringen voor restaurant en spa, en opent een geclassificeerd ticket in hetzelfde systeem als de app, via 11 tot 12 servertools op dezelfde databasefuncties. De identiteit wordt binnen het gesprek gecontroleerd en de pincode bereikt nooit de spraakleverancier of de logs. De systeemprompt wordt deterministisch samengesteld uit de configuratie van elke locatie en doorstond een adversarial red team: 0 van de 6 vectoren na het harden. Het is een pilot en dat zeggen we erbij: er is geen live telefoonnummer dat echte klanten te woord staat, geen beschikbaarheid of kamerprijzen uit het PMS, en geen full duplex.

## Wat het is

Een spraakagent die je klant te woord staat en het werk vervolgens ook doet. Hij stelt vast wie er spreekt, leest echte gegevens uit je database en schrijft terug naar dezelfde systemen die je team al gebruikt. Wij bouwen hem, beveiligen hem en blijven hem daarna beheren.
Deze pagina is geschreven als pilot, want dat is het. Hieronder staat wat al draait, gescheiden van wat nog niet draait.

## Wat onze agent al doet

De hotelagent in ons eigen product logt de gast in via spraak, beantwoordt vragen over het hotel, leest de echte kaart van elk restaurant uit de database, neemt roomservicebestellingen op, maakt, wijzigt en annuleert reserveringen voor restaurant en spa, doet triage van een melding door een geclassificeerd ticket te openen in hetzelfde systeem als de app, laat berichten achter bij de receptie en verbindt door naar de receptie zodra de locatie dat aanzet.
Dat zijn 11 tot 12 servertools, aangesloten op dezelfde databasefuncties die de app aanroept. Geen parallelle koppeling, dezelfde bron van waarheid.

### Hij verzint niets

De kaart komt uit de database. Heeft een restaurant geen kaart ingeladen, dan zegt de agent dat in plaats van er een te verzinnen, en gerechten die niet bestaan wijst hij af. Hij houdt zich aan echte openingsdagen en reserveringsvensters, en als reserveren niet kan noemt hij de werkelijke tijden in plaats van een algemene foutmelding.
Gecontroleerd op 18 van de 18 gesproken scenario's tijdens een QA-ronde in juli 2026 tegen de draaiende agent in een demolocatie, met audio, transcript, interface en database als bewijs. Een eerdere QA van de preview, juni 2026, kwam uit op 21 van de 24 perfect, zonder kritieke fouten.

### De identiteit wordt in het gesprek zelf gecontroleerd

Kamernummer of naam plus een pincode, gehasht en met blokkade na mislukte pogingen, één keer per gesprek gevraagd. De pincode bereikt nooit de spraakleverancier en nooit de logs. De tenant wordt altijd op de server bepaald, nooit uit het model of uit de payload.
Dezelfde agent kent twee sessiemodi: in de app, al geauthenticeerd via een serverkoppeling, waarbij de gast niets hoeft op te geven; en een belmodus met de volledige gesproken verificatie.

### De prompt is engineering, geen tekstvak

De systeemprompt van de pilotagent is ongeveer 31.000 tekens en wordt uit de configuratie van de locatie samengesteld door een deterministische compiler, zonder taalmodel erin. Voor livegang ging hij door een adversarial red team van twaalf agents: 4 van de 6 aanvalsvectoren braken het concept, en na het harden kwam 0 van de 6 er nog doorheen. Een aparte audit liep de toolschema's na en liet ze gezond achter, 12 van de 12.

### Eén agent per tenant, die zichzelf uitrolt

Voor een locatie met spraak aan maakt een edge function haar agent aan, stelt de prompt samen uit de configuratie van die locatie en wijst de tools toe die haar mogelijkheden toestaan. Dat pad is end to end getest in productie en daarna volledig opgeruimd. Het team van de klant stelt niveau en mogelijkheden in vanuit het platform zelf, en de spraakbackend leest die configuratie alleen via een functie die dichtvalt bij twijfel en die geen gastgegevens en geen pincode teruggeeft.
De scheiding wordt machinaal gecontroleerd, niet met de hand: row level security op de tabellen met een tenant-id, en een wachter die tenants en tabellen zelf ontdekt in plaats van ze op te sommen, draaiend in continuous integration. In augustus 2026 bewaakt hij 81 tabellen met een hotel-id, en die run, over twee echte hotels, vond geen lekkage tussen tenants.

## Wat hij nog niet doet

- Geen live telefoonnummer dat gesprekken van echte klanten aanneemt. De beltak is ontworpen, het nummer wacht op regelgevend papierwerk en er is geen echt inkomend gastgesprek gevalideerd.
- Geen beschikbaarheid en geen kamerprijzen uit het PMS. Die laag is niet open, en de beschikbaarheidstool dekt alleen restaurants.
- Geen full duplex. De API's van vandaag werken om de beurt en geen enkele leverancier publiceert officiële end-to-end latency, dus noemen wij er ook geen. We hebben wel een gemeten synthesetijd voor het voorlezen van een geschreven antwoord, maar dat is tekst naar spraak, geen gesprek, en die twee getallen door elkaar halen zou oneerlijk zijn.
- Elke agent die we tot nu toe hebben gebouwd is een hotelagent. Het mechanisme is niet hotelspecifiek. Het bewijs in productie wel.

## Een antwoord voorlezen is geen gesprek

Tekst naar spraak leest iets voor dat al geschreven is. Een spraakagent luistert, beslist en roept tools aan op jouw gegevens. Het zijn verschillende producten, ze kosten verschillend geld, en we houden hun cijfers uit elkaar.

## De stack

De conversatiemotor van ElevenLabs voor de agent, de stem en de transcriptie, met het taalmodel erin. Onze eigen backend op Supabase, met edge functions en databasefuncties met beheerde rechten. Geheimen in een vault, nooit in de repository.
Het platform waarop deze agent draait, staat in productie met echte gasten in twee hotels, één daarvan sinds augustus 2026. Dat zijn cijfers van het platform, niet van het spraakkanaal, en we presenteren ze niet als spraakresultaten.

Wat je krijgt

- Servertools op dezelfde databasefuncties die je app of portaal al aanroept, zodat spraak naar één bron van waarheid schrijft
- Identiteit gecontroleerd binnen het gesprek, gehasht en met blokkade na pogingen, waarbij het geheim nooit bij de spraakleverancier of in de logs komt
- Een systeemprompt die uit jouw configuratie wordt samengesteld door een deterministische compiler, zonder taalmodel in die compiler
- Adversarial red team op de prompt voor livegang, plus een audit van elk toolschema
- Scheiding per tenant met row level security en een automatische wachter die tabellen zelf ontdekt in plaats van ze op te sommen, draaiend in CI
- Selfservice-uitrol: een nieuwe locatie krijgt haar agent, haar prompt en haar tools in één handeling
- Gesproken QA tegen de draaiende agent, met audio, transcript, interface en database als bewaard bewijs
Samenwerking
Doorlooptijd
Het tempo wordt bepaald door de acties, niet door de stem. De spraakmotor aansluiten is het korte deel: elk ding dat de agent mag doen is een servertool op jouw database, met eigen regels en eigen tests. Een Discovery Sprint met vaste scope bepaalt welke acties in de eerste versie komen voordat er iets gebouwd wordt. Onze eigen hotelagent doorliep in juni en juli 2026 gesproken QA-rondes voordat wij hem bij een gast zouden neerzetten, en voor die van jou plannen we hetzelfde. Hoort het aannemen van een echte telefoonlijn erbij, zeg dat dan meteen: dat is de tak die wij niet gevalideerd hebben, met eigen regelgevend papierwerk.

Team
Wij zijn met z'n tweeën, en geen van beiden is verkoper. Pedro Ciordia, oprichter en CTO van Polargate, doet de architectuur, de tools, de prompt engineering en de reviews; Andrés Ciordia, Chief AI Officer, leidt de spraakagenten. Specialisten uit het netwerk van de studio sluiten aan wanneer een project daarom vraagt. Het adversarial werk hoort bij de methode: de prompt en de toolschema's worden aangevallen voordat een klant ooit met de agent praat.

Prijs
Scope en prijs komen uit een Discovery Sprint met vaste prijs, vanaf 4.900 EUR, die eindigt met een vaste prijs voor de bouw zelf. Wat die prijs beweegt is het aantal acties dat de agent moet uitvoeren, niet de stem. Het verbruik bij de spraakleverancier wordt apart doorbelast. Daarna loopt het draaiend houden via Care, vanaf 850 EUR per maand.

Stack

- Supabase
- PostgreSQL
- Deno

## Bewijs

Estevano

### Estevano: de gastenapp en de personeelsconsole die de hoteldag draaiende houden

Estevano is het eigen hotelproduct van Polargate: een gastenapp, een AI-assistent en een personeelsconsole die een verzoek omzetten in een gerouteerd ticket met een eigenaar en een klok. Het draait al maanden in productie bij Santo Domingo Bay, waar het in vier maanden zo'n 2.500 echte gastverzoeken afhandelde met een mediane oplostijd van zestien minuten.
2026 Bekijk de case

[Estevano: de gastenapp en de personeelsconsole die de hoteldag draaiende houden](https://polargate.ai/nl/work/estevano-hotel-operations)

FAQ

## Vragen, beantwoord

Kan een spraakagent onze telefoon aannemen? Nog niet, en dat zeggen we liever hier dan bij de kickoff. De agent heeft een belmodus met de volledige gesproken verificatie, maar de telefoontak is ontworpen en niet uitgevoerd: het nummer wacht op regelgevend papierwerk en er is geen echt inkomend klantgesprek gevalideerd. Wat we wel getest hebben, is spraak binnen de app, waar de gast al is geauthenticeerd via een serverkoppeling en nooit om een kamernummer of pincode wordt gevraagd. Is een live telefoonlijn je echte eis, dan is dat het eerste om te plannen, te begroten en te valideren.
Hoe voorkomen jullie dat hij dingen verzint? Door hem niet uit zijn geheugen te laten antwoorden. Feiten komen via servertools uit je database, dus de kaart is de kaart die is ingeladen, en heeft een restaurant geen kaart, dan zegt de agent dat in plaats van er een te maken. Wat niet bestaat wijst hij af, en hij houdt zich aan echte openingsdagen en reserveringsvensters. De systeemprompt is voor livegang aangevallen door een adversarial red team van twaalf agents: 4 van de 6 vectoren braken het concept, 0 van de 6 kwam er na het harden nog doorheen. Een QA-ronde in juli 2026 haalde 18 van de 18 gesproken scenario's tegen de draaiende agent in een demolocatie, met audio, transcript, interface en database als bewaard bewijs. Dat zijn gedateerde testresultaten, geen permanente garantie, en we herhalen ze.
Werkt dit alleen voor hotels? Het mechanisme is niet hotelspecifiek: een agent, een set servertools op jouw database, een prompt die uit jouw configuratie wordt samengesteld, en scheiding per tenant. Maar we zijn eerlijk over het bewijs. Elke spraakagent die Polargate tot nu toe heeft gebouwd is een hospitality-agent, en daar is het testen in productie gebeurd. Is jouw situatie een andere sector, dan ben je bij ons de eerste, en de Discovery Sprint bestaat juist om dat te beprijzen en het risico te beperken in plaats van het weg te praten.
Wat is het verschil met een chatbot die praat? Een chatbot die praat leest een al geschreven antwoord voor. Dat is tekst naar spraak, en dat informeert. Een spraakagent luistert, controleert wie er spreekt, beslist en roept tools aan die echte records wijzigen: een bestelling, een reservering, een ticket in hetzelfde systeem waarin je team werkt. Het zijn verschillende producten en hun cijfers zijn niet uitwisselbaar, en daarom noemen we onze synthesetijd niet alsof het gesprekslatentie is. De API's van vandaag werken bovendien om de beurt, geen full duplex, en geen leverancier publiceert officiële end-to-end latency, dus beloven we geen getal dat we niet kunnen meten.
Zijn onze gegevens veilig als de spraakleverancier ertussen zit? Het ontwerp gaat ervan uit dat de spraakleverancier een buitenstaander is. De verificatie gebeurt binnen het gesprek en de pincode is gehasht, met blokkade na pogingen, en gaat nooit naar de leverancier of naar de logs. De tenant wordt op onze server bepaald, nooit uit het model of de payload, dus geen enkele prompt kan zich naar de gegevens van een andere klant praten. Het configuratie-endpoint valt dicht bij twijfel en geeft geen gastgegevens terug. De scheiding wordt afgedwongen met row level security en in continuous integration gecontroleerd door een wachter die tabellen zelf ontdekt in plaats van ze op te sommen: in augustus 2026 dekt hij 81 tabellen met een hotel-id, en die run, over twee echte hotels, vond geen lekkage tussen tenants. Dat is een gedateerde controle, geen permanente eigenschap, en hij draait bij elke wijziging opnieuw.

INITIATE

## Start de motor

Vertel ons in een paar korte vragen wat je bouwt. Een senior engineer antwoordt binnen twee werkdagen schriftelijk met een eerste inschatting van scope, planning en prijs.
[Start je project](https://polargate.ai/nl/start) · [Praat met ons](https://polargate.ai/nl/start#static-brief-heading)
