De 6 raamwerken waar elke zakelijke koper van voice-AI naar moet vragen
De meeste securitypagina's van leveranciers pronken met één badge — meestal SOC 2 — en daar blijft het bij. Inkoopteams die echt toetsen hebben zes beheersmaatregelen nodig die vanaf dag één helder zijn:
- HIPAA — covered entities en business associates die tijdens gesprekken PHI verwerken.
- SOC 2 Type II — het rapport over operationele effectiviteit (niet Type I, niet de zelf opgestelde pdf).
- PCI DSS v4.0.1 — overal waar een beller een kaartnummer uitspreekt of via DTMF intoetst.
- GDPR + UK GDPR — bellers uit de EU en het VK, subverwerkers in de EU, DPA's op grond van Article 28.
- Dataresidentie — de fysieke opslagregio voor transcripties, opnames en embeddings.
- Spraakspecifieke risico's — stemafdrukken, bewaartermijn van opnames, lekken van trainingsdata.
Als de leverancier niet alle zes in één gesprek kan beantwoorden, is dat het antwoord. Sla de demo over en ga verder.
HIPAA: BAA's, PHI in transcripties, opt-out voor modeltraining
Spraaktranscripties zijn PHI zodra een beller zijn naam noemt in combinatie met een aandoening, een medicijn of een afspraak. Behandel de transcriptieopslag, de embeddingopslag en het analytics-datawarehouse allemaal als PHI-systemen.
Minimale HIPAA-lat voor een voice-AI-leverancier:
- Ondertekend BAA met bij naam genoemde subverwerkers (LLM-aanbieder, ASR-aanbieder, TTS-aanbieder, telecomprovider, observability-leverancier). Een BAA dat de LLM uitsluit, is geen BAA.
- Versleuteling tijdens transport (TLS 1.2+, SRTP voor media) en in rust (AES-256).
- Auditlogs van elke PHI-toegang, 6 jaar bewaard.
- Zero-data-retention-modus (ZDR) op de LLM-aanroep. OpenAI ZDR, Anthropic ZDR en Google Vertex zonder logging zijn allemaal instelbaar — controleer welke er daadwerkelijk voor jouw tenant is aangezet, niet de standaardinstelling uit de marketingfolder.
- Opt-out voor modeltraining op papier. De leverancier moet zich contractueel vastleggen dat jouw gespreksaudio, transcripties en tool-call payloads nooit worden gebruikt om enig model te trainen, van henzelf of van een subverwerker.
Voorbeeld van een BAA-clausule om in de RFP te plakken:
"Leverancier zal geen Beschermde Gezondheidsinformatie die via de Voice-AI-dienst wordt verzonden gebruiken, en zal ervoor zorgen dat geen enkele Onderaannemer die gebruikt, om enig machinelearningmodel te trainen, te finetunen of te evalueren, met inbegrip van maar niet beperkt tot grote taalmodellen, modellen voor automatische spraakherkenning en tekst-naar-spraakmodellen. Leverancier zal alle modelaanbieders van derden voor de tenant van Klant configureren in een modus met zero data retention of zonder logging en zal op verzoek een schriftelijke verklaring van die configuratie verstrekken."
Als de leverancier terugdeinst voor die clausule, staat jouw PHI in iemands trainingscorpus.
SOC 2 Type II: wat je moet controleren voorbij de badge
De SOC 2-badge in een footer betekent niets. Eis het rapport zelf op onder NDA en lees juist de delen waarvan leveranciers hopen dat je ze overslaat.
Checklist voor het rapport:
- Type II, niet Type I. Type I is een opzettoets op één moment. Type II beslaat 6 tot 12 maanden operationele effectiviteit. Alles daaronder is theater.
- Welke Trust Service Criteria zijn gedekt. Security is verplicht. Availability, Confidentiality en Processing Integrity horen allemaal binnen de scope te vallen bij een voice-AI-platform dat echte klantgesprekken voert.
- Auditor. Een echte Big-4 of een erkend accountantskantoor. Geen lopendebandauditor van 5.000 dollar die schone rapporten uitgeeft alsof het een productfeature is.
- Het hoofdstuk met bevindingen. Sla de begeleidende brief over. Ga naar de bevindingen. Nul bevindingen in een echte Type II betekent meestal dat de scope om niets heen is getrokken. Eén of twee goed gedocumenteerde bevindingen met herstelplan is normaal en gezond.
- Subserviceorganisaties. Kijk of AWS, GCP en Azure als carve-outs staan vermeld met hun eigen SOC 2. Is de LLM-aanbieder of de telecomprovider een subserviceorganisatie, dan hoort ook hun SOC 2 genoemd te worden.
- Scopebeschrijving. Controleer of het voice-AI-product dat je koopt bij naam in de scope staat. Soms nemen leveranciers alleen de marketingsite of het dashboard in scope, niet het inferentiepad.
PCI DSS: hoe voice-AI je scope bij betaalgesprekken verandert (of vergroot)
Hier blazen de meeste voice-AI-implementaties stilletjes de PCI-scope van de koper op. Op het moment dat een beller 16 cijfers uitspreekt, ligt het hele pad — telecomprovider, ASR, contextvenster van de LLM, transcriptieopslag, observability-leverancier — binnen de Cardholder Data Environment.
Twee architecturen, twee heel verschillende audits:
| Patroon | Wat er met het kaartnummer gebeurt | Jouw PCI-scope |
|---|---|---|
| Naïeve voice-AI | De ASR transcribeert "4111 1111 1111 1111" naar de LLM-context en je logs | Volledige CDE: ASR, LLM, transcriptiedatabase, logpijplijn, BI-datawarehouse |
| DTMF-onderdrukking / pauzeren en hervatten | De beller wordt doorgegeven aan een PCI DSS Level 1 IVR-toetsenblok, agent en ASR staan op mute, alleen een token komt terug | De PCI-scope van de leverancier, niet die van jou |
Het patroon pauzeren en hervatten met DTMF-maskering (soms "agent assist-onderdrukking" genoemd) krimpt je scope van "audit het universum" naar "audit de integratie".
Vragen voor de koper:
- Gebeurt de DTMF-maskering op SBC-niveau of op applicatieniveau? Op SBC-niveau komen de tonen helemaal niet in de mediastroom.
- Krijgt de ASR gedempte audio tijdens het invoervenster, of wordt de transcriptie er alleen achteraf uit geredigeerd? Achteraf redigeren is niet PCI-conform — de data heeft het systeem al geraakt.
- Heeft de leverancier een geldige PCI DSS v4.0.1 AOC voor de betaalinvoercomponent? Vraag om de AOC, niet om een persbericht.
- Worden gespreksopnames van het betaalsegment opgeslagen, ook versleuteld? PCI vereist dat ze helemaal niet bewaard worden als ze na autorisatie SAD bevatten.
GDPR + EU-residentie: datalocatie, subverwerkers, alarmbellen in het DPA
Als er ook maar één beller vanuit de EU of het VK belt, geldt GDPR ongeacht waar je hoofdkantoor staat. De voice-AI-leverancier is verwerker (Article 28); jouw bedrijf is verwerkingsverantwoordelijke.
Het DPA moet vastleggen:
- Bij naam genoemde subverwerkers met hun locaties. "AWS" is niet genoeg — "AWS eu-central-1" wel.
- Standard Contractual Clauses (modules uit 2021) als een subverwerker in de VS zit, plus een Transfer Impact Assessment.
- Een schriftelijke garantie van dataresidentie. "EU waar mogelijk" is geen residentie. Zoek naar een regiovastzetting op tenantniveau: audio, transcripties, embeddings en vectorindexen blijven allemaal in eu-west-1 / eu-central-1 / eu-north-1.
- Een verwijderings-SLA. Verwijdering op grond van Article 17 van GDPR binnen 30 dagen, doorgevoerd naar back-ups binnen het gedocumenteerde back-uprotatievenster.
- Melding van wisseling van subverwerker met een echt recht van bezwaar — minimaal 30 dagen, niet "we werken de pagina wel bij".
Alarmbellen in DPA's van leveranciers:
- "Geaggregeerde en geanonimiseerde gegevens kunnen worden gebruikt om onze diensten te verbeteren." Spraakdata is zelden echt te anonimiseren — stemafdrukken zijn biometrische identificatoren op grond van Article 9 van GDPR. Schrap die clausule.
- Een datacenter uitsluitend in de VS met een "wij voldoen aan GDPR" maar zonder SCC's en zonder TIA.
- Een lijst met subverwerkers verstopt achter een login of een NDA. Article 28 vereist dat die voor jou beschikbaar is.
Spraakspecifieke risico's: bewaren van opnames, biometrische stemafdrukken, lekken van trainingsdata
De raamwerken hierboven zijn geschreven voor SaaS en betalingen. Voice-AI voegt drie faalwijzen toe die geen van alle volledig gedekt worden:
1. Bewaren van opnames. De standaardbewaartermijn op de meeste platformen is 30 tot 90 dagen, soms onbeperkt. Dring aan op een per tenant instelbare bewaartermijn tot 0 dagen (alleen transcriptie, geen audio) en laat bevestigen dat het om harde verwijdering gaat, niet om soft-deletevlaggen.
2. Biometrische stemafdrukken. Sommige platformen berekenen sprekerembeddings (een vector met 192 dimensies die een stem uniek identificeert) voor diarisatie of fraudedetectie. Op grond van Article 9 van GDPR, BIPA (Illinois) en de Texas CUBI is die vector biometrische data met toestemmingseisen die verder gaan dan bij gewone PII. Vraag: worden er stemafdrukken gegenereerd, waar worden ze opgeslagen, kunnen ze per tenant worden uitgezet?
3. Lekken van trainingsdata. Zelfs met een opt-out voor modeltraining gebruiken leveranciers soms geredigeerde transcripties om modelprestaties te beoordelen of evaluatiesets op te bouwen. "Evaluatie" kan een achterdeurtje zijn. Zorg dat de clausule elk nagelegen modelgebruik dekt, inclusief evaluaties en datasets voor promptoptimalisatie.
De downloadbare RFP-vragenlijst (15 vragen)
Plak deze in je leveranciersvragenlijst. Ja/nee-antwoorden dwingen de leverancier zich op papier vast te leggen.
- Tekenen jullie een HIPAA BAA dat alle subverwerkers dekt, inclusief de LLM-, ASR- en TTS-aanbieders?
- Draaien jullie de LLM standaard in een modus met zero data retention / zonder logging voor onze tenant?
- Leggen jullie je contractueel vast dat onze audio, transcripties en tool-call payloads nooit worden gebruikt voor modeltraining, finetuning of evaluatie?
- Lever je meest recente SOC 2 Type II-rapport onder NDA. Welke Trust Service Criteria vallen binnen de scope?
- Wordt het inferentiepad van de voice-AI expliciet bij naam genoemd in de SOC 2-scopebeschrijving?
- Som alle bevindingen uit de meest recente SOC 2 Type II op, met de herstelstatus van elk.
- Lever je geldige PCI DSS v4.0.1 AOC. Welke component is gecertificeerd?
- Hoe worden betaalkaartgegevens vastgelegd — DTMF-onderdrukking op SBC-niveau, maskering op applicatieniveau of redactie achteraf?
- Worden gespreksopnames van betaalsegmenten in enige vorm bewaard? Zo ja, waar en hoe lang?
- Lever een lijst met subverwerkers met per stuk de fysieke datacenterregio.
- Kunnen audio, transcripties, embeddings en vectorindexen op tenantniveau aan een EU-regio worden vastgezet?
- Wat is jullie verwijderings-SLA op grond van Article 17 van GDPR, inclusief doorwerking naar back-ups?
- Genereren jullie sprekerembeddings of stemafdrukken? Kunnen die per tenant worden uitgezet?
- Wat is de kortste instelbare bewaartermijn voor gespreksopnames? Kan die op nul worden gezet?
- Lever een samenvatting van een recente penetratietest door een derde partij (van de afgelopen 12 maanden) die het spraakinferentiepad dekt.
Als een leverancier niet alle 15 binnen een week schriftelijk kan beantwoorden, heeft hij het werk nog niet gedaan — en betaal jij om zijn R&D-project op het gebied van compliance te zijn.
Veelgestelde vragen
Is HIPAA genoeg voor een voice-AI-implementatie in de zorg? Nee. HIPAA is noodzakelijk, niet voldoende. Je hebt ook SOC 2 Type II nodig voor de platformbeheersing, een actuele pentest voor het inferentiepad en biometrische dekking op statelijk niveau (BIPA, CUBI, Washington My Health My Data) als je stemafdrukken genereert.
Betekent een SOC 2 Type II-rapport dat de leverancier voldoet aan GDPR? Nee. SOC 2 gaat over de operationele effectiviteit van interne beheersmaatregelen. GDPR is een juridisch regime dat een DPA, bij naam genoemde subverwerkers, SCC's voor doorgiften en rechten van betrokkenen vereist. Een leverancier heeft beide nodig, en de twee rapporten dekken verschillende oppervlakken.
Kan een voice-AI-leverancier mijn PCI-scope tot nul terugbrengen? Bijna, maar niet precies nul. Een leverancier met DTMF-onderdrukking op SBC-niveau en een Level 1 PCI AOC voor de betaalinvoercomponent brengt je in de meeste telefonische betaalopstellingen terug tot het gebied van SAQ A of SAQ A-EP. De integratie en de keuze voor gespreksrouting blijven van jou.
Wat is de zero-data-retention-modus (ZDR) en waarom is die belangrijk? ZDR is een instelling op tenantniveau bij de LLM-aanbieder die het loggen van prompts en completions uitschakelt. Zonder die instelling staan je gesprekstranscripties minimaal 30 dagen in de logs van de LLM-aanbieder, wat verderop in de keten zowel de BAA- als de DPA-toezeggingen breekt.
FAQ JSON-LD: render this section as Question + Answer schema.org entities for the FAQPage type so the SERP gets the rich result. Standard Next.js MDX FAQ component on the blog already handles this — wrap the section in <FAQ> and the layout emits the JSON-LD.
Ben je een voice-AI-leverancier aan het toetsen en klaar met securitypagina's van marketingniveau? Finn komt vanaf dag één met een ondertekend BAA, SOC 2 Type II met het inferentiepad in scope, DTMF-onderdrukking op SBC-niveau voor PCI en EU-residentie op tenantniveau. Stuur ons de vragenlijst met 15 vragen hierboven — wij antwoorden binnen 48 uur, schriftelijk, met de bewijsstukken erbij. Boek een securityreview op inkoopniveau →
Reviewer: Menselijk bestuur / AGNB-contenteigenaar. Niet publiceren voordat het is beoordeeld — de publicatiestap is op dit moment handmatig.
Gerelateerd: Voice-AI-security: het dreigingsmodel van de audiolaag




