Skip to main content

HIPAA, SOC 2, PCI: la checklist di conformità per l'AI vocale

Quasi tutte le pagine sulla sicurezza dei fornitori si vantano di un solo bollino — di solito SOC 2 — e si fermano lì.

Digvijay Singh Shekhawat
Digvijay Singh Shekhawat
July 24, 2026
12 min read
Una cornetta telefonica beige poggia su carta e lastre di travertino sotto una calda luce solare

I 6 framework su cui ogni acquirente enterprise di AI vocale deve fare domande

Quasi tutte le pagine sulla sicurezza dei fornitori si vantano di un solo bollino — di solito SOC 2 — e si fermano lì. I team acquisti che fanno verifiche vere hanno bisogno di sei controlli chiariti già dal primo giorno:

  1. HIPAA — covered entity e business associate che trattano PHI durante le chiamate.
  2. SOC 2 Type II — il report sull'efficacia operativa (non Type I, non il PDF autocertificato).
  3. PCI DSS v4.0.1 — ovunque chi chiama pronunci o digiti in DTMF il numero di una carta.
  4. GDPR + UK GDPR — chiamanti da UE e Regno Unito, sub-responsabili nell'UE, DPA ai sensi dell'Article 28.
  5. Residenza dei dati — regione di archiviazione fisica di trascrizioni, registrazioni ed embedding.
  6. Rischi specifici della voce — impronte vocali, conservazione delle registrazioni, fuga di dati di addestramento.

Se il fornitore non riesce a rispondere a tutti e sei i punti in una sola chiamata, quella è la risposta. Salta la demo e passa oltre.


HIPAA: BAA, PHI nelle trascrizioni, opt-out dall'addestramento dei modelli

Le trascrizioni vocali diventano PHI nel momento in cui chi chiama dice il proprio nome insieme a una patologia, a un farmaco o a un appuntamento. Tratta l'archivio delle trascrizioni, quello degli embedding e il data warehouse analitico tutti come sistemi che contengono PHI.

Soglia minima di HIPAA per un fornitore di AI vocale:

  • BAA firmato con sub-responsabili indicati per nome (fornitore di LLM, fornitore di ASR, fornitore di TTS, operatore telefonico, fornitore di observability). Un BAA che esclude l'LLM non è un BAA.
  • Cifratura in transito (TLS 1.2+, SRTP per i flussi media) e a riposo (AES-256).
  • Log di audit di ogni accesso ai PHI per 6 anni.
  • Modalità a conservazione zero dei dati (ZDR) sulla chiamata all'LLM. OpenAI ZDR, Anthropic ZDR e la modalità senza logging di Google Vertex sono tutte configurabili: verifica quale è effettivamente attiva per il tuo tenant, non l'impostazione predefinita da brochure.
  • Opt-out dall'addestramento dei modelli messo per iscritto. Il fornitore deve impegnarsi contrattualmente a non usare mai l'audio delle tue chiamate, le trascrizioni e i payload delle chiamate agli strumenti per addestrare alcun modello, né suo né di un sub-responsabile.

Esempio di clausola BAA da incollare nell'RFP:

"Il Fornitore non utilizzerà, e garantirà che nessun Subappaltatore utilizzi, le Informazioni Sanitarie Protette trasmesse tramite il Servizio di AI Vocale per addestrare, mettere a punto o valutare qualsivoglia modello di apprendimento automatico, inclusi a titolo esemplificativo e non esaustivo i grandi modelli linguistici, i modelli di riconoscimento vocale automatico e i modelli di sintesi vocale. Il Fornitore configurerà tutti i fornitori di modelli terzi in modalità a conservazione zero dei dati o senza logging per il tenant del Cliente e fornirà su richiesta un'attestazione scritta di tale configurazione."

Se il fornitore storce il naso davanti a questa clausola, i tuoi PHI stanno finendo nel corpus di addestramento di qualcuno.


SOC 2 Type II: cosa verificare oltre il bollino

Il bollino SOC 2 nel piè di pagina non significa nulla. Pretendi il report vero e proprio sotto NDA e leggi le parti che i fornitori sperano che tu salti.

Checklist per il report:

  • Type II, non Type I. Il Type I è una verifica di progettazione a una data precisa. Il Type II copre 6-12 mesi di efficacia operativa. Qualsiasi cosa di meno è teatro.
  • Trust Service Criteria coperti. Security è obbligatorio. Availability, Confidentiality e Processing Integrity dovrebbero rientrare tutti nel perimetro di una piattaforma di AI vocale che gestisce chiamate reali dei clienti.
  • Revisore. Una vera Big-4 o una società di revisione riconosciuta. Non un revisore da 5.000 dollari in stile catena di montaggio che emette report senza rilievi come se fosse una funzionalità.
  • Sezione delle eccezioni. Salta la lettera di presentazione. Vai alle eccezioni. Zero eccezioni in un Type II serio di solito significa che il perimetro è stato tracciato attorno al nulla. Una o due eccezioni ben documentate con il relativo piano di rimedio sono normali e sane.
  • Organizzazioni di sub-servizio. Cerca AWS, GCP e Azure elencati come carve-out con i propri SOC 2. Se il fornitore di LLM o l'operatore telefonico è un'organizzazione di sub-servizio, anche il suo SOC 2 dovrebbe essere richiamato.
  • Descrizione del perimetro. Verifica che il prodotto di AI vocale che stai comprando sia nominato nel perimetro. A volte i fornitori includono solo il sito di marketing o la dashboard, non il percorso di inferenza.

PCI DSS: come l'AI vocale cambia (o allarga) il tuo perimetro sulle chiamate di pagamento

È qui che la maggior parte delle implementazioni di AI vocale fa saltare in silenzio il perimetro PCI dell'acquirente. Nell'istante in cui chi chiama pronuncia 16 cifre, l'intero percorso — operatore telefonico, ASR, finestra di contesto dell'LLM, archivio delle trascrizioni, fornitore di observability — si trova dentro il Cardholder Data Environment.

Due architetture, due audit molto diversi:

SchemaChe fine fa il numero di cartaIl tuo perimetro PCI
AI vocale ingenuaL'ASR trascrive "4111 1111 1111 1111" nel contesto dell'LLM e nei tuoi logCDE completo: ASR, LLM, DB delle trascrizioni, pipeline dei log, data warehouse di BI
Soppressione DTMF / pausa e ripresaChi chiama viene passato a un tastierino IVR PCI DSS Level 1, agente e ASR vengono silenziati, torna indietro solo un tokenIl perimetro PCI del fornitore, non il tuo

Lo schema pausa e ripresa con mascheramento DTMF (a volte chiamato "soppressione dell'agent assist") riduce il tuo perimetro da "verificare l'universo" a "verificare l'integrazione".

Domande per l'acquirente:

  • Il mascheramento DTMF avviene a livello di SBC o a livello applicativo? A livello di SBC i toni non entrano affatto nel flusso media.
  • L'ASR riceve audio silenziato durante la finestra di acquisizione, oppure la sua trascrizione viene solo oscurata a posteriori? L'oscuramento a posteriori non è conforme a PCI: il dato ha già toccato il sistema.
  • Il fornitore ha un AOC PCI DSS v4.0.1 in corso di validità per il componente di acquisizione dei pagamenti? Chiedi l'AOC, non un comunicato stampa.
  • Le registrazioni della fase di pagamento vengono conservate, anche cifrate? PCI richiede che non siano conservate affatto se contengono SAD dopo l'autorizzazione.

GDPR + residenza UE: posizione dei dati, sub-responsabili, campanelli d'allarme nel DPA

Se anche solo un chiamante compone il numero dall'UE o dal Regno Unito, GDPR si applica a prescindere da dove sia la tua sede. Il fornitore di AI vocale è responsabile del trattamento (Article 28); la tua azienda è il titolare.

Il DPA deve specificare:

  • Sub-responsabili indicati per nome con le rispettive ubicazioni. "AWS" non basta: "AWS eu-central-1" sì.
  • Standard Contractual Clauses (moduli 2021) se qualche sub-responsabile si trova negli Stati Uniti, più un Transfer Impact Assessment.
  • Garanzia scritta di residenza dei dati. "UE per quanto possibile" non è residenza. Cerca un vincolo di regione a livello di tenant: audio, trascrizioni, embedding e indici vettoriali restano tutti in eu-west-1 / eu-central-1 / eu-north-1.
  • SLA di cancellazione. Cancellazione ai sensi dell'Article 17 di GDPR entro 30 giorni, propagata ai backup entro la finestra documentata di rotazione dei backup.
  • Notifica del cambio di sub-responsabile con un vero diritto di opposizione: almeno 30 giorni, non un "aggiorneremo la pagina".

Campanelli d'allarme nei DPA dei fornitori:

  • "I dati aggregati e anonimizzati possono essere utilizzati per migliorare i nostri servizi." I dati vocali sono raramente anonimizzabili davvero: le impronte vocali sono identificatori biometrici ai sensi dell'Article 9 di GDPR. Cancella questa clausola.
  • Data center solo negli Stati Uniti con un "siamo conformi a GDPR" ma senza SCC e senza TIA.
  • Elenco dei sub-responsabili nascosto dietro un login o un NDA. L'Article 28 richiede che sia a tua disposizione.

Rischi specifici della voce: conservazione delle registrazioni, impronte vocali biometriche, fuga di dati di addestramento

I framework di cui sopra sono stati scritti per il SaaS e i pagamenti. L'AI vocale aggiunge tre modalità di guasto che nessuno di essi copre del tutto:

1. Conservazione delle registrazioni. La conservazione predefinita sulla maggior parte delle piattaforme è di 30-90 giorni, a volte a tempo indeterminato. Insisti per una conservazione configurabile per tenant fino a 0 giorni (solo trascrizione, niente audio) e verifica che si tratti di cancellazione definitiva, non di flag di cancellazione logica.

2. Impronte vocali biometriche. Alcune piattaforme calcolano embedding del parlante (un vettore a 192 dimensioni che identifica una voce in modo univoco) per la diarizzazione o per il rilevamento delle frodi. Ai sensi dell'Article 9 di GDPR, di BIPA (Illinois) e della Texas CUBI, quel vettore è un dato biometrico con requisiti di consenso più stringenti di quelli previsti per i normali PII. Chiedi: le impronte vocali vengono generate?, dove sono conservate?, si possono disattivare per singolo tenant?

3. Fuga di dati di addestramento. Anche con un opt-out dall'addestramento dei modelli, a volte i fornitori usano trascrizioni oscurate per valutare le prestazioni del modello o per costruire set di valutazione. La "valutazione" può diventare una scappatoia. Fai in modo che la clausola copra qualsiasi uso a valle del modello, incluse le valutazioni e i dataset per l'ottimizzazione dei prompt.


Il questionario RFP scaricabile (15 domande)

Incolla queste domande nel tuo questionario per i fornitori. Le risposte sì/no costringono il fornitore a impegnarsi nero su bianco.

  1. Firmerete un BAA HIPAA che copra tutti i sub-responsabili, inclusi i fornitori di LLM, ASR e TTS?
  2. Fate girare l'LLM in modalità a conservazione zero dei dati / senza logging per il nostro tenant in modo predefinito?
  3. Vi impegnerete contrattualmente a non usare mai il nostro audio, le nostre trascrizioni e i payload delle chiamate agli strumenti per addestramento, messa a punto o valutazione dei modelli?
  4. Fornite il vostro report SOC 2 Type II più recente sotto NDA. Quali Trust Service Criteria rientrano nel perimetro?
  5. Il percorso di inferenza dell'AI vocale è esplicitamente nominato nella descrizione del perimetro SOC 2?
  6. Elencate tutte le eccezioni del SOC 2 Type II più recente e lo stato di rimedio di ciascuna.
  7. Fornite il vostro AOC PCI DSS v4.0.1 in corso di validità. Quale componente è certificato?
  8. Come vengono acquisiti i dati della carta di pagamento: soppressione DTMF a livello di SBC, mascheramento applicativo o oscuramento a posteriori?
  9. Le registrazioni delle fasi di pagamento vengono conservate in qualsiasi forma? Se sì, dove e per quanto tempo?
  10. Fornite un elenco dei sub-responsabili con le regioni fisiche dei data center di ciascuno.
  11. Audio, trascrizioni, embedding e indici vettoriali possono essere vincolati a una regione UE a livello di tenant?
  12. Qual è il vostro SLA di cancellazione ai sensi dell'Article 17 di GDPR, propagazione ai backup inclusa?
  13. Generate embedding del parlante o impronte vocali? Si possono disattivare per singolo tenant?
  14. Qual è il periodo minimo configurabile di conservazione delle registrazioni delle chiamate? Si può portare a zero?
  15. Fornite la sintesi di un recente penetration test di terza parte (degli ultimi 12 mesi) che copra il percorso di inferenza vocale.

Se un fornitore non riesce a rispondere a tutte e 15 per iscritto entro una settimana, il lavoro non l'ha ancora fatto — e stai pagando per essere il suo progetto di ricerca e sviluppo sulla conformità.


Domande frequenti

HIPAA basta per un'implementazione di AI vocale in ambito sanitario? No. HIPAA è necessario, non sufficiente. Servono anche SOC 2 Type II per i controlli della piattaforma, un penetration test aggiornato sul percorso di inferenza e la copertura biometrica a livello di singolo stato (BIPA, CUBI, Washington My Health My Data) se generi impronte vocali.

Un report SOC 2 Type II significa che il fornitore è conforme a GDPR? No. SOC 2 copre l'efficacia operativa dei controlli interni. GDPR è un regime giuridico che richiede un DPA, sub-responsabili indicati per nome, SCC per i trasferimenti e i diritti degli interessati. Un fornitore ha bisogno di entrambi, e i due report coprono superfici diverse.

Un fornitore di AI vocale può azzerare il mio perimetro PCI? Quasi, ma non esattamente a zero. Un fornitore con soppressione DTMF a livello di SBC e un AOC PCI Level 1 per il componente di acquisizione dei pagamenti ti porta nel territorio del SAQ A o del SAQ A-EP nella maggior parte delle implementazioni di pagamento telefonico. Restano tuoi l'integrazione e la scelta di instradamento delle chiamate.

Che cos'è la modalità a conservazione zero dei dati (ZDR) e perché conta? ZDR è una configurazione a livello di tenant presso il fornitore dell'LLM che disattiva il logging di prompt e completion. Senza di essa, le trascrizioni delle tue chiamate restano nei log del fornitore dell'LLM per almeno 30 giorni, il che manda a monte a valle sia gli impegni del BAA sia quelli del DPA.

FAQ JSON-LD: render this section as Question + Answer schema.org entities for the FAQPage type so the SERP gets the rich result. Standard Next.js MDX FAQ component on the blog already handles this — wrap the section in <FAQ> and the layout emits the JSON-LD.


Stai valutando un fornitore di AI vocale e sei stanco di pagine sulla sicurezza scritte dal marketing? Finn arriva con un BAA firmato, con SOC 2 Type II che include nel perimetro il percorso di inferenza, con soppressione DTMF a livello di SBC per PCI e con residenza UE a livello di tenant fin dal primo giorno. Mandaci il questionario di 15 domande qui sopra: rispondiamo in 48 ore, per iscritto, con le prove alla mano. Prenota una verifica di sicurezza da ufficio acquisti →


Revisore: Comitato umano / responsabile dei contenuti AGNB. Non pubblicare prima della revisione: al momento il passaggio di pubblicazione è manuale.

Correlato: Sicurezza dell'AI vocale: il modello di minaccia del livello audio

Digvijay Singh Shekhawat
Digvijay Singh Shekhawat

Founder, Finn AI

Digvijay sta costruendo Finn — il livello di orchestrazione vocale enterprise che ragiona durante le chiamate, estrae dati e aggiorna i tuoi sistemi in tempo reale. Scrive di AI vocale, go-to-market e di cosa serve per portare in produzione agenti autonomi su larga scala.

HIPAA, SOC 2, PCI: la checklist di conformità per l'AI vocale