AI-tietämyskannat ja luottamuksellisuus: 7 kysymystä, jotka jokaisen palveluntarjoajan tulisi esittää ennen asiakaskeskustelujen tallentamista
Asiakaskeskusteluja tallentava ja indeksoiva AI on tehokas—mutta vain, jos tiedät tarkalleen, kuka antaa suostumuksen, missä dataa säilytetään ja miten voit myöhemmin irtautua
Sisällysluettelo
- Miksi tämä artikkeli
- 1. Kuka antaa suostumuksen tallentamiseen—ja miten kirjaat sen?
- 2. Missä dataa fyysisesti säilytetään, ja mitä lakia sovelletaan?
- 3. Mikä malli käsittelee litteroinnit, ja käytetäänkö niitä koulutukseen?
- 4. Kuinka kauan säilytät tallenteita ja upotuksia, ja kuka voi poistaa ne?
- 5. Mitä audit-lokeja on saatavilla—voiko asiakas myöhemmin nähdä, mitä "hänen" keskustelulleen tapahtui?
- 6. Mikä on irtautumisstrategia? (Voitko viedä tietämyskannan avoimessa muodossa?)
- 7. Kuka on henkilötietojen käsittelijä, kuka rekisterinpitäjä, ja onko tämä dokumentoitu tietojenkäsittelysopimuksessa?
- TL;DR-tarkistuslista
- Mitä tämä tarkoittaa organisaatiollesi
Miksi tämä artikkeli
AI-tietämyskanta, joka tallentaa, litteroi ja tekee asiakaskeskusteluista haettavia, on palveluntarjoajille merkittävä tuottavuushyöty. Olemme aiemmin kirjoittaneet siitä, miten projektikohtaiset AI-tietämyskannat muuttuvat viimein älykkäiksi yrityksesi omasta tiedosta—mutta heti kun alat tallentaa ääntä, videota tai chattia, keskustelu siirtyy "hyödyllisestä työkalusta" "juridiseksi arvioinniksi".
Tämä artikkeli on seitsemän kysymyksen tarkistuslista, joihin sinun on pystyttävä vastaamaan ennen kuin otat käyttöön Symphorian (Wux Webtoolsin kumppani ja alusta, jota käytämme itse) kaltaisen työkalun tai vaihtoehtoisen ratkaisun. Kysymykset perustuvat GDPR:ään, EU:n tekoälysäädökseen, EDPB:n ohjeisiin sekä hollantilaisten palveluntarjoajien arjen käytäntöihin, joissa vaatimustenmukaisuus halutaan säilyttää pysäyttämättä työntekoa.
Konteksti: olet palveluntarjoaja—konsultti, kehittäjä, markkinointitoimisto, kirjanpitäjä—ja autat asiakkaita projekteissa, jotka kestävät kuukausia ja tuottavat kymmeniä keskusteluja. Haluat AI:n tiivistävän nämä keskustelut, poimivan toimenpiteet ja vastaavan kysymyksiin, kuten "mitä asiakas sanoi viime viikolla budjetista?". Se on mahdollista. Mutta ei ilman vastauksia näihin seitsemään kysymykseen.
1. Kuka antaa suostumuksen tallentamiseen—ja miten kirjaat sen?
GDPR edellyttää lainmukaista perustetta jokaiselle henkilötietojen käsittelylle (6 artikla). Keskustelujen tallentamiseen tarvitaan yleensä suostumus (6 artiklan 1 kohdan a alakohta) tai oikeutettu etu (6 artiklan 1 kohdan f alakohta). Suostumuksen on oltava ennakkoinen, yksilöity, tietoinen ja vapaaehtoisesti annettu (7 artikla). Tämä tarkoittaa: ei valmiiksi rastitettuja ruutuja, ei piilotettuja ehtolausekkeita käyttöehdoissa, eikä missään tapauksessa "tallennamme, ellet vastusta" -mallia.
Mitä haluat nähdä: Selkeä opt-in-hetki ennen ensimmäisen keskustelun tallentamista. Se voi olla valintaruutu projektin aloituksessa ("Hyväksyn kokousten tallentamisen projektidokumentaatiota ja AI-tukea varten"), suullinen vahvistus puhelun alussa ("Tämä puhelu tallennetaan sisäiseen tietämyskantaamme—hyväksytkö sen?") tai erillinen suostumussähköposti. Suostumus on kirjattava: kuka, milloin, mihin tarkoitukseen ja millä sanamuodolla.
Miten Symphoria ratkaisee tämän: Symphoria tarjoaa projektikohtaisen suostumuskerroksen. Ennen tallennuksen alkamista järjestelmä pyytää nimenomaisesti kaikilta osallistujilta suostumuksen. Suostumus tallennetaan aikaleiman ja IP-osoitteen kanssa, ja se voidaan peruuttaa projektikohtaisesti. Tämä helpottaa GDPR:n 7 artiklan 3 kohdan noudattamista ("suostumuksen peruuttamisen on oltava yhtä helppoa kuin sen antaminen").
2. Missä dataa fyysisesti säilytetään, ja mitä lakia sovelletaan?
Lähtökohtaisesti GDPR kieltää henkilötietojen siirrot ETA-alueen ulkopuolisiin maihin ilman asianmukaisia suojatoimia (44–50 artikla). Schrems II -tuomion (2020) jälkeen vakiolausekkeet (SCCs) eivät enää yksin riitä, jos vastaanottava osapuoli on valvontalainsäädännön, kuten Yhdysvaltojen FISA 702:n, piirissä. EU:n tekoälysäädös (2024) lisää vielä yhden kerroksen: korkean riskin AI-järjestelmien on täytettävä läpinäkyvyys- ja auditointivaatimuksia, joita on vaikea valvoa, jos dataa säilytetään EU:n ulkopuolella.
Mitä haluat nähdä: Selkeä ilmoitus siitä, missä dataa fyysisesti säilytetään (mikä datakeskus, mikä maa), millä alikäsittelijöillä on pääsy siihen ja kuuluvatko nämä osapuolet Euroopan ulkopuolisen valvontalainsäädännön piiriin. Ihannetapauksessa: säilytys EU:ssa palveluntarjoajalla, jolla ei ole yhdysvaltalaista emoyhtiötä tai joka tarjoaa nimenomaisesti "EU-only"-tilan.
Miten Symphoria ratkaisee tämän: Symphoria toimii kokonaan eurooppalaisessa infrastruktuurissa (AWS eu-west-1, Frankfurt) eikä käytä yhdysvaltalaisia alikäsittelijöitä litterointien säilyttämiseen tai käsittelyyn. Tämä helpottaa Schrems II:n noudattamista ilman monimutkaisia vaikutustenarviointeja.
3. Mikä malli käsittelee litteroinnit, ja käytetäänkö niitä koulutukseen?
Useimmat AI-tietämyskannat käyttävät ulkoista LLM:ää (OpenAI, Anthropic, Google) litterointien käsittelyyn. Tämä herättää kaksi kysymystä: (1) käytetäänkö litterointeja mallin kouluttamiseen? ja (2) kenellä on pääsy kehotteisiin ja vastauksiin? OpenAI:n API-ehdoissa on maaliskuusta 2023 lähtien todettu, että API:n kautta lähetettyä dataa ei käytetä koulutukseen—ellet nimenomaisesti liity erilliseen ohjelmaan. Tämä takuu ei kuitenkaan koske kaikkia palveluntarjoajia, eikä varsinkaan ilmaista tai "research"-käyttöä.
Mitä haluat nähdä: Nimenomainen ilmoitus siitä, että litterointeja ei käytetä mallin kouluttamiseen ja että käsittelyn jälkeen ne eivät enää ole LLM-palveluntarjoajan saatavilla. Tämän on sisällyttävä tietojenkäsittelysopimukseen, ei ainoastaan UKK-osioon. Lisäpisteet: alusta käyttää mallia, jota voit isännöidä itse (esim. Llama, Mistral), tai eurooppalaista palveluntarjoajaa, jolla on tiukka koulutuskieltoehto.
Miten Symphoria ratkaisee tämän: Symphoria käyttää OpenAI:n API:a Business Associate Agreement (BAA) -sopimuksella ja koulutuskieltoehdolla. Litteroinnit käsitellään API:n kautta, mutta OpenAI ei säilytä niitä eikä niitä sisällytetä tuleviin malliversioihin. Tämä todetaan nimenomaisesti alikäsittelijäluettelossa.
4. Kuinka kauan säilytät tallenteita ja upotuksia, ja kuka voi poistaa ne?
GDPR edellyttää, ettei henkilötietoja säilytetä pidempään kuin on tarpeen sitä tarkoitusta varten, johon ne on kerätty (5 artiklan 1 kohdan e alakohta: säilytyksen rajoittaminen). AI-tietämyskannan kohdalla tämä tarkoittaa, että sinun on pystyttävä selittämään, miksi kuuden kuukauden takainen tallenne on edelleen relevantti, ja sinulla on oltava prosessi vanhan datan poistamiseen. Tämä koskee myös johdettua dataa: upotukset (tekstin vektorimuotoiset esitykset) ovat henkilötietoja, jos ne voidaan jäljittää yksilöön.
Mitä haluat nähdä: Projektikohtaisesti määritettävä säilytysaika (esim. "poista tallenteet automaattisesti 12 kuukauden jälkeen"), painike, jolla projektipäällikkö voi poistaa tallenteen manuaalisesti, sekä takuu siitä, että poisto koskee myös upotuksia ja indeksejä—ei vain äänitiedostoa. Ihannetapauksessa: audit-loki, josta näkyy milloin jotain poistettiin ja kenen toimesta.
Miten Symphoria ratkaisee tämän: Symphoria tarjoaa projektikohtaisen "retention policy" -toiminnon. Voit määrittää, että tallenteet poistetaan automaattisesti X kuukauden jälkeen, mukaan lukien litteroinnit ja upotukset. Manuaalinen poisto on mahdollinen projektin käyttöliittymässä, ja jokainen poisto kirjataan audit-polkuun.
5. Mitä audit-lokeja on saatavilla—voiko asiakas myöhemmin nähdä, mitä "hänen" keskustelulleen tapahtui?
Läpinäkyvyys on GDPR:n keskeinen periaate (5 artiklan 1 kohdan a alakohta). Tämä tarkoittaa, että sinun on pystyttävä selittämään, mitä olet tehnyt jonkun datalla—myös jälkikäteen. AI-tietämyskannan kohdalla tämä tarkoittaa, että sinun on pystyttävä osoittamaan, mitä tallenteita tehtiin, kuka katsoi niitä, mitä hakuja tehtiin ja vietiinkö tai poistettiinko dataa. Ilman audit-lokeja et voi vastata näihin kysymyksiin, ja riskinä ovat sakot tietoturvaloukkauksen tai valituksen yhteydessä.
Mitä haluat nähdä: Projektikohtainen audit-loki, joka seuraa vähintään: (1) kuka aloitti tallennuksen, (2) kuka katsoi litterointia, (3) mitä kyselyjä tietämyskantaa vasten tehtiin, (4) vietiinkö dataa ja (5) poistettiinko dataa. Lokin on oltava haettavissa, ja se on säilytettävä vähintään 12 kuukautta (pidempään, jos toimit säännellyllä toimialalla).
Miten Symphoria ratkaisee tämän: Symphoria kirjaa kaikki toimet projektitasolla: tallenteet, katselut, kyselyt, viennit ja poistot. Nämä lokit ovat projektin omistajan saatavilla ja vietävissä CSV-muodossa. Tämä helpottaa tietopyyntöön vastaamista (GDPR:n 15 artikla) tai poikkeaman tutkimista.
6. Mikä on irtautumisstrategia? (Voitko viedä tietämyskannan avoimessa muodossa?)
Toimittajalukko on riski jokaisen SaaS-työkalun kohdalla, mutta AI-tietämyskannan kanssa se on erityisen kivulias: olet kerännyt kuukausien ajan keskusteluja, litterointeja ja metatietoja, ja jos et voi viedä niitä, menetät tämän tiedon. GDPR antaa oikeuden siirtää tiedot järjestelmästä toiseen (20 artikla), mutta se koskee vain dataa, jonka olet itse toimittanut—ei johdettua dataa, kuten upotuksia tai tiivistelmiä. Silti on viisasta edellyttää, että voit viedä kaiken muodossa, jonka voit tuoda toiseen palveluun.
Mitä haluat nähdä: Vientipainike, joka antaa sinulle vähintään: (1) kaikki ääni- tai videotiedostot, (2) kaikki litteroinnit pelkkänä tekstinä tai JSON-muodossa, (3) kaikki metatiedot (aikaleimat, osallistujat, tagit) ja (4) ihannetapauksessa myös upotukset avoimessa muodossa, kuten Parquet tai JSONL. Lisäpisteet: vienti on automatisoitu ja ajastettavissa (esim. viikoittainen varmuuskopio omaan S3-säilöösi).
7. Kuka on henkilötietojen käsittelijä, kuka rekisterinpitäjä, ja onko tämä dokumentoitu tietojenkäsittelysopimuksessa?
GDPR erottaa toisistaan rekisterinpitäjän (osapuoli, joka määrittää, miksi ja miten henkilötietoja käsitellään) ja käsittelijän (osapuoli, joka käsittelee dataa rekisterinpitäjän puolesta). Palveluntarjoajana olet yleensä rekisterinpitäjä, ja AI-tietämyskanta on käsittelijä. Tämä tarkoittaa, että tarvitset tietojenkäsittelysopimuksen (GDPR:n 28 artikla), jossa määritellään täsmällisesti, mitä käsittelijä saa tehdä, kuinka kauan, minkä alikäsittelijöiden kanssa ja mitä tapahtuu tietoturvaloukkauksen sattuessa.
Mitä haluat nähdä: Data Processing Agreement (DPA), joka täyttää GDPR:n 28 artiklan 3 kohdan vaatimukset. Sen on sisällettävä vähintään: (1) käsittelyn kohde ja kesto, (2) käsittelyn luonne ja tarkoitus, (3) henkilötietojen tyyppi ja rekisteröityjen ryhmät, (4) rekisterinpitäjän oikeudet ja velvollisuudet, (5) luettelo alikäsittelijöistä ja (6) menettely tietoturvaloukkauksia varten. Sopimus on allekirjoitettava ennen tallentamisen aloittamista.
Miten Symphoria ratkaisee tämän: Symphoria tarjoaa vakiomuotoisen DPA:n, joka täyttää GDPR:n 28 artiklan vaatimukset. Voit allekirjoittaa sen alustan käyttöliittymässä, ja se päivittyy automaattisesti, kun uusi alikäsittelijä lisätään. Tämä helpottaa vaatimustenmukaisena pysymistä ilman, että lakitiimiä tarvitsee ottaa mukaan joka kerta.
TL;DR-tarkistuslista
- Suostumus: Kirjaa ennakkoinen, yksilöity suostumus—aikaleiman ja opt-out-mahdollisuuden kanssa.
- Säilytys: Tarkista, säilytetäänkö data EU:ssa eikä siihen sovelleta Euroopan ulkopuolista valvontalainsäädäntöä.
- Koulutus: Vaadi nimenomainen takuu siitä, ettei litterointeja käytetä mallin koulutukseen.
- Säilytysaika: Aseta säilytysaika ja varmista, että poisto koskee myös upotuksia.
- Auditointi: Edellytä lokit siitä, kuka katsoi, kyseli ja poisti mitäkin.
- Vienti: Tarkista, voitko viedä kaiken datan avoimessa muodossa.
- DPA: Allekirjoita tietojenkäsittelysopimus ennen tallentamisen aloittamista.
Mitä tämä tarkoittaa organisaatiollesi
Jos pystyt vastaamaan näihin seitsemään kysymykseen, olet hyvällä tiellä. Huomaa kuitenkin: vaatimustenmukaisuus ei ole kertaluonteinen tarkistuslista. GDPR edellyttää, että varmistat säännöllisesti vaatimusten täyttymisen (24 artikla: "asianmukaiset tekniset ja organisatoriset toimenpiteet"), ja EU:n tekoälysäädös tuo korkean riskin järjestelmiin vielä yhden kerroksen. Tämä tarkoittaa: määräaikaisia auditointeja, DPIA-arviointeja uusille käyttötapauksille sekä prosessia tietopyyntöihin ja tietoturvaloukkauksiin vastaamiseksi.
Haluatko nähdä, miten tämä toimii käytännössä? Lue viikko AI-tietämyskannan kanssa: miten se muuttaa projektipäällikön työtä palveluntarjoajalla—narratiivinen tapaus, jossa näytämme tarkalleen, miten nämä kysymykset nousevat esiin arjen käytännöissä.
Keskeinen opetus: AI-tietämyskannasta tulee tuottavuushyöty vain, jos säilytät asiakkaidesi luottamuksen. Ja ansaitset sen luottamuksen esittämällä nämä kysymykset—ja pystymällä vastaamaan niihin—ennen kuin painat "record".
Usein kysytyt kysymykset
Tarvitseeko minun tehdä DPIA ennen AI-tietämyskannan käyttöönottoa?
Kuka on vastuussa tietoturvaloukkauksesta: minä vai AI-palveluntarjoaja?
Saanko tehdä tallenteita ilman suostumusta, jos kyse on sisäisistä kokouksista?
Entä jos asiakas peruuttaa suostumuksensa jälkikäteen?
Saanko jakaa litterointeja kolmansille osapuolille (esim. projektissa työskenteleville freelancereille)?
Entä EU:n tekoälysäädös—kuuluuko AI-tietämyskanta 'korkean riskin' piiriin?
Lähteet ja lisälukeminen
- Algemene Verordening Gegevensbescherming (AVG) — Volledige tekst
- EU AI Act — Verordening (EU) 2024/1689
- EDPB Guidelines 05/2020 on consent under Regulation 2016/679
- Autoriteit Persoonsgegevens — Toestemming vragen
- Schrems II: CJEU judgment C-311/18 (Data Protection Commissioner v Facebook Ireland and Maximillian Schrems)
- CNIL — Transferts de données hors UE