Varför är frågan svårare för AI än för vanliga system?

Ett traditionellt systemköp har få led. Data ligger hos leverantören, eller hos den molnleverantör de använder, och det går att rita på en servett.

En AI-funktion har nästan alltid fler. Det finns ett gränssnitt någonstans, en applikation som hanterar logiken, en modell som anropas, ofta en tjänst för sökning eller lagring av inbäddad text, och inte sällan ett verktyg för loggning och felsökning som ser innehållet på vägen förbi.

Varje led är en plats där uppgifter passerar. Det är inte dramatiskt i sig, men det betyder att frågan "var ligger vår data" har flera svar, och att den som svarar med ett enda svar antagligen bara har tänkt på det första ledet.

Checklistan nedan är ordnad efter hur ofta svaret saknas, inte efter hur viktigt det låter.

Var lagras och behandlas uppgifterna?

Be om två separata svar, för de är olika saker.

Lagring är var uppgifterna vilar: databasen, filerna, säkerhetskopiorna. Behandling är var de passerar när något händer: vilken region modellen anropas i, var loggarna hamnar, var supportpersonalen sitter när de felsöker.

Ett system kan ha all lagring i Sverige och ändå behandla varje förfrågan någon annanstans. Det är ett vanligt och ofta helt hanterbart upplägg, men det ska vara ett medvetet val och det ska stå i avtalet.

Fråga också efter säkerhetskopiorna. De glöms nästan alltid och de ligger ofta någon annanstans än produktionsdatan.

Vem är personuppgiftsbiträde, och vad står i avtalet?

Om leverantören behandlar personuppgifter för er räkning ska det finnas ett personuppgiftsbiträdesavtal. Det är inget formkrav att bocka av, det är dokumentet som avgör vad de får och inte får göra.

Fyra punkter är värda att läsa själv, även om resten går till juristen:

  • Vad får uppgifterna användas till, utöver att leverera tjänsten?
  • Får de användas för att förbättra eller träna leverantörens egna modeller?
  • Hur lång tid sparas de, och vad händer när avtalet upphör?
  • Vilka säkerhetsåtgärder är faktiskt utlovade, i konkreta ord?

Den andra punkten är den som oftast är otydlig i AI-sammanhang, och den som är svårast att backa ur i efterhand.

Vilka underbiträden finns i kedjan?

Det här är frågan som brukar ta längst tid att få svar på, och den som avslöjar mest.

Be om en lista, inte en formulering. Listan ska innehålla varje part som kan komma i kontakt med uppgifterna: molnleverantören, modellleverantören, eventuell söktjänst, verktyg för loggning och övervakning, och den som sköter support.

Två följdfrågor är värda att ställa direkt. Hur får ni veta när ett underbiträde byts ut eller läggs till? Och har ni rätt att invända?

Ligger något led utanför EU eller EES är det en tredjelandsöverföring, och då krävs en rättslig grund för den överföringen utöver biträdesavtalet. Integritetsskyddsmyndigheten beskriver vilka skyddsåtgärder som räknas. Det är inte ett hinder, men det är ett beslut någon ska ha fattat medvetet.

En leverantör som har ordning på det här svarar med ett dokument. En som inte har det svarar med en mening om att allt ligger i EU, vilket kan vara sant om det första ledet och fortfarande vara ofullständigt.

Fyra led i kedjan: ni som personuppgiftsansvarig, leverantören som personuppgiftsbiträde, underbiträdet som sköter drift och lagring, och modellleverantören längst ut Ni personuppgiftsansvarig Leverantören personuppgiftsbiträde, skriftligt avtal Underbiträde drift, lagring, säkerhetskopior Modellleverantör ledet som saknas i svaret
Kedjan i ett AI-flöde. Det sista ledet är det som oftast saknas när någon svarar att data ligger i EU.

Vad raderas, när, och vem kan beställa det?

Tre olika saker göms i den här frågan.

Det första är radering på begäran: en enskild person hör av sig och vill bli borttagen. Kan ni verkställa det i alla led, inklusive i loggar och säkerhetskopior, och hur lång tid tar det?

Det andra är radering vid avtalets slut. Vad händer med allt när ni slutar, och får ni ett kvitto på att det är gjort?

Det tredje är det som samlas på vägen utan att någon bestämde det: promptloggar, felsökningsspår, mellanlagrade svar. De har en livslängd också, och den är ofta satt av en standardinställning ingen har tittat på.

Vad ska stå skriftligt innan driftsättning?

Kort lista, att stämma av mot innan systemet går live. Den hör ihop med de fem frågorna att ställa en leverantör: den här listan är vad ni ber om skriftligt, de fem frågorna är vad ni lyssnar efter på mötet.

PunktVad som ska finnasVanligaste luckan
LagringRegion, för både data och säkerhetskopiorSäkerhetskopiorna saknas i svaret
BehandlingVar anrop och felsökning skerAntas vara samma som lagringen
BiträdesavtalUndertecknat, med träning regleradTräningsfrågan otydlig
UnderbiträdenLista, plus rutin för ändringarModellleverantören saknas
RaderingPå begäran och vid avslut, med tidLoggar och kopior glöms

Ingen av de här punkterna kräver att ni förstår tekniken. De kräver att någon har ställt frågan innan systemet togs i drift, vilket är betydligt enklare att ordna före driftsättning än efteråt.

Vad ska du ta med dig?

Fyra svar, skriftligt, före driftsättning: var uppgifterna ligger och behandlas, vilket biträdesavtal som gäller, vilka underbiträden som finns, och vad som raderas när.

Den tredje är den som avgör. Ett AI-flöde har fler led än ett vanligt systemköp, och det är det yttersta ledet, oftast modellleverantören, som ingen har läst villkoren för. Fråga efter listan tidigt. En leverantör som har den färdig har gjort det här förut. Reglerna kring själva AI-användningen är en separat fråga.

Vanliga frågor

Vad ska vi göra med data som redan har skickats in i ett AI-system?

Ta reda på om den används för att träna modeller och om det går att stänga av. Många leverantörer har det avstängt för företagskunder som standard, men det ska stå skriftligt, inte antas.

Behöver vi göra en konsekvensbedömning?

Det beror på behandlingen, inte på tekniken. Ett system som behandlar känsliga uppgifter eller fattar beslut med rättslig verkan för enskilda ligger nära gränsen. Diskutera det med den som ansvarar för dataskydd hos er innan bygget börjar, inte efter.

Vem ansvarar om leverantörens underleverantör läcker data?

Som personuppgiftsansvarig har ni ett ansvar mot de registrerade oavsett var i kedjan felet uppstod. Det är därför kedjan ska vara känd och reglerad i avtal innan systemet går i drift.

Källor

  1. IMY: Personuppgiftsbiträdesavtal, vad det ska innehålla. Integritetsskyddsmyndigheten, tillsynsmyndighet för dataskydd i Sverige
  2. IMY: Att tänka på som personuppgiftsbiträde, inklusive underbiträden
  3. IMY: Överföring av personuppgifter till tredjeland