selitetty.com

Tekoäly ja yksityisyys

Keskusteluhistoria ja muisti: mitä tekoäly säilyttää sinusta

Tekoälyassistentin muisti ei ole mallin sisällä vaan tavallisessa tietokannassa. Siksi sen voi lukea ja tyhjentää, mutta siksi myös poisto ulottuu vain osaan tallennetusta.

Lyhyt vastaus

Tekoälypalvelu säilyttää sinusta tietoa kolmessa toisistaan riippumattomassa paikassa: keskustelulokissa, erillisessä muistissa ja teknisissä lokeissa. Keskustelut ja muistimerkinnät voit yleensä lukea ja poistaa itse asetuksista, ja poisto tehoaa niihin oikeasti. Mallin painoihin, väärinkäytön valvontalokeihin ja varmuuskopioihin poistonappi ei ulotu, koska ne ovat eri järjestelmiä eri tarkoituksella.

Sisällys
  1. Sinusta oleva tieto on viidessä paikassa, ei yhdessä
  2. Muisti ei ole konteksti-ikkuna, vaikka ne näyttävät samalta
  3. Miten muistitoiminto päättää, mitä sinusta kannattaa poimia
  4. Näin tarkistat ja siivoat muistin
  5. Muisti muuttaa vastauksia myös huomaamatta
  6. Väliaikainen keskustelu tekee vähemmän kuin nimi lupaa
  7. Miksi poisto ei ulotu varmuuskopioihin ja valvontalokeihin
  8. Kolme kysymystä ennen kuin päästät tiedon muistiin
  9. Usein kysytyt kysymykset
  10. Lähteet ja lisälukemista

Kun tekoälyassistentti sanoo muistavansa, että asut pääkaupunkiseudulla ja kirjoitat työksesi tarjouksia, tieto ei ole mallin sisällä. Se on tavallisessa tietokannassa lyhyenä tekstirivinä, ja se liitetään keskustelun alkuun joka kerta kun avaat uuden ikkunan. Tämä ero ratkaisee kaiken muun: koska muisti on tekstiä eikä osa mallia, sen voi näyttää sinulle, sen voi muokata ja sen voi poistaa.

Julkisessa keskustelussa muisti, keskusteluhistoria ja mallin opettaminen menevät jatkuvasti sekaisin. Ne ovat kolme eri asiaa, joilla on eri säilytysaika, eri poistotapa ja eri riski. Tämä artikkeli käsittelee tallennuspaikkoja ja niiden tyhjentämistä. Yleinen kuvaus siitä, mitä tiedoillesi tapahtuu palvelimella, on artikkelissa tekoäly ja tietosuoja, ja opetuskäytön estäminen omana toimenpiteenään artikkelissa näin estät tietojesi käytön opettamiseen.

Sinusta oleva tieto on viidessä paikassa, ei yhdessä

Kun mietit mitä palvelu tietää sinusta, kannattaa erottaa tallennuspaikat toisistaan. Ne käyttäytyvät eri tavalla, ja poistopyyntö tehoaa niihin eri tavalla.

Paikka Mitä siellä on Miten pääset käsiksi
Keskusteluloki Viestit sellaisina kuin ne kirjoitit, liitteineen Näet ja poistat tililläsi keskustelu kerrallaan
Muisti Lyhyitä väitteitä sinusta ja tavoistasi Näet listana asetuksissa, poistat rivi kerrallaan
Mallin painot Ei mitään sinusta, ellei tietosi ole päätynyt opetusaineistoon Ei luettavissa eikä poistettavissa
Tekniset lokit ja valvonta Pyynnöt, aikaleimat, merkinnät epäillystä väärinkäytöstä Ei käyttäjän hallinnassa, poistuu säilytysajan päätyttyä
Varmuuskopiot Tilannekuva tietokannasta poistohetkeä edeltävältä ajalta Ei käyttäjän hallinnassa, korvautuu kopiokierron edetessä

Kolme ensimmäistä riviä ovat niitä, joista käyttäjä yleensä puhuu. Kaksi viimeistä ovat niitä, jotka selittävät, miksi poisto ei tunnu tapahtuvan välittömästi. Mikään näistä ei ole poikkeuksellista tekoälypalveluille, vaan sama rakenne on jokaisessa pilvipalvelussa, jossa on käyttäjätili ja tuotantokäytön vaatima ylläpito.

Muisti ei ole konteksti-ikkuna, vaikka ne näyttävät samalta

Konteksti-ikkuna on se määrä tekstiä, jonka malli pystyy ottamaan huomioon yhdellä kertaa. Se on tekninen kapasiteettiraja, ja se tyhjenee joka kerta kun avaat uuden keskustelun. Muisti taas on pysyvä tekstitiedosto tilisi takana. Kun aloitat uuden keskustelun, palvelu liittää muistin sisällön näkymättömästi viestisi eteen, jolloin se kuluttaa konteksti-ikkunaa aivan kuten mikä tahansa kirjoittamasi teksti.

Tästä seuraa kaksi käytännön asiaa. Ensinnäkin pitkä muisti syö tilaa varsinaiselta tehtävältä, mikä selittää osan siitä ilmiöstä, että pitkissä istunnoissa malli alkaa sivuuttaa ohjeita. Ilmiön mekanismi on selitetty artikkelissa konteksti-ikkuna. Toiseksi muisti ei ole mystinen ominaisuus vaan luettavaa tekstiä, joten kysymys "mitä sinä tiedät minusta" antaa yleensä rehellisen vastauksen, koska malli lukee sen samasta paikasta kuin sinäkin.

Mallin painot ovat kolmas taso. Ne ovat lukossa käytön aikana: yksittäinen keskustelu ei muuta niitä lainkaan. Malli ei siis "opi" sinusta kesken keskustelun, vaan se lukee muistin ja unohtaa sen heti kun istunto päättyy.

Miten muistitoiminto päättää, mitä sinusta kannattaa poimia

Muistin täyttyminen tapahtuu kahta reittiä. Suoraan pyytämällä: kirjoitat että vastaukset saa antaa suomeksi ja tiiviisti, ja pyyntö tallentuu. Toinen reitti on automaattinen poiminta, jossa malli itse arvioi, mikä keskustelun tieto on pitkäkestoisesti hyödyllistä. Juuri jälkimmäinen yllättää.

Automaattinen poiminta ei erottele sitä, kerroitko asian itsestäsi vai jostakusta toisesta. Jos liität sähköpostin, jossa kollegasi kertoo sairauspoissaolostaan, poiminta voi tulkita tiedon keskustelun kannalta olennaiseksi. Se ei myöskään erottele hetkellistä pysyvästä: yhden kerran mainittu projekti voi jäädä muistiin kuukausiksi ja vinouttaa vastauksia tehtävissä, joihin se ei liity.

Kolmas ongelma on päätelmien jäykkyys. Malli voi kirjata muistiin päätelmän, jota et koskaan sanonut, esimerkiksi ammattisi tai perhetilanteesi. Päätelmä ei korjaannu itsestään, koska se luetaan jokaisen uuden keskustelun alussa tosiasiana. Korjaus tapahtuu vain poistamalla merkintä käsin.

Muisti ei ole muisto vaan muistiinpano, jonka joku muu on kirjoittanut sinusta ja jonka voit lukea.

Näin tarkistat ja siivoat muistin

Tee tämä ensimmäisen kerran rauhassa, sen jälkeen se vie muutaman minuutin.

  1. Avaa asetukset ja etsi kohta, jonka nimessä on muisti, personointi tai mukauttaminen. Nimitys vaihtelee palveluittain, mutta se on lähes aina käyttäjätilin eikä keskustelun asetuksissa.
  2. Lue lista kokonaan läpi. Muistimerkinnät ovat lyhyitä lauseita. Kiinnitä huomiota siihen, mitä sinusta on päätelty ilman että kerroit sitä.
  3. Poista virheelliset ja arkaluonteiset merkinnät yksitellen. Terveyteen, vakaumukseen, talouteen ja toisten ihmisten asioihin liittyvät rivit kuuluvat pois riippumatta siitä, ovatko ne oikein.
  4. Tyhjennä koko muisti, jos lista on sekava. Se on nopeampaa kuin yksitellen siivoaminen, ja hyödylliset ohjeet voi kirjoittaa uudelleen.
  5. Poista keskusteluhistoria erikseen. Muistin tyhjennys ei poista vanhoja keskusteluja, ja vanhoista keskusteluista muisti voidaan periaatteessa rakentaa uudelleen.
  6. Tarkista lopputulos kysymällä. Kysy assistentilta, mitä se tietää sinusta. Jos se toistaa poistamasi tiedon, muisti ei tyhjentynyt tai tieto tulee samassa keskustelussa aiemmin kirjoitetusta tekstistä.

Jos käytät samaa tiliä työ- ja yksityisasioihin, kannattaa erottaa ne joko kahdelle tilille tai vähintään kytkeä muisti pois työkäytössä. Työtehtävien aineistoon liittyvät säännöt on käyty läpi artikkelissa tekoäly työpaikalla.

Muisti muuttaa vastauksia myös huomaamatta

Muistin tietoturvapuoli on helppo hahmottaa, mutta sen laatuvaikutus jää usein huomaamatta. Malli ei erottele muistista luettua tietoa siitä, minkä kirjoitit juuri äsken. Molemmat ovat sille samaa tekstiä saman kehotteen sisällä. Siksi vanhentunut merkintä ei näy virheilmoituksena vaan hienovaraisena vinoumana vastauksissa.

Tyypillinen esimerkki on ammatti tai toimiala. Jos muistiin on kirjattu, että työskentelet markkinoinnissa, malli suodattaa neuvojaan sen läpi silloinkin, kun kysyt jotain aivan muuta. Vastaus ei ole väärä, mutta se on kavennettu. Sama koskee kieltä ja tyyliä: kerran pyydetty tiivis muoto voi jäädä voimaan tilanteeseen, jossa tarvitsisit perustelut auki kirjoitettuina.

Toinen vaikutus on kehämäinen. Kun malli tietää mieltymyksesi, se tuottaa niiden mukaisia vastauksia, ja sinä vahvistat niitä jatkokysymyksillä. Lopputulos on kapeampi näkymä kuin mihin malli pystyisi. Tämä on sukua sille tapahtumaketjulle, joka tekee tekoälystä myötäilevän: mekanismi on selitetty artikkelissa miksi tekoäly on aina samaa mieltä.

Käytännön korjaus on yksinkertainen. Jos vastaus tuntuu oudon kapealta tai olettaa sinusta jotain, avaa uusi keskustelu väliaikaisessa tilassa ja kysy sama asia uudelleen. Ero kertoo, kuinka paljon muisti ohjasi vastausta.

Väliaikainen keskustelu tekee vähemmän kuin nimi lupaa

Useimmissa assistenteissa on tila, jossa keskustelua ei tallenneta historiaan eikä siitä poimita muistia. Se on hyödyllinen, mutta sen kattavuus ymmärretään usein väärin. Väliaikainen keskustelu vastaa selaimen yksityistä selausta: se estää jäljen jäämisen omaan päätelaitteeseen ja omaan tiliin, ei tiedon kulkua ulos.

Väliaikaisessakin tilassa teksti lähetetään palvelimelle, käsitellään siellä selväkielisenä ja kirjataan teknisiin lokeihin. Väärinkäytön automaattinen valvonta koskee sitä samalla tavalla kuin muitakin keskusteluja. Palvelut kertovat yleensä säilyttävänsä myös väliaikaiset keskustelut lyhyen määräajan juuri tästä syystä.

Väliaikainen tila kannattaa siis ajatella suojana uteliailta silmiltä ja muistin saastumiselta, ei suojana palveluntarjoajaa vastaan. Arkaluonteista tietoa ei kannata liittää kumpaankaan tilaan.

Miksi poisto ei ulotu varmuuskopioihin ja valvontalokeihin

Kun poistat keskustelun, se merkitään poistetuksi tuotantotietokannassa ja häviää näkyvistä. Varmuuskopiot ovat kuitenkin erillisiä tilannekuvia, jotka on otettu ennen poistoa. Niitä ei muokata jälkikäteen, koska muokattu varmuuskopio ei enää palauttaisi järjestelmää eheään tilaan. Tieto häviää niistä vasta, kun kopio vanhenee ja korvautuu kierrossa. Sama periaate koskee kaikkea tietokantojen varmuuskopiointia, ei vain tekoälypalveluita.

Toinen poikkeus on väärinkäytön valvonta. Palveluilla on velvollisuus estää palvelunsa käyttö esimerkiksi vahingoittavaan tai laittomaan toimintaan, ja siihen tarvitaan lokia siitä, kuka teki mitä ja milloin. Jos keskustelu on merkitty epäilyttäväksi, se voidaan säilyttää tutkintaa varten pidempään kuin tavallinen keskustelu, eikä käyttäjän poistotoiminto ulotu siihen.

Kolmas poikkeus on laki. Tietosuoja-asetus antaa oikeuden tietojen poistamiseen, mutta oikeus ei ole ehdoton: säilyttämiselle voi olla lakisääteinen peruste tai oikeusvaateen laatimiseen liittyvä tarve. Rekisteröidyn oikeuksien rajat on käsitelty artikkelissa GDPR ja rekisteröidyn oikeudet. Käytännössä tämä tarkoittaa, että poistonappi tekee sen, minkä se lupaa, mutta lupaus koskee näkyvää dataa eikä koko järjestelmää.

Kolme kysymystä ennen kuin päästät tiedon muistiin

Muisti on hyödyllinen ominaisuus. Se säästää toistoa ja parantaa vastauksia, kun malli tietää työsi luonteen ja haluamasi tyylin. Rajanveto kannattaa tehdä sisällön eikä ominaisuuden perusteella.

  • Haluaisitko tämän tiedon näkyvän ruudulla, jos joku katsoo olkasi yli? Muistin sisältö voi ilmestyä vastaukseen milloin tahansa, myös jaetulla näytöllä kokouksessa.
  • Onko tieto sinun kerrottavanasi? Toisen ihmisen terveydentila, palkka tai perhesuhteet eivät kuulu muistiin, vaikka olisit itse ne kuullut.
  • Vanheneeko tieto? Työnantaja, asuinpaikka ja meneillään oleva projekti muuttuvat. Vanhentunut muistimerkintä ei ole vain hyödytön, se ohjaa vastauksia väärään suuntaan.

Käytännön nyrkkisääntö on pitää muistissa vain työtapoja koskevia ohjeita ja poistaa kaikki, mikä kuvaa henkilökohtaista elämäntilannetta. Ohjeet paranevat, riski ei kasva. Jos haluat tietää tarkasti, mitä palvelu on sinusta tallentanut, voit tehdä sille tietopyynnön omista tiedoista, jolloin vastauksen pitää kattaa myös ne tallennuspaikat, joita käyttöliittymä ei näytä.

Usein kysytyt kysymykset

Poistuuko muisti, jos poistan kaikki keskustelut?

Ei automaattisesti. Muisti ja keskusteluhistoria ovat eri tietokantoja ja niillä on omat poistotoimintonsa. Poista molemmat erikseen, jos haluat aloittaa puhtaalta pöydältä.

Näkeekö toinen käyttäjä muistini, jos käytämme samaa laitetta?

Muisti on sidottu käyttäjätiliin, ei laitteeseen. Jos olet kirjautuneena ja toinen käyttää samaa istuntoa, hän näkee saman muistin ja voi saada vastauksia, joihin se vaikuttaa. Jaetulla laitteella kannattaa kirjautua ulos tai käyttää selaimen erillistä profiilia.

Voiko malli kertoa muistin sisällön toiselle käyttäjälle?

Ei suoraan, koska muisti liitetään vain sinun istuntoosi. Riski koskee tilanteita, joissa jaat keskustelulinkin tai kuvakaappauksen, jolloin muistista peräisin oleva tieto voi olla vastauksen sisällä.

Mitä eroa on muistilla ja järjestelmäkehotteella?

Järjestelmäkehote on palveluntarjoajan tai sinun asettamasi pysyvä ohje siitä, miten malli käyttäytyy. Muisti on kokoelma tietoja sinusta, joita malli on itse poiminut tai jotka olet pyytänyt tallentamaan. Molemmat liitetään keskustelun alkuun, mutta muistia voit lukea ja muokata rivi riviltä.

Käytetäänkö muistiin tallennettuja tietoja mallin opettamiseen?

Se riippuu palvelun ehdoista ja tilin tyypistä, ei muistitoiminnosta itsestään. Muisti on tallennus, opetuskäyttö on erillinen asia, joka kytketään päälle tai pois omasta asetuksestaan.

Kuinka kauan poistettu keskustelu on vielä olemassa?

Näkyvistä se häviää heti, mutta varmuuskopioista ja lokeista se poistuu vasta säilytysajan kuluttua. Säilytysajat kerrotaan palvelun tietosuojaselosteessa, ja ne ovat tyypillisesti viikkoja tai kuukausia, eivät vuosia.

Kannattaako muisti kytkeä kokonaan pois?

Kannattaa, jos käytät assistenttia vaihtelevissa tehtävissä tai työaineiston kanssa, koska silloin muisti tuottaa enemmän sekaannusta kuin hyötyä. Yhteen toistuvaan käyttötarkoitukseen muisti on hyödyllinen, kunhan tarkistat sen sisällön säännöllisesti.

Takaisin ylös