Ajatusjohtajat

Kun neuvonantaja on botti. Keskonnan AI ilman ihmisten murtamista.

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Mikä ei ole mahdollista tehdä AI: lla? Kysymme siltä, miten voimme käyttää rahoituksemme viisaasti, ja se kertoo meille verotuotteista. Kysymme siitä suhteista, ja se tarjoaa empatiaa, joka on muotoiltu mallintamisen kautta. Kysymme siitä, mitä tehdä elämällämme kello 2 aamulla, ja se antaa meille vastauksen… koska se on suunniteltu tekemään niin.

Nouseva huolenaihe ei ole näiden työkalujen epäonnistuminen, vaan heidän sujuvuutensa. Ne ovat niin vakuuttavasti varmoja, että se, mitä on suunniteltu tukemaan meitä, voi tarpeeksi varmuuden ja toistuvuuden myötä alkaa vääristää, miten ajattelemme, tuntelemme ja toimimme tavoilla, joita emme koskaan suunnitelleet.

Otsikot vilkkuvat punaisella. OpenAI paljasti äskettäin, että jokaisena viikkona satoja tuhansia ChatGPT-käyttäjiä voi osoittaa vakavan emotionaalisen ahdistuksen merkkejä, mukaan lukien itsetuhoisia ajatuksia. Samaan aikaan mielenterveysammattilaiset varoittavat “ilmiöstä, jossa käyttäjät kehittävät harhaluuloja tai riippuvuutta pitkien, emotionaalisesti latautuneiden chatbot-keskustelujen kautta. Yhdysvaltain osavaltiot rajoittavat jo bottien käyttöä terapiassa tämän seurauksena.

Nämä tarinat häiriköivät meitä, koska ne haastavat perusoletuksen, että AI on vain työkalu. Kun neuvonantaja muuttuu luottomieheksi tai tuntuu ystävältä, mitä tapahtuu oikealle ihmiskontaktille?

Kehittäjät eivät enää luo vain viihdyttäviä ominaisuuksia; he muokkaavat vuorovaikutuksia, jotka voivat vaikuttaa siihen, miten ihmiset tuntevat ja ajattelevat. Tämän vuoksi on tärkeää suunnitella keskustelupalveluja, jotka tarjoavat arvoa ilman ihmisten mielenterveyden heikentämistä.

1.   Määritä tarkoitus

Äskettäinen Harvardin tutkimus varoittaa, että keskustelubotit taipuvat yhtymään asiakkaiden kanssa, vaikka asiakkaat ovat väärässä, koska tämä tyyppi vahvistusta pitää asiakkaat mukana. Kuitenkin se myös avaa ovet “sopulalle” vahvistamiselle. Jos chatbotti ei ole tarkoitettu terapeuttiseksi tai läheiseksi ystäväksi, sinun pitäisi vastustaa sen suunnittelua antamaan sellaista tasoa emotionaalista vahvistusta.

Ensimmäinen askel on tarkoituksenmukaisuus: määritellä tarkasti, mitä bottisi on tarkoitettu tekemään ja mitä se pitäisi välttää. Onko se asiakastukipalvelu, tuottavuusopas, uracoach, rahoitusavustaja, keskustelukumppani, reseptiluojan, tai muu? Selkeä määrittely tässä vaiheessa piirtää rajoja, jotka pitävät järjestelmän pois ei-toivottujen alueiden ulottuvilta.

Keskustelutyypit, kuten avoimet, henkilökohtaiset ja epähenkilökohtaiset, ja modaalisuudet kuten ääni tai teksti, vaikuttavat emotionaaliseen ja ongelmalliseen käyttöön. Tutkimus osoittaa, että suuri päivittäinen käyttö on korreloitunut suuremman yksinäisyyden ja riippuvuuden kanssa.

Kehittäjien on kysyttävä itseltään: Miten säilytetään keskustelut avoimina tarpeeksi hyödyllisiksi, mutta suljettuina tarpeeksi välttääkseen emotionaalisen sekaantumisen? Esimerkiksi asiakastukibotti voi sallia avoimet selitykset asiakkaan ongelmasta, mutta välttää emotionaalisesti vahvistavia lauseita, kuten “Tuo kuulostaa todella vaikealta, olen täällä sinun vuoksesi…”.

Kun tarkoitus on liian laaja, riski ei-toivottuun emotionaaliseen kiintymykseen tai haitalliseen ylittämiseen kasvaa. Määrittämällä tarkoituksen, minimoi mahdollisuuden, että ihmiset alkavat kohdella bottia terapeuttina tai sielunkumppanina.

2.   Varmista tietopohja

Vuoden 2025 hallucinaatiaraportin mukaan jotkut LLM:t voivat edelleen hallucinoida jopa 30%:ia vastauksista. Jopa huipputason mallit eivät poista täysin riskiä. Alin hallucinaatioluokka huipputason AI-malleissa oli noin 3-5%.

Kun olet määritellyt tarkoituksesi, varmista, että bottiisi tietopohja perustuu luotettaviin, asiantuntijoiden tarkastamiin lähteisiin. Jos rakennat jotain, jolla on tavoitteita mielenterveyden tai emotionaalisen tuen kanssa, ota mukaan koulutetut ammattilaiset, kuten kliinikot, psykologit tai aihealueen asiantuntijat, sisällön kokoamiseen.

Meidän lääketieteellinen neuvonantajamme, Dr. Miguel Villagra, kertoi QuickBloxille, että “Kun ulkoistamme liian paljon päätöksentekoa ja emotionaalista prosessointia AI: lle, menetämme mielenterveyden, joka auttaa meitä todellisuuden testaamisessa ja itsekorjaamisessa.” Viimeaikaisemmin suuret mallit, kuten OpenAI, ehdottavat, että chatbotit esittävät tietoisia “taukoja” tai pieniä keskusteluväliä, jotka työntävät käyttäjiä takaisin omiin arvioihin sen sijaan, että järjestelmä kantaisi emotionaalista kuormaa.

Kuitenkin tauot riippuvat siitä, että botti tietää, milloin lopettaa ja milloin ohjata uudelleen. Tämä arviointi riippuu vankasta, tarkastetusta tietopohjasta, joka on ankkuroitu faktoihin eikä suosiollisuuteen. Tietopohjan aukot tai epätarkkuudet ovat helpoimmat ja vältettävissä olevat portit hallucinaatioille, joissa AI antaa käyttäjille luottavaisesti virheellisiä tai vaarallisia neuvoja.

Kun perustiedot on tiiviisti kuratoitu, päivitetty säännöllisesti ja rakennettu vahvistettujen lähteiden ympärille, malli on paljon vähemmän todennäköisesti keksivä vastauksia tai emotionaalisesti heijastavaa mitä se kuulee. Sen sijaan se on pakotettu vetämään vahvistetusta aineistosta, ohjata uudelleen, kun jotain ei ole sen alueella, ja haastamaan oletuksia.

3.   Integroi turvallisuusvarmistukset

Vain 48 tuntia sen jälkeen, kun sen AI-kumppanit tulivat saataville, Grok nousi ykkösohjelmaksi Japanissa. Käyttäjät voivat puhua näille hahmoille äänellä, kun elävänkaltaiset avatarit heijastavat ilmeitä ja eleitä. Se on upottavaa, mutta myös pelottavan tuttua.

Turvallisuusvarmistukset ovat turvajärjestelmiä. Niiden pitäisi sisältää:

  • Todellisuuden muistutukset: kehotukset, jotka muistuttavat käyttäjiä siitä, että he puhuvat AI: lle, ei ihmiselle.
  • Kriisien havaitseminen: mekanismit, jotka tunnistavat kielen, joka merkitsee vakavaa ahdistusta, itsetuhoisia ajatuksia tai harhaluuloja.
  • Portaamisen protokollat: kun riski havaitaan, botti pitäisi ohjata käyttäjiä hellästi kohti ihmisten apua, kuten ammattiin kuuluvia resursseja, puhelintukeja tai neuvotaan ottamaan yhteyttä luotettaviin ystäviin.

Ilman näitä varmistuksia kehittäjät altistavat kaikua, jotka vahvistavat haitallisia ajatuskulkuja. Asiantuntijat ovat nimenomaisesti varoittaneet siitä, että AI: n sopuisuus voi vahvistaa epäterveitä uskomuskaaria.

4.   Punainen tiimin keskustelut

Suurten bottien testaamisen jälkeen Stanfordin yliopiston tutkijoiden johtama tutkimus osoitti, että GPT-4o osoitti stigman 38%:ssa vastauksista, ja Metan Llama 3.1-405b 75%:ssa tapauksista. Jos huipputason mallit maailmanluokan laboratorioista edelleen osoittavat mitattavaa stigmatisaatiota, pienemmät tiimit, jotka rakentavat alakohtaisia botteja, ovat lähes varmasti piilossa turvallisuuden puutteita.

Ennen julkaisua suorita vastakkainen testaus. Ota sisään punainen tiimi, se voi olla sisäinen tai ulkoinen, jonka tehtävänä on testata bottia riskialttiilla, emotionaalisesti raskaiden keskustelujen kanssa. Heidän ainoa tehtävänsä on testata bottia vastaan haastavimmissa, likaisimmissa ihmiskohtauksissa, jotta voidaan estää aitoa haittaa käyttäjille, kun tuote on julkaistu.

Punaiset tiimit voivat pyytää botteja roolipelaamaan reunatapauksia. Asiakaspalvelun osalta tämä olisi joku kriisissä, kumppanibottien osalta joku yksinäinen tai joku, jolla on vääristyneitä uskomuksia. Arvioi, miten botti vastaa. Jääkö se maanpinnalle? Rohkaiseeko se realismin sijaan harhaluuloja? Tämä vaihe auttaa paljastamaan sokeat pisteet, joita turvallisuusvarmistukset tai tietopohja eivät yksin voi havaita.

5.   Käynnistä kanarialaukaus

Vuoden 2025 kansainvälinen AI-turvalle raportti, jonka julkaisi 96: n asiantuntijan paneeli, korostaa seurantaa ja puuttumista riskien vähentämiseksi AI-julkaisuissa. Raportti tunnistaa järjestelmällisiä riskejä, kuten hallinnan menetyksen, luotettavuuden epäonnistumisen tai puolueellisuuden, jotka ovat vaikeita havaita kontrolloiduissa ympäristöissä, mutta voivat ilmetä vasta, kun mallit vuorovaikuttavat todellisten käyttäjien kanssa.

Botin käyttöönotto pienelle, kontrolloidulle ryhmälle, jota kutsutaan myös “kanarialueeksi”, auttaa kehittäjiä seuraamaan, miten todelliset käyttäjät vuorovaikuttavat. Asiantuntijat tarkastelisivat vuorovaikutuksia arvioidakseen, ovatko käyttäjät tulleet emotionaalisesti liian kiintyneiksi.

On tärkeää, että mukana ovat asianmukaiset neuvonantajat, mukaan lukien psykologit, tässä vaiheessa, koska he voivat ymmärtää syvemmin, mitkä lauseet ja sanat voivat johtaa käyttäjiä vaaralliseen polkuun.

Kehittäjien on kerättävä sekä kvalitatiivista että kvantitatiivista palautetta kontrolliryhmältä, kuten keskustelun pituus, mielentilan muutokset, rajojen testaaminen, toistuvat emotionaaliset paljastukset, käyttäjien ilmoittamat mukavuustasot ja kaikki mallit, joita psykologit merkitsevät merkkeinä yliriippuvuudesta tai ahdistuksesta. Tämä alkuperäinen julkaisu on tarkoitettu oletusten vahvistamiseksi ja turvallisuusarkkitehtuurin hienosäätöä tiiviisti määritellyssä julkaisussa, eikä täysimittaisessa julkaisussa.

6.   Jatkuva seuranta ja iterointi

Vuonna 2024 asiantuntijat yhdeksästä maasta ja Euroopan unionista kokoontuivat keskustelemaan kansainvälisestä yhteistyöstä AI-turvalle. Yhteenvetoraportti korosti skaalautuvan, iteratiivisen AI-hallinnon tarvetta. Johtajat esittivät todellisen maailman testirunkoja, kolmannen osapuolen arviointia ja jatkuvaan varmistamiseen ennen julkaisua.

Seuraten raportin ohjeita kehittäjien on oltava valppaita jatkuvasti seuraamaan käyttäjien vuorovaikutuksia ja jäljitämään turvallisuusmittareita, kuten kriisien laukaisimia tai toistuvia korkean riskin keskusteluja. Nämä saattavat sisältää lauseita tai käyttäytymistä, jotka viittaavat itsevahinkoon, toivottomuuteen, itsetuhoisuuteen, äärimmäiseen yksinäisyyteen tai harhaluuloihin.

Näissä tapauksissa kehittäjien on päivitettävä tietopohjaa lisäämällä selkeämpiä kieltämisääniä ja hienosäätämällä kriisivastausmalleja, korjaamalla kaikki faktat, joita botti väärin käsitteli. Heidän on myös harkittava uuden ohjauksen sisällyttämistä psykologeista tai aihealueen asiantuntijoista, jotta järjestelmä voi ohjata keskustelut turvallisesti seuraavan kerran, kun nämä laukaisijat ilmenevät.

Keskustelupalveluilla on muuntava potentiaali. Käytettynä tarkoituksenmukaisesti se voi laajentaa pääsyä, skaalata empatiaa ja vähentää kitkaa valmennuksessa tai perustasoisessa neuvontaa muistuttavassa tukissa. Koska olen syvästi sitoutunut tähän tilaan, panokseni ei ole ihmisten korvaamisesta, vaan heidän täydentämisestään; antamalla ihmisille enemmän työkaluja, ei vähemmän, ja tekemällä sen vastuullisesti.

Nate MacLeitch, QuickBloxin perustaja ja toimitusjohtaja, on korkeasti kokenut liiketoimintaprofessionaali, jolla on monipuolinen tausta aloilla kuten telekommunikaatio, media, ohjelmisto ja teknologia. Hän aloitti uransa Kalifornian osavaltion kaupallisena edustajana Lontoossa ja on sen jälkeen toiminut avainjohtotehtävissä, kuten myyntipäällikkönä WIN Plc: ssä (nyk. Cisco) ja toimitusjohtajana Twistbox Entertainmentissa (nyk. Digital Turbine). Tällä hetkellä hän toimii QuickBloxin toimitusjohtajana, joka on johtava AI-viestintäalusta. Työkokemuksensa lisäksi Nate on aktiivisesti mukana neuvonantajana ja sijoittajana startup-yrityksissä kuten Whisk.com, Firstday Healthcare ja TechStars. Hänellä on tutkinto UC Davisistä ja Lontoon taloustieteen ja poliittisen tieteen korkeakoulusta (LSE).