Kritička rasprava: Personalizacija odgovora u konverzacijskim AI sustavima: između korisničkog iskustva i etičkih izazova
Proces izrade seminarskog rada
Debater 1 — napad
§1 Teza nakon ispravaka
Izmjenama je teza znatno sužena i metodološki opreznija. Izbačena je tvrdnja da personalizirani prikazi sami po sebi povećavaju ocjene preporuka, a uklonjena je i šira tvrdnja o „pogrešnoj atribuciji sposobnosti” sustavu. Također je napuštena opća tvrdnja da personalizacija poboljšava prirodnost, kvalitetu interakcije i zadovoljstvo.
Preostala središnja teza glasi:
„Personalizacija je u pojedinim zadacima i populacijama povezana s boljom relevantnošću ili doživljajem interakcije, ali otvoreni izvori ne podupiru opću tvrdnju da je personalizirani odgovor bolji od generičkog.”
To više nije teza o učinku personalizacije općenito, nego ograničena tvrdnja o povezanosti između pojedinih oblika prilagodbe i pojedinih ishoda. Međutim, tekst i dalje na više mjesta govori šire nego što dopušta ta sužena teza. Najveći preostali problem jest zamjena personalizacije kontekstualnom prilagodbom, stilske prilagodbe, persone agenta i afektivne procjene. Dokazi za te različite pojave zatim se zbrajaju kao dokaz o „personalizaciji” u cjelini.
Najviše su oslabljeni ili ostali bez dostatnog pokrića:
- odjeljak 4.3 o memoriji i trajnom korisničkom profilu;
- opća tvrdnja da personalizacija često zahtijeva osobne podatke;
- tvrdnja da personalizacija povećava pristranostne rizike izvan konkretnih persona-modela;
- tvrdnja da personalizacija smanjuje kognitivno opterećenje i broj potrebnih pojašnjenja;
- tvrdnje o socijalnoj prisutnosti, antropomorfizmu i pretjeranom povjerenju;
- tvrdnja da je povećanje relevantnosti „najstabilniji” učinak;
- odjeljak 11, koji najavljuje minimalni eksperimentalni dizajn, ali nakon izbacivanja četiriju uvjeta više ne nudi stvarno razrađen dizajn.
§2 Napadi
1. Rad dokaze o različitim fenomenima prikazuje kao dokaz o personalizaciji u cjelini
Meta:
„Personalizacija je u pojedinim zadacima i populacijama povezana s boljom relevantnošću ili doživljajem interakcije...”
Na čemu se temelji napad: Kao potpora se koriste radovi o implicitnoj personi, personi agenta, prilagodbi stila u zdravstvenom kontekstu, afektivnim očekivanjima i benchmark-evaluacijama. To nisu isti tretmani. Persona agenta nije isto što i modeliranje korisnika; prilagodba stila nije isto što i memorija; očekivanje korisnika nije stvarni učinak sustava; benchmark-poboljšanje nije poboljšanje korisničkog iskustva.
Izvori iz rada: Chen i sur. opisuju heterogeno područje personaliziranog dijaloga; Cho i sur. proučavaju implicitnu personu; Gross i sur. proučavaju stil interakcije kod pacijenata s KOPB-om; Hernandez i sur. proučavaju očekivanja; Kwon i sur. evaluiraju konkretnu arhitekturu.
Razornost: Podriva zaključak. Središnja teza može ostati istinita samo ako se jasno ograniči na konkretne vrste prilagodbe. U sadašnjem obliku riječ „personalizacija” djeluje kao zajednički naziv za različite intervencije, pa se njihovi rezultati ne mogu zbrajati u jednu empirijsku tvrdnju.
2. Tekst priznaje da relevantnost nije točnost, ali zatim relevantnost tretira kao glavni očekivani učinak bez izvora
Meta:
„Najstabilniji očekivani učinak personalizacije jest povećanje relevantnosti...”
Na čemu se temelji napad: U samom radu ranije stoji: „relevantnost nije jednaka točnosti”. Ipak, tvrdnja da je povećanje relevantnosti najstabilniji učinak nije potkrijepljena usporednim pregledom svih metoda i populacija. U odjeljku 4.7 navodi se samo da pregled Li i suradnika razlikuje podatkovne i modelne pristupe; to ne dokazuje stabilnost učinka na korisničku relevantnost.
Izvor iz rada: Li, Waleed i Salam, pregled personaliziranog afektivnog računarstva; Kwon i sur., evaluacija konkretne arhitekture.
Razornost: Traži preformulaciju. „Najstabilniji” je komparativna tvrdnja koja zahtijeva dokaz da je taj učinak stabilniji od drugih učinaka. Preostali izvori to ne nose.
3. Memorija je predstavljena kao trajni profil, ali odjeljak nema vlastitu potporu
Meta:
„Sustav može pohranjivati činjenice o korisniku, sažetke ranijih razgovora ili obrasce ponašanja te ih dohvaćati kada su relevantni za novi upit. Ovaj pristup može smanjiti ponavljanje informacija i povećati kontinuitet, ali stvara trajni profil koji mora imati jasnu svrhu, rok čuvanja, mogućnost uvida i mogućnost brisanja.”
Na čemu se temelji napad: Prva rečenica opisuje tehničku mogućnost, druga iznosi učinke i normativne zahtjeve. Za razliku od odjeljaka o personi, afektivnom računarstvu i pristranosti, ovdje nije naveden izvor koji pokazuje da memorija smanjuje ponavljanje, povećava kontinuitet ili nužno stvara trajni profil. Nisu svi oblici dohvaćanja prethodnog konteksta trajna memorija, a sam tekst u odjeljku 3 razlikuje kratkotrajnu kontekstualizaciju od trajnog profiliranja.
Izvori iz rada: Hendrickx i sur. bave se privatnošću i kontrolom u personaliziranim agentima; GDPR i mišljenje EDPB-a daju pravni okvir, ali ne empirijski dokaz o učinku memorije na kontinuitet ili ponavljanje.
Razornost: Traži ogradu i preformulaciju. Odjeljak može ostati samo kao opis dizajnerskog problema. Tvrdnje o smanjenju ponavljanja i povećanju kontinuiteta ne mogu ostati kao nalazi bez izvora.
4. „Često zahtijeva obradu osobnih podataka” preširoko je nakon vlastitog pojmovnog razgraničenja
Meta:
„Personalizacija često zahtijeva obradu osobnih podataka ili zaključivanje o korisniku...”
Na čemu se temelji napad: U odjeljku 3 rad izrijekom razlikuje kontekstualnu prilagodbu koja može biti kratkotrajna i odvijati se „bez stvaranja trajnog profila”. U odjeljku 4.1 opisuje eksplicitni profil, ali u odjeljku 4.4 opisuje prilagodbu jezika, duljine i stručne razine, što ne mora zahtijevati osobne podatke ni zaključivanje o identitetu korisnika.
Izvor iz rada: Chen i sur. podupiru heterogenost oblika personaliziranog dijaloga; GDPR podupire analizu obrade osobnih podataka kada se ona doista događa, ali ne tvrdnju da je to obilježje personalizacije općenito.
Razornost: Traži preformulaciju. Tvrdnja bi morala razlikovati personalizaciju koja koristi osobne podatke od prilagodbe trenutačnom kontekstu, jeziku ili eksplicitnom korisničkom zahtjevu.
5. Privatnosni i profilacijski rizici opravdano su navedeni, ali „pristranostni rizici” nisu izvedeni iz istih metoda
Meta:
„Personalizacija može povećati privatnosne, profilacijske, pristranostne i autonomijske rizike...”
Na čemu se temelji napad: Radovi Wan i Sheng pokazuju persona-pristranosti, odnosno promjene štetnog ponašanja povezane sa zadanom personom. To ne pokazuje da svaka personalizacija, osobito eksplicitni profil, prilagodba tona ili dohvaćanje konteksta, povećava pristranost. Tekst iz konkretnih persona-eksperimenata prelazi na personalizaciju kao širu kategoriju.
Izvori iz rada: Wan i sur. te Sheng i sur. o persona-pristranostima; Liu i sur. o rodnim i rasnim pristranostima u dijaloškim sustavima.
Razornost: Traži ogradu. Tvrdnja može ostati samo uz preciziranje da se pristranostni rizik odnosi na određene načine profiliranja i zadavanja persone. U sadašnjem obliku zaključak je širi od dokaza.
6. Nalazi o očekivanjima afektivnih agenata nisu nalazi o zadovoljstvu ili učinkovitosti
Meta:
„Istraživanje očekivanja prema afektivnim konverzacijskim agentima [...] pokazalo je da preferencije ovise o kontekstu.”
Na čemu se temelji napad: Sam tekst navodi da Hernandez i sur. mjere očekivanja i preferencije, a ne dugoročnu učinkovitost agenata. Unatoč tome, taj se rad nalazi u odjeljku o „korisničkom iskustvu i učinkovitosti” i koristi se za potporu tezi o poželjnosti različitih razina afektivne personalizacije.
Izvor iz rada: Hernandez i sur., istraživanje očekivanja prema afektivnim konverzacijskim agentima.
Razornost: Traži preformulaciju strukture i zaključka. Nalaz može poduprijeti tvrdnju o kontekstualnosti očekivanja, ali ne i tvrdnju o stvarnom poboljšanju korisničkog iskustva, zadovoljstva ili učinkovitosti.
7. Siro i sur. ne nose onoliko koliko im tekst pripisuje
Meta:
„U istraživanju korisničkog zadovoljstva task-orijentiranih dijaloških sustava zadovoljstvo je analizirano kroz relevantnost, zanimljivost, razumijevanje, izvršenje zadatka, učinkovitost i pobuđivanje interesa. Autori nalaze da se važnost tih dimenzija razlikuje među korisnicima i dijalozima...”
Na čemu se temelji napad: U kontrolnom popisu rada sam izvor I8 opisan je kao analiza „anotacija dijaloga iz ReDial skupa”. To nije isto što i izravno mjerenje stvarnog zadovoljstva korisnika u eksperimentu personalizacije. Nadalje, izvor ne uspoređuje personalizirani i nepersonalizirani odgovor.
Izvor iz rada: Siro, Aliannejadi i de Rijke, uz napomenu I8 o anotacijama ReDial skupa.
Razornost: Traži ogradu. Rad može služiti za razlaganje konstrukta zadovoljstva, ali ne kao empirijski dokaz da personalizacija poboljšava bilo koju od tih dimenzija.
8. Tvrdnja o smanjenju kognitivnog opterećenja ostaje hipoteza, ali je napisana kao mehanizam
Meta:
„Smanjenje kognitivnog opterećenja: prilagodba razine detalja i formata može smanjiti potrebu za dodatnim pojašnjenjima.”
Na čemu se temelji napad: U nastavku se ispravno kaže da bi se taj učinak morao mjeriti brojem izmjena, vremenom i uspjehom zadatka. Međutim, u odjeljku 9 tvrdnja je već uvrštena među mehanizme koji objašnjavaju korist personalizacije. U radu nema izvora koji mjeri kognitivno opterećenje u konverzacijskom AI sustavu.
Izvori iz rada: Gross i sur. mjere interakcijske ishode u specifičnoj zdravstvenoj populaciji; Siro i sur. razlažu zadovoljstvo, ali ne daju dokaz o smanjenju kognitivnog opterećenja.
Razornost: Traži preformulaciju. To treba označiti kao hipotezu za buduće testiranje, a ne kao potvrđeni mehanizam.
9. Socijalna prisutnost, antropomorfizam i pretjerano povjerenje spojeni su bez dokaza o uzročnom lancu
Meta:
„Socijalna prisutnost: topliji i osobniji stil može povećati doživljaj društvene prisutnosti i povjerenja. Međutim, antropomorfizam može potaknuti pretjerano povjerenje i veće samootkrivanje, što povećava privatnosni rizik.”
Na čemu se temelji napad: U radu se citira longitudinalno istraživanje Arauja i Bola koje je pratilo antropomorfizam, povjerenje, privatnosni rizik i samootkrivanje. No samo mjerenje tih varijabli ne dokazuje navedeni uzročni lanac: topliji stil → društvena prisutnost → antropomorfizam → pretjerano povjerenje → samootkrivanje → privatnosni rizik. Tekst vlastiti popis mjerenih varijabli pretvara u mehanistički zaključak.
Izvor iz rada: Araujo i Bol, longitudinalno istraživanje ponovljenih personaliziranih interakcija.
Razornost: Podriva mehanističko objašnjenje i traži ogradu. Treba razlikovati istodobno praćene varijable od dokazanih uzročnih odnosa.
10. Tvrdnja o „trajnom profilu” nije usklađena s razlikovanjem kratkotrajnog konteksta i personalizacije
Meta:
„Što je sustav osobniji, to je veća potreba za podacima ili zaključivanjem o korisniku.”
Na čemu se temelji napad: U odjeljku 3 rad priznaje da se kontekstualna prilagodba može odvijati bez trajnog profila. U odjeljku 4.1 korisnik može izričito zadati željeni ton, duljinu ili razinu stručnosti. Takva prilagodba može biti osobna u iskustvenom smislu, ali ne mora zahtijevati povećanje količine podataka ili zaključivanje o korisniku.
Izvor iz rada: Chen i sur. o različitim oblicima personaliziranog dijaloga; Hendrickx i sur. o korisničkoj kontroli nad podacima.
Razornost: Traži preformulaciju. Problem nije u tome da osobnija interakcija nikada ne traži više podataka, nego u neosnovanom linearnom pravilu „što osobniji sustav, to veća potreba”.
11. Odjeljak o učinkovitosti ne pokazuje učinak na učinkovitost
Meta:
„5.2. Učinkovitost komunikacije”
i:
„Dokazi iz zdravstvenog istraživanja pokazuju da prilagodba interakcijskog stila može poboljšati neke interakcijske ishode u određenoj populaciji.”
Na čemu se temelji napad: Odjeljak najavljuje učinkovitost komunikacije, ali jedini konkretni dokaz dolazi iz specifične populacije pacijenata s KOPB-om i ne pokazuje opću učinkovitost konverzacijskih AI sustava. U samom tekstu također stoji da studija ne mjeri dugoročno zdravstveno ponašanje. Tako odjeljak ostaje bez izravnog dokaza za šire tvrdnje o vremenu, broju izmjena, ponavljanju ili izvršenju zadatka.
Izvor iz rada: Gross i sur., studija prilagodbe interakcijskog stila kod pacijenata s KOPB-om.
Razornost: Podriva zaključak o učinkovitosti izvan zdravstvenog konteksta. Naslov i zaključci odjeljka moraju biti ograničeni na interakcijske ishode u toj studiji.
12. „Personalizacija može povećati uvjerljivost” nije isto što i dokaz manipulativnog učinka
Meta:
„Ako sustav zna korisnikove slabosti, strahove ili preferencije, prilagođeni odgovor može prijeći iz korisne asistencije u ciljano uvjeravanje ili manipulaciju.”
Na čemu se temelji napad: Pollmann i suradnici u radu su opisani kao autori koji razmatraju kompromis između korisničkog iskustva, autonomije i manipulacije. To podupire postavljanje rizika na dnevni red, ali ne pokazuje da konverzacijski sustav doista koristi slabosti ili strahove korisnika za ciljano uvjeravanje. U tekstu nema eksperimenta koji bi mjerio takav učinak.
Izvor iz rada: Pollmann i suradnici, rad o personaliziranoj interakciji čovjeka i robota.
Razornost: Traži ogradu. Tvrdnju treba zadržati kao etički rizik ili normativni scenarij, ne kao empirijski učinak personalizacije.
13. Ograda o benchmarkovima potkopava ranije formulirane zaključke o korisničkom iskustvu
Meta:
„Takvi rezultati mogu pokazati da model bolje slijedi personu, proizvodi raznovrsnije odgovore ili dobiva više ocjene, ali ne dokazuju dugoročni učinak na stvarne korisnike.”
Na čemu se temelji napad: Ova ograda je metodološki ispravna, ali rad je ne primjenjuje dosljedno. Kwonov benchmark, Choova evaluacija implicitne persone i nalazi o afektivnim očekivanjima ranije se koriste za potporu tvrdnjama o relevantnosti, kvaliteti interakcije i korisničkom iskustvu. Ako benchmark ne dokazuje učinak na stvarne korisnike, ne može istodobno biti glavni dokaz za središnju tezu o korisničkom iskustvu.
Izvori iz rada: Kwon i sur.; Cho i sur.; Hernandez i sur.; Chen i sur.
Razornost: Podriva zaključak. Potrebno je razdvojiti dokaz o modelskom ponašanju od dokaza o korisničkom iskustvu i izbaciti benchmark-nalaze iz argumenta o stvarnim korisnicima.
14. „Minimalni eksperimentalni dizajn” nakon izmjena više nije dizajn
Meta:
„Minimalni eksperimentalni dizajn”
i:
„Potrebno je odvojeno mjeriti stvarnu kvalitetu odgovora i doživljenu personalizaciju...”
Na čemu se temelji napad: Nakon izbacivanja rečenice o četiri eksperimentalna uvjeta odjeljak više ne navodi kontrolne uvjete, način dodjele sudionika, vrstu personalizacije, trajanje interakcije, primarni ishod ni način testiranja razlika među skupinama. Odvojeno mjerenje dviju varijabli jest zahtjev za mjerenje, ali nije minimalni eksperimentalni dizajn.
Izvor iz rada: Istraživanje personaliziranih preporuka navedeno je kao potpora razlikovanju stvarne i doživljene personalizacije; rad sam navodi da ne propisuje četiri uvjeta.
Razornost: Traži preformulaciju strukture. Naslov treba govoriti o „preporučenim mjerama”, a ne o minimalnom eksperimentalnom dizajnu, osim ako se uvede stvarni dizajn koji tekst trenutačno nema.
15. Zaključci o korisničkoj kontroli prelaze iz normativnog prijedloga u privid empirijske preporuke
Meta:
„Upravljačka tvrdnja: sigurniji dizajn zahtijeva korisničku kontrolu, ograničavanje podataka, mogućnost ispravka i brisanja profila, praćenje pristranosti te odvojeno testiranje korisničkog iskustva i štetnih ishoda.”
Na čemu se temelji napad: Neki su elementi pravno ili upravljački opravdani, ali rad ih predstavlja kao jedinstveni zahtjev „sigurnijeg dizajna” bez pokazivanja da svaki element empirijski smanjuje konkretan rizik u konverzacijskom AI sustavu. Hendrickx i sur. su u radu opisani kao argumentacijski radionicaški prilog, a NIST kao dobrovoljni okvir upravljanja rizicima.
Izvori iz rada: Hendrickx i sur.; NIST AI 600-1; GDPR; EDPB.
Razornost: Traži razdvajanje vrsta tvrdnji. Treba jasno odvojiti pravni zahtjev, normativnu preporuku i empirijski potvrđen sigurnosni učinak. U sadašnjem obliku preporuka izgleda empirijski potvrđena iako su navedeni izvori različite vrste.
16. Odjeljak o otvorenim pitanjima djelomično skriva već riješene metodološke probleme
Meta:
„Kako mjeriti dugoročni učinak personalizacije na autonomiju i ponašanje korisnika?”
i:
„Kako razlikovati stvarnu emocionalnu prilagodbu od pogrešnog pripisivanja emocije?”
Na čemu se temelji napad: Ta su pitanja legitimna, ali tekst ih ne povezuje s time da raniji zaključci upravo te učinke već koriste kao dio argumenta o autonomiji, afektivnoj personalizaciji i sigurnosti. Ako dugoročni učinak na autonomiju nije izmjeren, ne smije biti prikazan kao posljedica personalizacije; ako se emocija ne može pouzdano razlikovati od pogrešnog pripisivanja, afektivna prilagodba ne može služiti kao stabilan mehanizam.
Izvori iz rada: Hernandez i sur. mjere očekivanja, ne dugoročnu učinkovitost; Li, Waleed i Salam te rad o afektivnom prepoznavanju navode kontekstualna ograničenja.
Razornost: Podriva jačinu ranijih zaključaka. Otvorena pitanja ne popravljaju činjenicu da su pojedini njihovi ishodi već ugrađeni u argument kao da su utvrđeni.
17. „Odgovorna i proporcionalna personalizacija” nije izvedena kao zaključni kriterij
Meta:
„Zaključak: kriteriji za odgovornu i proporcionalnu personalizaciju.”
Na čemu se temelji napad: Rad ne definira kriterij proporcionalnosti. Nije određeno prema čemu se uspoređuju korist i rizik, koji su rizici prihvatljivi, kada je količina podataka nužna, kako se mjeri autonomija ni kako se odlučuje da je razina personalizacije razmjerna koristi.
Izvori iz rada: GDPR daje načela poput smanjenja količine podataka, ograničenja svrhe i ograničenja pohrane; NIST daje okvir za upravljanje rizicima; nijedan od tih izvora u radu nije prikazan kao konkretan prag proporcionalnosti za konverzacijske AI sustave.
Razornost: Traži preformulaciju zaključka. Tekst može ponuditi kriterije za razmatranje proporcionalnosti, ali ne i tvrditi da je razvio ili dokazao standard odgovorne proporcionalne personalizacije.
Debater 2 — obrana
§1 Provjera mete
Napadi su provjereni prema odobrenoj verziji dokumenta, a ne prema briefu. Mete koje u tekstu ne postoje ili ih tekst već izrijekom ograničava označene su kao napadi koji padaju; postojeće mete koje prelaze dosege vlastitih izvora označene su kao napadi koji stoje.
§2 Odgovor na napade
-
Različiti fenomeni prikazani su kao personalizacija u cjelini
Provjera mete: meta postoji. Središnja teza izrijekom kaže da je personalizacija povezana s boljom relevantnošću „u pojedinim zadacima i populacijama”, dok pojmovni okvir navodi da se razlikuju „persona agenta”, „personalizacija korisnika” i „kontekstualna prilagodba”; napad zato ne ruši tezu, nego upozorava na potrebu dosljednijeg razdvajanja dokaza.
Najmanja izmjena: U središnju tezu dodati: „Ova se tvrdnja odnosi na pojedine oblike prilagodbe, a ne na personalizaciju kao jedinstvenu intervenciju.”
-
Relevantnost je proglašena „najstabilnijim” učinkom bez dovoljnog izvora
Provjera mete: meta postoji. Rečenica „Najstabilniji očekivani učinak personalizacije jest povećanje relevantnosti” jest komparativna tvrdnja koju navedeni izvori ne potvrđuju; napad stoji.
Najmanja izmjena: Zamijeniti je rečenicom: „Povećanje relevantnosti jedan je od mogućih učinaka personalizacije, ali njegova stabilnost među zadacima i populacijama nije utvrđena.”
Cijena ustupka: Odjeljak 9 više ne može relevantnost prikazivati kao najstabilniji mehanizam, nego samo kao hipotezu ili mogući učinak.
-
Memorija je predstavljena kao trajni profil bez vlastite potpore
Provjera mete: meta postoji. U tekstu doista stoji da memorija „može smanjiti ponavljanje informacija i povećati kontinuitet”, ali navedeni izvori ne daju empirijsku potporu tim učincima, a dohvaćanje prethodnog konteksta ne mora stvarati trajni profil; napad stoji.
Najmanja izmjena: Zamijeniti drugu rečenicu ovako: „Ovaj pristup može služiti kontinuitetu razgovora, ali trajanje pohrane, profiliranje i prava korisnika ovise o konkretnom dizajnu sustava.”
Cijena ustupka: Gube se izravne tvrdnje da memorija smanjuje ponavljanje i povećava kontinuitet; odjeljak ostaje opis tehničkog i upravljačkog problema.
-
Personalizacija preširoko navodno zahtijeva osobne podatke
Provjera mete: meta postoji. Rečenica „Personalizacija često zahtijeva obradu osobnih podataka ili zaključivanje o korisniku” preširoka je u odnosu na vlastito razlikovanje kratkotrajne kontekstualne prilagodbe i trajnog profiliranja; napad stoji.
Najmanja izmjena: Zamijeniti je rečenicom: „Oblici personalizacije koji koriste profile, memoriju ili zaključene osobine uključuju obradu osobnih podataka, dok se neke kontekstualne prilagodbe mogu odvijati bez trajnog profila.”
Cijena ustupka: Privatnosna analiza više se ne može primijeniti na personalizaciju općenito, nego samo na one oblike koji obrađuju ili zaključuju osobne podatke.
-
Persona-pristranost neopravdano se proširuje na personalizaciju općenito
Provjera mete: meta postoji. Tekst navodi da „personalizacija može povećati privatnosne, profilacijske, pristranostne i autonomijske rizike”, dok konkretni nalazi o pristranosti potječu ponajprije iz rada o demografskim personama; napad stoji u pogledu dosega tvrdnje.
Najmanja izmjena: Zamijeniti tvrdnju ovako: „Određeni oblici profiliranja i zadavanja persone mogu povećati pristranostne rizike, dok se učinak drugih oblika personalizacije mora zasebno mjeriti.”
Cijena ustupka: Ne može se više govoriti o povećanju pristranosti kao općem riziku svih personaliziranih sustava; odjeljak se mora osloniti na konkretne persona-modele i profilacijske postupke.
-
Očekivanja afektivnih agenata nisu nalazi o zadovoljstvu ili učinkovitosti
Provjera mete: meta postoji, ali napad pada. Dokument izrijekom navodi da Hernandez i suradnici „proučavaju očekivanja”, a ne dugoročnu učinkovitost, te njihov nalaz koristi samo za tvrdnju da „preferencije ovise o kontekstu”; ne prikazuje ga kao dokaz poboljšanja zadovoljstva ili učinkovitosti.
Najmanja izmjena: Nije potrebna izmjena; dovoljno je zadržati postojeću ogradu: „To podupire tezu da ista razina afektivne personalizacije neće biti jednako poželjna u svim situacijama.”
-
Siro i suradnici ne dokazuju učinak personalizacije
Provjera mete: meta postoji. Dokument Siro i suradnika koristi za razlaganje konstrukta zadovoljstva, ali ne tvrdi da taj rad uspoređuje personalizirani i nepersonalizirani odgovor; napad pada kao prigovor na zaključak koji tekst ne izvodi.
Najmanja izmjena: Nije potrebna izmjena; postojeća formulacija već govori da se dimenzije zadovoljstva razlikuju među korisnicima i dijalozima, a ne da personalizacija poboljšava te dimenzije.
-
Smanjenje kognitivnog opterećenja napisano je kao potvrđeni mehanizam
Provjera mete: meta postoji. Odjeljak 9 doista navodi „Smanjenje kognitivnog opterećenja” među mehanizmima, iako tekst priznaje da ga treba tek mjeriti; napad stoji.
Najmanja izmjena: Naslov i tvrdnju preoblikovati u: „Hipoteza o smanjenju kognitivnog opterećenja: prilagodba razine detalja i formata mogla bi smanjiti potrebu za dodatnim pojašnjenjima, ali to zahtijeva zasebno mjerenje.”
Cijena ustupka: Smanjenje kognitivnog opterećenja više nije objašnjenje potvrđene koristi, nego prijedlog za buduće testiranje; odjeljak 9 gubi jedan potvrđeni mehanistički opis.
-
Socijalna prisutnost, antropomorfizam i povjerenje spojeni su u nedokazan uzročni lanac
Provjera mete: meta postoji. Rečenica povezuje „topliji i osobniji stil”, društvenu prisutnost, antropomorfizam, pretjerano povjerenje i samootkrivanje, iako dokument za Arauja i Bola navodi da su te varijable praćene, a ne da je uzročni lanac dokazan; napad stoji.
Najmanja izmjena: Zamijeniti odlomak ovako: „Topliji i osobniji stil može biti povezan s većom društvenom prisutnošću ili povjerenjem, ali navedene varijable ne dokazuju same po sebi uzročni lanac prema antropomorfizmu, samootkrivanju i privatnosnom riziku.”
Cijena ustupka: Gubi se mehanističko objašnjenje uzročnog slijeda; ostaje samo oprezna tvrdnja o mogućim povezanostima koje treba longitudinalno testirati.
-
Tvrdnja „što je sustav osobniji, to je veća potreba za podacima” nije usklađena s pojmovnim razgraničenjem
Provjera mete: meta postoji. Rečenica „Što je sustav osobniji, to je veća potreba za podacima ili zaključivanjem o korisniku” uvodi linearno pravilo koje ne vrijedi za eksplicitnu ili kratkotrajnu kontekstualnu prilagodbu; napad stoji.
Najmanja izmjena: Zamijeniti je rečenicom: „Potreba za podacima ili zaključivanjem ovisi o načinu personalizacije; trajna memorija i profiliranje stvaraju veći opseg obrade nego prilagodba trenutačnom kontekstu ili izričitom zahtjevu korisnika.”
Cijena ustupka: Gubi se opće linearno pravilo, a privatnosni argument mora razlikovati vrste personalizacije i njihove podatkovne zahtjeve.
-
Odjeljak o učinkovitosti ne dokazuje opću učinkovitost
Provjera mete: meta postoji, ali napad pada. Dokument izrijekom ograničava nalaz na „određenu populaciju”, navodi da se iz studije „ne može zaključiti da personalizacija općenito povećava učinkovitost svih konverzacijskih AI sustava” i razlikuje interakcijske ishode od dugoročnog zdravstvenog ponašanja; napad cilja zaključak koji je već izrijekom odbačen.
Najmanja izmjena: Nije potrebna izmjena; postojeće ograničenje dosega dovoljno je jasno.
-
Rizik manipulacije nije isto što i dokaz manipulativnog učinka
Provjera mete: meta postoji, ali napad pada. Rečenica koristi modalni oblik „može prijeći” i nalazi se u odjeljku o napetosti između personalizacije i autonomije, dok se Pollmann i suradnici opisuju kao izvor koji taj odnos razmatra, a ne kao dokaz da sustavi stvarno manipuliraju korisnicima.
Najmanja izmjena: Nije potrebna izmjena; za dodatnu jasnoću može se dodati: „Ovdje je riječ o etičkom riziku dizajna, a ne o dokazanom učinku u navedenim studijama.”
-
Ograda o benchmarkovima nije dosljedno primijenjena
Provjera mete: meta postoji. Dokument s jedne strane kaže da benchmark-rezultati „ne dokazuju dugoročni učinak na stvarne korisnike”, a s druge ih koristi za tvrdnje o relevantnosti i kvaliteti interakcije; napad stoji kao zahtjev za razdvajanjem razina dokaza.
Najmanja izmjena: Uz Kwonove, Choove i srodne nalaze dodati: „Ovaj rezultat odnosi se na modelsko ponašanje ili evaluacijske uvjete, a ne sam po sebi na stvarno korisničko iskustvo.”
Cijena ustupka: Benchmark-nalazi više ne mogu biti glavni dokaz za tvrdnje o stvarnim korisnicima; središnja teza mora se oslanjati na ograničene korisničke i kontekstualne studije.
-
„Minimalni eksperimentalni dizajn” nakon izmjena više nije dizajn
Provjera mete: meta postoji. Odjeljak je naslovljen „Minimalni eksperimentalni dizajn”, ali sadrži samo zahtjev da se odvojeno mjere „stvarna kvaliteta odgovora i doživljena personalizacija”; napad stoji.
Najmanja izmjena: Naslov zamijeniti s „Preporučene mjere za buduće eksperimente”, a rečenicu zadržati kao metodološki zahtjev za odvojeno mjerenje.
Cijena ustupka: Odjeljak više ne predstavlja eksperimentalni dizajn, nego samo skup mjernih načela; dokument gubi ambiciju da propiše minimalnu strukturu istraživanja.
-
Upravljačke preporuke prikazane su kao empirijski potvrđen sigurnosni paket
Provjera mete: meta postoji. Rečenica „sigurniji dizajn zahtijeva korisničku kontrolu...” spaja pravne zahtjeve, normativne preporuke i upravljačke prakse, iako navedeni izvori nisu predstavljeni kao eksperimentalni dokaz da svaki element smanjuje konkretan rizik; napad stoji.
Najmanja izmjena: Zamijeniti je rečenicom: „Sigurniji dizajn trebao bi razmotriti korisničku kontrolu, ograničavanje podataka, ispravak i brisanje profila, praćenje pristranosti te odvojeno testiranje korisničkog iskustva i štetnih ishoda.”
Cijena ustupka: Preporuka više ne tvrdi da je svaki navedeni element empirijski potvrđena mjera; treba ga čitati kao normativni i upravljački prijedlog utemeljen na različitim vrstama izvora.
-
Otvorena pitanja ne popravljaju navodno neizmjerene zaključke
Provjera mete: meta postoji, ali napad pada. Pitanja „Kako mjeriti dugoročni učinak personalizacije na autonomiju i ponašanje korisnika?” i „Kako razlikovati stvarnu emocionalnu prilagodbu od pogrešnog pripisivanja emocije?” izrijekom označavaju neriješene probleme; tekst autonomiju i afektivnu prilagodbu prethodno prikazuje kao rizike, ograničenja ili otvorene hipoteze, a ne kao utvrđene učinke.
Najmanja izmjena: Nije potrebna izmjena; postojeće formulacije u odjeljcima 4.6, 9 i 12 već razlikuju procjenu, rizik i potvrđeni nalaz.
-
„Odgovorna i proporcionalna personalizacija” nije izvedena kao kriterij
Provjera mete: meta postoji. U preporučenoj strukturi doista stoji „kriteriji za odgovornu i proporcionalnu personalizaciju”, ali dokument ne definira prag proporcionalnosti ni način vaganja koristi i rizika; napad stoji.
Najmanja izmjena: Zamijeniti završnu točku s: „Zaključak: kriteriji za razmatranje odgovorne i proporcionalne personalizacije.”
Cijena ustupka: Dokument više ne sugerira da je razvio standard proporcionalnosti; može ponuditi samo kriterije za analizu, oslonjene na načela GDPR-a i NIST-ov okvir za upravljanje rizicima.
§3 Što teza i dalje nosi
- Personalizacija je heterogena skupina postupaka, a ne jedna tehnika; dokument razlikuje eksplicitne profile, implicitno zaključivanje, memoriju, stil, personu, afektivnu i modelnu personalizaciju.
- Implicitna persona izvedena iz povijesti dijaloga jest modelska procjena, a ne izravno opažena činjenica.
- Učinci prilagodbe ovise o zadatku, populaciji, kontekstu i vrsti intervencije; to potvrđuje i ograničavanje nalaza na pojedine studije i populacije.
- Očekivanja korisnika nisu isto što i stvarna učinkovitost sustava, a benchmark-rezultati nisu isto što i dugoročno korisničko iskustvo.
- Relevantnost nije jednaka točnosti, a doživljena personalizacija nije jednaka stvarnoj kvaliteti odgovora.
- Privatnosni rizici legitimno se vežu uz profiliranje, memoriju, zaključivanje o korisniku i sekundarnu uporabu podataka, ali se moraju pripisati konkretnim oblicima personalizacije.
- Persona-pristranost je empirijski poduprt rizik određenih persona-modela, uz nalaz da persona u nekim slučajevima može smanjiti, a u drugima povećati štetne odgovore.
- Identitetska transparentnost nije isto što i podatkovna ili učinska transparentnost; dokument to razdvaja u tri razine.
- GDPR, Akt o umjetnoj inteligenciji, EDPB i NIST u radu imaju različite uloge: pravni okvir, regulatorni zahtjev, službeno mišljenje i upravljački okvir, a ne jedinstveni empirijski dokaz.
- Za odgovornu evaluaciju potrebno je odvojeno mjeriti korisničko iskustvo, stvarnu kvalitetu odgovora, privatnost, pristranost, štetne ishode i razlike među skupinama.
§4 Najmanja izmjena koja spašava tezu
Tezu spašava dosljedno ograničavanje svih empirijskih zaključaka na „pojedine oblike prilagodbe, zadatke i populacije”, uz uklanjanje komparativa poput „najstabilniji” i uz jasno razlikovanje modelske evaluacije, očekivanja korisnika, normativnog rizika i stvarnog korisničkog ishoda.
Najvažnije pojedinačne izmjene jesu: preoblikovati odjeljak o memoriji u opis dizajnerskog problema, ograničiti privatnosne i pristranostne tvrdnje na oblike koji doista koriste profiliranje ili personu, kognitivno opterećenje označiti hipotezom, naslov „Minimalni eksperimentalni dizajn” zamijeniti naslovom o preporučenim mjerama te „kriterije za odgovornu i proporcionalnu personalizaciju” preoblikovati u kriterije za razmatranje proporcionalnosti.
Debater 3 — presuda
§0 Zaključane odluke
Sljedeće odluke prenose se doslovno i obvezujuće su za sve nizvodne faze. Pisanje ne smije vratiti uklonjene tvrdnje, proširiti sužene formulacije ni dodati referencu kao razlog za poništavanje odluke.
-
Br. 3 — IZNOVA_IZVEDI_TVRDNJU
„Personalizacija je u pojedinim zadacima i populacijama povezana s boljom relevantnošću ili doživljajem interakcije, ali otvoreni izvori ne podupiru opću tvrdnju da je personalizirani odgovor bolji od generičkog.”
Izvori podupiru pojedinačne učinke, ali ne opću nadmoć.
-
Br. 4 — IZNOVA_IZVEDI_TVRDNJU
„Učinak personalizacije ovisi o zadatku, populaciji i vrsti prilagodbe; otvoreni izvori dodatno upućuju na važnost konteksta, objašnjenja i korisničke kontrole, ali ne potvrđuju sve navedene čimbenike u jedinstvenom eksperimentu.”
Količina podataka i svi navedeni čimbenici nisu potvrđeni u istom opsegu.
-
Br. 5 — IZNOVA_IZVEDI_TVRDNJU
„Personalizacija može povećati privatnosne, profilacijske, pristranostne i autonomijske rizike; rizik pogrešne atribucije sposobnosti treba navesti samo uz zaseban izvor.”
Veći dio tvrdnje je poduprt, ali pogrešna atribucija sposobnosti nije potvrđena u istom korpusu.
-
Br. 17 — IZBACI_TVRDNJU
„Eksperiment s filmskim preporukama pokazao je da su sudionici davali više ocjene preporukama kada su im iste preporuke predstavljene kao personalizirane.”
Izvor navodi da nije nađena značajna razlika između personaliziranih i nepersonaliziranih preporuka.
-
Br. 21 — IZNOVA_IZVEDI_TVRDNJU
„U radu Cho i suradnika implicitna persona korisnika izvedena je iz povijesti dijaloga i predstavlja modelsku procjenu, a ne izravno opaženu činjenicu.”
Izvor opisuje latentno modeliranje, ali ne opću tvrdnju o svim modelima.
-
Br. 27 — IZNOVA_IZVEDI_TVRDNJU
„Rezultati Kwonova rada pokazuju uspješnost ispitane arhitekture u njezinim evaluacijskim uvjetima; sami po sebi ne daju opći dokaz o učinku personalizacije na dugoročno korisničko iskustvo.”
Metodološka ograda je opravdana, ali nije izravan nalaz sažetka.
-
Br. 29 — IZNOVA_IZVEDI_TVRDNJU
„Afektivno prepoznavanje treba tretirati kao kontekstualno ograničenu procjenu koja sama po sebi nije dovoljna za sigurnu prilagodbu interakcije.”
Izvor podupire ograničenu generalizaciju i nedostatnost same procjene, ali ne cijelu izvornu formulaciju.
-
Br. 32 — IZNOVA_IZVEDI_TVRDNJU
„Osobni detalji mogu povećati doživljenu relevantnost i uvjerljivost odgovora, ali to samo po sebi ne potvrđuje njegovu sadržajnu točnost.”
Nije potvrđena konkretna kombinacija stvarne netočnosti i osobnih detalja.
-
Br. 35 — IZNOVA_IZVEDI_TVRDNJU
„Učinkovitost treba mjeriti izvršenjem zadatka, učinkovitošću, vremenom, brojem izmjena i potrebom za ponavljanjem; kognitivno opterećenje zahtijeva zasebnu mjeru.”
Kognitivno opterećenje nije izravno potvrđeno u navedenom izvoru.
-
Br. 39 — IZNOVA_IZVEDI_TVRDNJU
„Pregledani radovi često koriste benchmark-skupove, automatske metrike ili kratke korisničke studije, dok je dugoročna procjena stvarnih korisnika rjeđa u otvorenom korpusu.”
Kvantifikator „većina” nije izravno potvrđen.
-
Br. 44 — IZNOVA_IZVEDI_TVRDNJU
„Pollmann i suradnici personaliziranu interakciju razmatraju kao kompromis između pozitivnih učinaka na korisničko iskustvo i rizika za autonomiju i manipulaciju.”
Stav je potvrđen, ali izvor nije u bibliografskom popisu i treba ga navesti punim zapisom.
-
Br. 53 — IZBACI_TVRDNJU
„pohrana osjetljivih informacija koje korisnik nije očekivao da će biti trajno spremljene;”
Korpus podupire opće privatnosne rizike, ali ne ovu specifičnu tvrdnju.
-
Br. 61 — IZNOVA_IZVEDI_TVRDNJU
„Obavijest da korisnik komunicira s AI sustavom uređuje identitetsku transparentnost, ali sama po sebi ne daje objašnjenje o memoriji, profiliranju ili utjecaju tih elemenata na odgovor.”
Drugi dio je interpretativni zaključak, a ne izravan tekst članka 50.
-
Br. 84 — IZBACI_TVRDNJU
„Najinformativnija usporedba uključivala bi najmanje četiri uvjeta: generički odgovor, eksplicitno personalizirani odgovor, implicitno personalizirani odgovor i personalizirani odgovor s korisničkom kontrolom i objašnjenjem.”
Otvoreni izvori podupiru odvajanje stvarne i doživljene personalizacije, ali ne propisuju četiri uvjeta.
Nizvodna obveza: Br. 17, 53 i 84 ostaju izbačeni. Formulacije iz br. 3, 4, 5, 21, 27, 29, 32, 35, 39, 44 i 61 moraju ostati u suženom obliku. Nije dopušteno ponovno uvesti „pogrešnu atribuciju sposobnosti”, „najstabilniji učinak”, četiri eksperimentalna uvjeta ni tvrdnju da personalizirani prikazi dobivaju više ocjene.
§1 Presuda po napadima
-
Različiti fenomeni prikazani su kao personalizacija u cjelini
Presuda: napad traži ogradu. Meta postoji, ali središnja teza već je ograničena na pojedine zadatke i populacije, a dokument razlikuje personu agenta, modeliranje korisnika i kontekstualnu prilagodbu. Ipak, pisac mora izrijekom navesti da se zaključak odnosi na pojedine oblike prilagodbe, a ne na personalizaciju kao jedinstvenu intervenciju.
Obvezna ograda: „Ova se tvrdnja odnosi na pojedine oblike prilagodbe, a ne na personalizaciju kao jedinstvenu intervenciju.”
-
Relevantnost je proglašena „najstabilnijim” učinkom
Presuda: napad stoji. Izraz „najstabilniji” komparativna je tvrdnja bez usporednog dokaza među metodama, zadacima i populacijama. Mora se ukloniti iz odjeljka o mehanizmima.
Obvezna zamjena: „Povećanje relevantnosti jedan je od mogućih učinaka personalizacije, ali njegova stabilnost među zadacima i populacijama nije utvrđena.”
-
Memorija je predstavljena kao trajni profil bez vlastite potpore
Presuda: napad stoji. Navedeni izvori ne dokazuju da memorija smanjuje ponavljanje ili povećava kontinuitet, a dohvaćanje prethodnog konteksta ne mora stvarati trajni profil. Odjeljak se smije zadržati samo kao opis tehničkog i upravljačkog problema.
Obvezna zamjena: „Ovaj pristup može služiti kontinuitetu razgovora, ali trajanje pohrane, profiliranje i prava korisnika ovise o konkretnom dizajnu sustava.”
-
Personalizacija preširoko navodno zahtijeva osobne podatke
Presuda: napad stoji. Tvrdnja je preširoka jer dokument priznaje da se neke kontekstualne prilagodbe mogu odvijati bez trajnog profila. Privatnosna analiza mora se vezati uz profile, memoriju i zaključene osobine, a ne uz personalizaciju općenito.
Obvezna zamjena: „Oblici personalizacije koji koriste profile, memoriju ili zaključene osobine uključuju obradu osobnih podataka, dok se neke kontekstualne prilagodbe mogu odvijati bez trajnog profila.”
-
Persona-pristranost proširuje se na personalizaciju općenito
Presuda: napad stoji. Wan i Sheng podupiru rizik kod određenih persona-modela, ali ne dokazuju da svaki oblik personalizacije povećava pristranost. Tvrdnja mora biti ograničena na profiliranje i zadavanje persone gdje je takav rizik izravno ispitan.
Obvezna zamjena: „Određeni oblici profiliranja i zadavanja persone mogu povećati pristranostne rizike, dok se učinak drugih oblika personalizacije mora zasebno mjeriti.”
-
Očekivanja afektivnih agenata nisu nalazi o zadovoljstvu ili učinkovitosti
Presuda: napad pada. Dokument Hernandez i suradnike koristi samo za tvrdnju da preferencije i prihvatljivost ovise o kontekstu te izrijekom navodi da rad ne mjeri dugoročnu učinkovitost. Nije potrebna izmjena ako se postojeća ograda zadrži.
-
Siro i suradnici ne dokazuju učinak personalizacije
Presuda: napad pada kao prigovor na zaključak koji tekst ne izvodi. Siro i suradnici koriste se za razlaganje konstrukta zadovoljstva, ne za tvrdnju da personalizacija poboljšava neku od njegovih dimenzija. Postojeća formulacija ne smije se proširiti u empirijski zaključak o personalizaciji.
-
Smanjenje kognitivnog opterećenja napisano je kao potvrđeni mehanizam
Presuda: napad stoji. Dokument navodi da taj učinak tek treba mjeriti, ali ga u odjeljku o mehanizmima prikazuje kao objašnjenje koristi. Mora se pretvoriti u hipotezu za buduće testiranje.
Obvezna zamjena naslova i tvrdnje: „Hipoteza o smanjenju kognitivnog opterećenja: prilagodba razine detalja i formata mogla bi smanjiti potrebu za dodatnim pojašnjenjima, ali to zahtijeva zasebno mjerenje.”
-
Socijalna prisutnost, antropomorfizam i povjerenje spojeni su u nedokazan uzročni lanac
Presuda: napad stoji. Araujo i Bol pratili su više varijabli, ali iz toga ne slijedi dokazan lanac od toplijeg stila do privatnosnog rizika. Tekst mora razlikovati povezanost, istodobno mjerenje i uzročni učinak.
Obvezna zamjena: „Topliji i osobniji stil može biti povezan s većom društvenom prisutnošću ili povjerenjem, ali navedene varijable ne dokazuju same po sebi uzročni lanac prema antropomorfizmu, samootkrivanju i privatnosnom riziku.”
-
Tvrdnja „što je sustav osobniji, to je veća potreba za podacima” nije usklađena s pojmovnim razgraničenjem
Presuda: napad stoji. Rečenica uvodi linearno pravilo koje ne vrijedi za eksplicitnu ili kratkotrajnu kontekstualnu prilagodbu. Potreba za podacima mora se vezati uz konkretnu metodu personalizacije.
Obvezna zamjena: „Potreba za podacima ili zaključivanjem ovisi o načinu personalizacije; trajna memorija i profiliranje stvaraju veći opseg obrade nego prilagodba trenutačnom kontekstu ili izričitom zahtjevu korisnika.”
-
Odjeljak o učinkovitosti ne dokazuje opću učinkovitost
Presuda: napad pada. Dokument već izrijekom ograničava nalaz na određenu populaciju i navodi da se iz njega ne može zaključiti da personalizacija općenito povećava učinkovitost svih konverzacijskih AI sustava. Odjeljak ipak ne smije izvan tog opsega izvoditi tvrdnje o svim sustavima.
-
Rizik manipulacije nije isto što i dokaz manipulativnog učinka
Presuda: napad pada, uz obvezno zadržavanje modalnog i normativnog statusa tvrdnje. Rečenica govori da prilagođeni odgovor „može” prijeći u manipulaciju i nalazi se u raspravi o etičkom riziku, a ne u odjeljku empirijskih nalaza. Ne smije se preoblikovati u tvrdnju da personalizacija uzrokuje manipulaciju.
-
Ograda o benchmarkovima nije dosljedno primijenjena
Presuda: napad stoji. Benchmark-rezultati ne smiju se koristiti kao izravan dokaz stvarnog ili dugoročnog korisničkog iskustva. Uz nalaze Kwonova, Choova i srodnih radova mora se jasno navesti odnose li se na modelsko ponašanje ili na stvarne korisničke ishode.
Obvezna ograda: „Ovaj rezultat odnosi se na modelsko ponašanje ili evaluacijske uvjete, a ne sam po sebi na stvarno korisničko iskustvo.”
-
„Minimalni eksperimentalni dizajn” nakon izmjena više nije dizajn
Presuda: napad stoji. Nakon uklanjanja četiriju uvjeta odjeljak sadržava samo zahtjev za odvojeno mjerenje stvarne kvalitete i doživljene personalizacije. Naslov mora biti promijenjen.
Obvezna zamjena naslova: „Preporučene mjere za buduće eksperimente”.
-
Upravljačke preporuke prikazane su kao empirijski potvrđen sigurnosni paket
Presuda: napad stoji. GDPR, EDPB, NIST i radionicaški rad imaju različite funkcije: pravni okvir, službeno mišljenje, upravljački okvir i argumentacijsku raspravu. Preporuka se mora formulirati kao normativni i upravljački prijedlog, a ne kao empirijski dokaz da svaki element smanjuje konkretan rizik.
Obvezna zamjena: „Sigurniji dizajn trebao bi razmotriti korisničku kontrolu, ograničavanje podataka, ispravak i brisanje profila, praćenje pristranosti te odvojeno testiranje korisničkog iskustva i štetnih ishoda.”
-
Otvorena pitanja ne popravljaju navodno neizmjerene zaključke
Presuda: napad pada. Pitanja o dugoročnom učinku na autonomiju i o pogrešnom pripisivanju emocija izrijekom su predstavljena kao otvorena pitanja, rizici ili ograničenja, a ne kao utvrđeni učinci. Nije potrebna izmjena, ali se ta pitanja ne smiju pretvoriti u zaključke u drugim dijelovima rada.
-
„Odgovorna i proporcionalna personalizacija” nije izvedena kao kriterij
Presuda: napad stoji. Dokument ne definira prag proporcionalnosti ni postupak vaganja koristi i rizika. Zaključak smije ponuditi samo kriterije za razmatranje proporcionalnosti.
Obvezna zamjena: „Zaključak: kriteriji za razmatranje odgovorne i proporcionalne personalizacije.”
§2 Što preživi
Tvrdnje koje prežive
- Personalizacija je heterogena skupina postupaka, a ne jedna tehnika.
- Eksplicitni profil, implicitno zaključivanje, memorija, prilagodba stila, persona agenta, afektivna personalizacija i modelna personalizacija moraju se analizirati kao različite intervencije.
- Implicitna persona izvedena iz povijesti dijaloga modelska je procjena, a ne izravno opažena činjenica.
- Učinak prilagodbe može ovisiti o zadatku, populaciji, kontekstu i vrsti intervencije.
- Očekivanja korisnika nisu isto što i stvarna učinkovitost sustava.
- Benchmark-rezultati nisu isto što i dugoročno korisničko iskustvo.
- Relevantnost nije jednaka točnosti.
- Osobni detalji mogu povećati doživljenu relevantnost i uvjerljivost, ali to samo po sebi ne potvrđuje sadržajnu točnost odgovora.
- Privatnosni rizici legitimno su povezani s profilima, memorijom, zaključivanjem o korisniku i sekundarnom uporabom podataka, ali samo kada konkretni oblik sustava takvu obradu doista uključuje.
- Određeni persona-modeli mogu proizvesti persona-pristranost; učinak persone nije nužno uvijek štetan niti uvijek koristan.
- Identitetska, podatkovna i učinska transparentnost nisu ista stvar.
- GDPR, Akt o umjetnoj inteligenciji, EDPB i NIST imaju različite normativne i upravljačke funkcije i ne smiju se prikazivati kao jedinstveni empirijski dokaz.
- Za evaluaciju treba odvojeno mjeriti stvarnu kvalitetu odgovora, korisničko iskustvo, privatnost, pristranost i štetne ishode.
Tvrdnje koje ne prežive u izvornom obliku
-
„Najstabilniji očekivani učinak personalizacije jest povećanje relevantnosti.”
Postupak: ukloniti komparativ „najstabilniji” i primijeniti zaključanu zamjenu iz br. 31 i presude napada 2.
-
„Memorija može smanjiti ponavljanje informacija i povećati kontinuitet.”
Postupak: suziti. Dopušten je samo opis mogućeg dizajnerskog cilja, bez tvrdnje da je učinak empirijski potvrđen.
-
„Personalizacija često zahtijeva obradu osobnih podataka ili zaključivanje o korisniku.”
Postupak: suziti na profile, memoriju i zaključene osobine; izuzeti kratkotrajnu kontekstualnu prilagodbu i izričite zahtjeve korisnika.
-
„Personalizacija može povećati pristranostne rizike” kao opća tvrdnja o svim oblicima personalizacije.
Postupak: suziti na određene oblike profiliranja i zadavanja persone.
-
„Prilagodba razine detalja i formata može smanjiti kognitivno opterećenje.”
Postupak: ograditi kao hipotezu koja zahtijeva zasebno mjerenje; ne prikazivati kao potvrđeni mehanizam.
-
Uzročni lanac od toplijeg stila do društvene prisutnosti, antropomorfizma, pretjeranog povjerenja, samootkrivanja i privatnosnog rizika.
Postupak: ograditi. Dopuštena je tvrdnja o mogućoj povezanosti, ne o dokazanom uzročno-posljedičnom slijedu.
-
„Što je sustav osobniji, to je veća potreba za podacima ili zaključivanjem.”
Postupak: ukloniti linearno pravilo i zamijeniti ga formulacijom koja razlikuje trajnu memoriju, profiliranje, trenutačni kontekst i izričit korisnički zahtjev.
-
„Minimalni eksperimentalni dizajn”.
Postupak: preimenovati u „Preporučene mjere za buduće eksperimente”. Ne predstavljati postojeći odjeljak kao potpun dizajn.
-
„Sigurniji dizajn zahtijeva...” kao empirijski potvrđen paket mjera.
Postupak: preoblikovati u normativnu preporuku: „Sigurniji dizajn trebao bi razmotriti...”
-
„Kriteriji za odgovornu i proporcionalnu personalizaciju.”
Postupak: preoblikovati u „Kriteriji za razmatranje odgovorne i proporcionalne personalizacije.”
Tvrdnje koje ostaju izbačene
- Eksperiment s filmskim preporukama pokazao je više ocjene kada su iste preporuke predstavljene kao personalizirane.
- Pohrana osjetljivih informacija koje korisnik nije očekivao da će biti trajno spremljene.
- Usporedba koja bi obvezno uključivala najmanje četiri uvjeta: generički odgovor, eksplicitno personalizirani odgovor, implicitno personalizirani odgovor i personalizirani odgovor s korisničkom kontrolom i objašnjenjem.
- Rizik pogrešne atribucije sposobnosti sustavu, osim ako se u nekoj budućoj fazi ne pribavi zaseban izvor; u ovom radu ne vraća se.
§3 Odluka
TEZA TRAŽI OGRADU.
Središnja teza može ostati jer je već sužena na povezanost u pojedinim zadacima i populacijama, a ne tvrdi opću nadmoć personaliziranih odgovora. Međutim, cijeli rad mora dosljedno primjenjivati ogradu da se dokazi odnose na pojedine oblike prilagodbe, a ne na personalizaciju kao jedinstvenu intervenciju.
Obvezne ograde odnose se na doseg personalizacije, razliku između modelske evaluacije i stvarnog korisničkog iskustva, razliku između očekivanja i učinka, razliku između povezanosti i uzročnosti te razliku između normativne preporuke i empirijski potvrđene mjere. Bez tih ograda teza bi ponovno postala šira od literature.
§4 Uputa za pisanje
Piši da je personalizacija u pojedinim oblicima, zadacima i populacijama povezana s boljom relevantnošću ili doživljajem interakcije, ali nemoj tvrditi da je općenito bolja od generičkog odgovora. Svaki nalaz označi prema razini dokaza: modelsko ponašanje, očekivanje korisnika, kratka korisnička studija, longitudinalno praćenje, pravni okvir ili normativna preporuka. Memoriju, profiliranje, afektivnu procjenu i personu obrađuj odvojeno; ne pretvaraj ih u jedan zajednički učinak personalizacije. Sve tvrdnje o učinkovitosti, kognitivnom opterećenju, povjerenju, autonomiji, manipulaciji i pristranosti ograniči na ono što konkretni izvor doista pokazuje, a uzročne lance zamijeni tvrdnjama o mogućim povezanostima ili hipotezama.
§5 Pokrivenost poglavlja
U dostavljenoj provjeri literature nije priložena zasebna numerička matrica pokrivenosti poglavlja. Stoga se ne može navesti numerička razlika između postojeće i nove procjene. Sljedeća procjena usklađuje status poglavlja s izvorima i zaključanim odlukama iz provjere literature.
-
Uvod i središnja teza — POKRIVENO. Postoji sužena teza i ograničenje da personalizirani odgovor nije općenito bolji od generičkog.
-
Pojmovno razgraničenje — POKRIVENO. Izvori i tekst razlikuju personalizaciju korisnika, personu agenta, kontekstualnu prilagodbu, implicitne signale i percipiranu personalizaciju. Pri pisanju treba zadržati ta razgraničenja.
-
Eksplicitni profil — TANKO. U radu postoji opis metode, ali nema zasebnog empirijskog nalaza koji bi pokazao njezin učinak na korisničko iskustvo.
-
Implicitno zaključivanje i persona korisnika — POKRIVENO. Cho i suradnici podupiru opis implicitne persone i konkretne evaluacijske rezultate, uz obveznu ogradu da je riječ o modelskoj procjeni.
-
Memorija i dohvaćanje prethodnih interakcija — TANKO. Nakon presude ne smiju ostati nepodržane tvrdnje o smanjenju ponavljanja, povećanju kontinuiteta ili nužnom stvaranju trajnog profila. Poglavlje je prikladno samo kao opis dizajnerskog i upravljačkog problema.
-
Prilagodba komunikacijskog stila — POKRIVENO. Gross i suradnici daju kontekstualni dokaz za određenu populaciju pacijenata s KOPB-om. Nalaz se ne smije generalizirati na sve sustave, populacije ili oblike učinkovitosti.
-
Persona i stil agenta — POKRIVENO. Kwonov rad daje dokaz o konkretnoj arhitekturi i njezinim evaluacijskim uvjetima, ne o dugoročnom korisničkom iskustvu općenito.
-
Afektivna personalizacija — POKRIVENO. Li, Waleed i Salam te rad o afektivnom prepoznavanju podupiru klasifikaciju pristupa i ograničenja generalizacije. Afektivno prepoznavanje mora se opisivati kao kontekstualno ograničena procjena.
-
Modelna personalizacija — POKRIVENO. Pregled personaliziranog afektivnog računarstva podupire razliku između podatkovnih i modelnih pristupa.
-
Relevantnost i kvaliteta odgovora — TANKO. Relevantnost može ostati kao mogući učinak, ali ne kao najstabilniji učinak i ne kao zamjena za točnost. Benchmark-nalazi ne smiju se prikazivati kao dokaz stvarnog korisničkog iskustva.
-
Učinkovitost komunikacije — TANKO. Gross i suradnici podupiru ograničeni nalaz o interakcijskim ishodima u specifičnoj zdravstvenoj populaciji. Nema osnove za opću tvrdnju o vremenu, broju izmjena ili izvršenju zadatka u svim konverzacijskim AI sustavima.
-
Zadovoljstvo, povjerenje i nastavak uporabe — POKRIVENO uz ogradu. Siro i suradnici mogu poduprijeti razlaganje konstrukta zadovoljstva, a Araujo i Bol važnost longitudinalnog praćenja više varijabli. Ne smiju se izvoditi uzročni lanci ni tvrdnja da personalizacija poboljšava sve navedene ishode.
-
Privatnost, zaštita podataka i profiliranje — POKRIVENO uz ogradu. GDPR, EDPB i Hendrickx i suradnici podupiru analizu podataka, svrhe, kontrole, memorije i profiliranja. Tvrdnje se moraju odnositi na one oblike personalizacije koji doista obrađuju ili zaključuju osobne podatke.
-
Persona-pristranost i jednakost — POKRIVENO uz ogradu. Wan i Sheng podupiru rizike konkretnih persona-modela, uključujući mogućnost da persona u nekim slučajevima smanji, a u drugima poveća štetne odgovore. Ne smije se iz toga izvesti opća tvrdnja o svim oblicima personalizacije.
-
Transparentnost i objašnjivost — POKRIVENO. Akt o umjetnoj inteligenciji podupire identitetsku transparentnost, dok tekstualno razgraničenje podatkovne i učinske transparentnosti ostaje kao analitički okvir. Ne tvrditi da članak 50. sam propisuje potpuno objašnjenje memorije ili profiliranja.
-
Mehanizmi koristi — TANKO. Relevantnost ostaje mogući učinak, kognitivno opterećenje hipoteza, a socijalna prisutnost i povjerenje moguće povezanosti bez dokazanog uzročnog lanca.
-
Metodološka ograničenja — POKRIVENO. Tekst ima dostatnu potporu za razlikovanje benchmarka, kratkih studija, očekivanja, stvarnih ishoda i dugoročne uporabe. Ograda mora se primjenjivati jednako u svim prethodnim poglavljima.
-
Preporučeni istraživački standard — TANKO. Poglavlje može navesti preporučene mjere, ali ne smije se predstavljati kao minimalni eksperimentalni dizajn. Izbačeni četverostruki dizajn ne vraća se.
-
Otvorena pitanja — POKRIVENO. Pitanja o autonomiji, afektivnoj procjeni, memoriji, implicitnim zaključcima i dugoročnim učincima primjereno ostaju otvorena pitanja, a ne zaključeni nalazi.
-
Zaključak i kriteriji proporcionalnosti — TANKO. Zaključak smije ponuditi kriterije za razmatranje proporcionalnosti, ali ne smije tvrditi da je izveden ili dokazan standard odgovorne proporcionalne personalizacije.
Napomena o poglavlju bez izvora: Nijedno od navedenih poglavlja nije označeno kao NENAPISIVO ili BEZ DODJELE jer u odobrenom radu postoji barem neki relevantan izvor ili jasno razgraničen normativni okvir. Memorija, mehanizmi koristi i eksperimentalni standard ostaju TANKI; ne smiju se pisati kao empirijski zaključci.
§6 Kontrolna lista za provjeru nakon pisanja
Svaka stavka mora biti provjerljiva čitanjem gotovog teksta, bez ponovnog pristupa izvorima.
-
Provjerljiva tvrdnja: Središnja teza izrijekom kaže da se odnosi na pojedine oblike prilagodbe, zadatke i populacije, a ne na personalizaciju kao jedinstvenu intervenciju.
Gdje provjeriti: sažetak, uvod, zaključak.
-
Provjerljiva tvrdnja: U radu se nigdje ne tvrdi da je personalizirani odgovor općenito bolji od generičkog.
Gdje provjeriti: središnja teza, rasprava, zaključak.
-
Provjerljiva tvrdnja: Tvrdnja da je povećanje relevantnosti „najstabilniji” učinak ne pojavljuje se ni u jednoj formulaciji.
Gdje provjeriti: odjeljci o korisničkom iskustvu i mehanizmima.
-
Provjerljiva tvrdnja: Relevantnost se ne izjednačuje s točnošću, a osobni detalji ne predstavljaju dokaz sadržajne točnosti odgovora.
Gdje provjeriti: odjeljak o relevantnosti i zaključak.
-
Provjerljiva tvrdnja: Memorija se opisuje kao mogući način služenja kontinuitetu razgovora, bez tvrdnje da nužno smanjuje ponavljanje ili povećava kontinuitet.
Gdje provjeriti: odjeljak o memoriji i odjeljak o privatnosti.
-
Provjerljiva tvrdnja: Nigdje se ne tvrdi da svaki oblik personalizacije zahtijeva osobne podatke ili trajni profil.
Gdje provjeriti: pojmovno razgraničenje, privatnost, zaključak.
-
Provjerljiva tvrdnja: Tvrdnje o privatnosnim rizicima povezane su s profilima, memorijom, zaključivanjem ili drugim konkretnim oblikom obrade, a ne s personalizacijom općenito.
Gdje provjeriti: središnja teza, privatnost, zaključak.
-
Provjerljiva tvrdnja: Tvrdnje o pristranosti ograničene su na određene oblike profiliranja i zadavanja persone.
Gdje provjeriti: odjeljak o personi-pristranosti i odjeljak o jednakom tretmanu.
-
Provjerljiva tvrdnja: Persona-pristranost nije predstavljena kao nužan ishod svake personalizacije.
Gdje provjeriti: rasprava, zaključak.
-
Provjerljiva tvrdnja: Afektivno prepoznavanje opisuje se kao kontekstualno ograničena procjena, a ne kao izravno mjerenje unutarnjeg stanja korisnika.
Gdje provjeriti: odjeljak o afektivnoj personalizaciji.
-
Provjerljiva tvrdnja: Očekivanja i preferencije korisnika kod Hernandez i suradnika nisu predstavljeni kao dokaz dugoročne učinkovitosti, zadovoljstva ili stvarnog ponašanja.
Gdje provjeriti: odjeljak o afektivnim agentima i zaključak empirijskog dijela.
-
Provjerljiva tvrdnja: Nalazi Siro i suradnika služe za razlaganje dimenzija zadovoljstva, ne kao dokaz učinka personalizacije.
Gdje provjeriti: odjeljak o zadovoljstvu.
-
Provjerljiva tvrdnja: Kognitivno opterećenje označeno je kao hipoteza ili mogući učinak koji zahtijeva zasebno mjerenje.
Gdje provjeriti: odjeljak o učinkovitosti i odjeljak o mehanizmima.
-
Provjerljiva tvrdnja: U radu ne postoji tvrdnja da je uzročni lanac od toplijeg stila do privatnosnog rizika dokazan.
Gdje provjeriti: odjeljak o povjerenju, antropomorfizmu i samootkrivanju.
-
Provjerljiva tvrdnja: Linearno pravilo „što je sustav osobniji, to je veća potreba za podacima” ne pojavljuje se u gotovom tekstu.
Gdje provjeriti: odjeljak o privatnosti i memoriji.
-
Provjerljiva tvrdnja: Nalaz Grossa i suradnika ograničen je na određenu populaciju i interakcijske ishode u zdravstvenom kontekstu.
Gdje provjeriti: odjeljak o učinkovitosti.
-
Provjerljiva tvrdnja: Benchmark-rezultati Kwonova i Choova rada nisu predstavljeni kao samostalan dokaz dugoročnog korisničkog iskustva.
Gdje provjeriti: odjeljci o metodama, korisničkom iskustvu i metodološkim ograničenjima.
-
Provjerljiva tvrdnja: U odjeljku o istraživačkom standardu ne postoji naslov „Minimalni eksperimentalni dizajn”, nego „Preporučene mjere za buduće eksperimente”.
Gdje provjeriti: metodološki odjeljak.
-
Provjerljiva tvrdnja: Izbačena je tvrdnja o četiri obvezna eksperimentalna uvjeta i nije vraćena u drugom obliku.
Gdje provjeriti: metodološki odjeljak, zaključak.
-
Provjerljiva tvrdnja: Upravljačke preporuke formulirane su kao ono što bi sigurniji dizajn trebao razmotriti, a ne kao empirijski potvrđen paket mjera.
Gdje provjeriti: odjeljak o upravljanju i zaključak.
-
Provjerljiva tvrdnja: GDPR, Akt o umjetnoj inteligenciji, EDPB i NIST nisu predstavljeni kao izvori iste vrste ili kao jedinstveni empirijski dokaz.
Gdje provjeriti: pravni i upravljački odjeljci.
-
Provjerljiva tvrdnja: Otvorena pitanja o autonomiji i afektivnoj procjeni ostaju otvorena pitanja, a ne zaključeni empirijski nalazi.
Gdje provjeriti: odjeljak o otvorenim pitanjima i zaključak.
-
Provjerljiva tvrdnja: U radu se ne tvrdi da je razvijen ili dokazan standard proporcionalnosti.
Gdje provjeriti: završni odjeljak i zaključak.
-
Provjerljiva tvrdnja: Završna formulacija glasi „kriteriji za razmatranje odgovorne i proporcionalne personalizacije”, a ne „kriteriji za odgovornu i proporcionalnu personalizaciju”.
Gdje provjeriti: struktura završnog poglavlja i zaključak.
-
Provjerljiva tvrdnja: U gotovom tekstu ne pojavljuje se izbačena tvrdnja o višim ocjenama filmskih preporuka predstavljenih kao personalizirane.
Gdje provjeriti: cijeli tekst.
-
Provjerljiva tvrdnja: U gotovom tekstu ne pojavljuje se izbačena tvrdnja o pohrani osjetljivih informacija koje korisnik nije očekivao trajno spremiti.
Gdje provjeriti: cijeli tekst.
-
Provjerljiva tvrdnja: U gotovom tekstu ne pojavljuje se formulacija o pogrešnoj atribuciji sposobnosti sustavu.
Gdje provjeriti: cijeli tekst.
-
Provjerljiva tvrdnja: Nijedan zaključak u raspravi ili zaključku nije širi od dosega izvora i ograda uvedenih u pripadajućem poglavlju.
Gdje provjeriti: rasprava, zaključak, sažetak.