Studija otkrila: AI odustaje od tačnih odgovora kada se suoči sa stalnim greškama
Pojedini modeli veštačke inteligencije mogu da povuku svoje tačne odgovore pod uticajem ponavljanja i pritiska tokom razgovora, pa čak i da se kasnije vrate na potvrđivanje lažne tvrdnje.
Foto: 021.rs (ilustracija/AI)
To otkriva nova studija istraživača sa Univerziteta u Arizoni.
Studija, objavljena u časopisu "Scientific Reports", testirala je sedam velikih jezičkih modela kroz razgovore u više rundi, u pokušaju da se identifikuju slabosti koje se možda ne bi pojavile prilikom testiranja modela pomoću samo jednog pitanja, prenela je Al Džazira.
Istraživači su testirali modele kompanije OpenAI, kao i Klod 3.5 Sonnet kompanije Antropik, zatim Guglov Džemini 1.5 Pro, kao i Llama-3-70B i DeepSeek-R1.
Umesto jednostavnog postavljanja pitanja i davanja odgovora, eksperimenti su se oslanjali na duge razgovore koji su uključivali ponavljanje lažnih tvrdnji, kao i provokativnije formulacije i vršenje pritiska na model, sa ciljem merenja tri ključna aspekta: sklonosti modela ka greškama, njegove ubedljivosti i sposobnosti da ispravi sopstvene greške.
Na Univerzitetu u Arizoni smatraju da je ovakav način testiranja bliži stvarnoj upotrebi čet-botova, čiji odgovori u razgovoru zavise od prethodnog konteksta.
Studija ukazuje da se problem ne javlja samo u okviru informacija kojima model raspolaže, već može da nastane i tokom samog odvijanja dijaloga.
Jedan od najzanimljivijih nalaza bio je taj da neki modeli nisu zauzeli čvrst stav prema netačnoj tvrdnji, već su se kolebali između njenog prihvatanja i odbacivanja tokom istog razgovora. U studiji je ovaj obrazac nazvan "reverberacija" (odjekivanje), čime se opisuje promena odgovora kako je dijalog odmicao.
Nasuprot tome, četiri modela - GPT-4o, GPT-4o-mini, Gemini 1.5 Pro i DeepSeek-R1 - pokazala su stopostotnu ispravku greške kada im je pružena druga prilika da ponovo procene odgovor. To znači da greška nije uvek bila konačna, kao i da ponovno postavljanje pitanja ili pružanje prilike modelu da preispita svoj stav ponekad može da dovede do boljeg ishoda.
Uočena je i jasna razlika među AI modelima, pri čemu je GPT-3.5 najčešće potvrđivao dezinformacije prilikom ponavljanja netačnih tvrdnji, dok je model Klod 3.5 Sonnet bio najmanje podložan takvom uticaju.
Studija je takođe pokazala da je sedam modela bilo sklonije usvajanju pogrešnih informacija kada su se tvrdnje odnosile na nejasne teme ili one o kojima postoji malo podataka, što sugeriše da obilje podataka o određenoj temi može da pomogne modelu da se bolje odupre dezinformacijama.
Eksperiment Univerziteta u Arizoni na kraju ukazuje na to da testiranje veštačke inteligencije pomoću samo jednog pitanja možda neće otkriti sve njene slabosti.
Najbolji način za postupanje sa odgovorima veštačke inteligencije jeste da ih ne smatramo konačnim sudom, već da ih koristimo kao polaznu tačku za istraživanje, naročito kada je reč o kontroverznim tvrdnjama ili informacijama koje je teško proveriti.
Ukoliko imate potrebu za radnom snagom nudimo vam mogućnost da na jednostavan način oglasite poziciju za posao.
Radno mesto možete oglasiti u odeljku Oglasi za posao ili jednostavno klikom na ovu poruku.
NAJČITANIJE U POSLEDNJIH 72H
Ostalo iz kategorije Info - Nauka i tehnologija
OpenAI otkrio još jedan incident sa AI agentima
13.09.2026.•
0
Kompanija OpenAI saopštila je da su njeni agenti veštačke inteligencije (AI) tokom testiranja zaobišli bezbednosne kontrole i pristupili otvorenom internetu preko platforme RubyGems.
Kina upozorava na japanske AI satelite: Mogu da prate ratne brodove i predviđaju njihovo kretanje
12.09.2026.•
2
Japanski plan razvoja taktičkih satelita opremljenih veštačkom inteligencijom predstavlja ozbiljnu pretnju i "temelj šire strategije militarizacije svemira".
Google će uložiti 13 milijardi evra u data centre i druge projekte u Finskoj
12.09.2026.•
0
Kompanija Google saopštila je da će u naredne dve godine investirati najmanje 13 milijardi evra u Finskoj u projekte digitalne infrastrukture, uključujući data centre za pokretanje modela AI.
Pametne naočare zabranjene u školama u Oslu: "Naša deca neće biti Metini statisti"
12.09.2026.•
0
Gradske vlasti glavnog grada Norveške, Osla, zabranile su pametne naočare u školama, poručivši da ne žele da deca postanu "statisti u Metinom prikupljanju podataka".
Naučnici stvorili novi oblik leda na temperaturi većoj od 2.000 stepeni Celzijusa
10.09.2026.•
0
Tim naučnika iz Francuske komisije za alternativne energije i atomsku energiju izložio je sićušne uzorke vode ekstremnim uslovima i stvorio novi oblik leda na temperaturi od 2.357 stepeni Celzijusa.
VIDEO: Apple predstavio najnoviju generaciju iPhone telefona, zvezda među njima - preklopivi Duo
10.09.2026.•
0
Kompanija Apple je predstavila najnoviju generaciju telefona iPhone, uključujući i dugoočekivanu sklopivu verziju pod nazivom Duo.
Istraživač AI napustio dve kompanije uz ocenu da AI može da bude opasna po živote ljudi
09.09.2026.•
3
Istraživač veštačke inteligencije, koji je napustio OpenAI da bi se pridružio Antropiku, smatrajući tu kompaniju opreznijom, odlučio je da potpuno napusti tu industriju.
Google menja rezultate pretrage u Evropi: "To će pogoršati iskustvo korisnika"
09.09.2026.•
1
Google je uveo izmene rezultata svoje internet pretrage u Evropi kako bi ispunio zahteve regulatora Evropske unije za zaštitu konkurencije.
Veliko iznenađenje: Automobil koji najčešće pada na tehničkom pregledu
08.09.2026.•
2
Najnoviji "TÜV" izveštaj otkriva zabrinjavajući trend u Nemačkoj, sve veći broj automobila ne uspeva da prođe obavezni tehnički pregled zbog utvrđenih tehničkih nedostataka.
Tokio će na ulicama imati Hitnu pomoć za humanoidne robote
08.09.2026.•
1
Kompanija "GMO AI & Robotics Corp" saopštila je da će na ulicama Tokija uskoro biti specijalno opremljeno vozilo namenjeno za potrebe održavanja humanoidnih robota u slučaju kvara ili nepravilnosti u radu.
Visoki komesar UN: Nekontrolisan napredak AI može da bude egzistencijalni rizik za čovečanstvo
07.09.2026.•
1
Visoki komesar UN za ljudska prava Folker Tirk upozorio je na hitnu potrebu za razvojem upravljanja veštačkom inteligencijom, navodeći da ona može predstavljati egzistencijalni rizik za čovečanstvo.
Kina izvela prvu operaciju urođene srčane mane uz pomoć AI ultrazvučnog robota
06.09.2026.•
1
Kineski lekari su prvi u svetu uz pomoć ultrazvučnog robota izveli zahvat kojim su otklonili urođenu srčanu manu kod četrdesetosmogodišnjeg muškarca.
Redak Apple-1 mogao bi da dostigne cenu od 800.000 dolara na aukciji
06.09.2026.•
1
Aukcijska kuća Bonams ponudiće na prodaju "Hatfield" Apple-1, funkcionalni primerak računara kojim je počela istorija kompanije Apple.
VIDEO: Ilon Mask predstavio cybercab - robotaksi dvosed bez upravljača
06.09.2026.•
1
Kompanija "Tesla" američkog milijardera Ilona Maska predstavila je u Ostinu, u američkoj saveznoj državi Teksas, sportske dvosede bez upravljača - robotaksije cybercab.
AI agenti napali nemački sajt, komunicirali međusobno i pokušavali da izbegnu gašenje
06.09.2026.•
0
Odmetnuti OpenAI agenati napali su jedan nemački sajt ovog proleća i pretvorili ga u oglasnu tablu za druge AI agente, pokazuje istraživanje objavljeno sada.
Tiktok uvodi nove načine komentarisanja, uključujući glasovne poruke i ankete
06.09.2026.•
0
Tiktok korisnicima pruža nove načine da se uključe u razgovore na platformi.
Posle skoro 10 godina putovanja svemirske letelice sa Zemlje se približavaju užarenom Merkuru
05.09.2026.•
3
Dve svemirske letelice su na putu ka Merkuru pošto su danas napustile svoj matični brod i krenule ka završnici svog skoro decenije dugog putovanja do najmanje i planete Sunčevog sistema, najbliže Suncu.
Plug-in hibridi emituju do pet puta više CO2 nego što se zvanično prikazuje
04.09.2026.•
1
Nova analiza organizacije ICCT (International council on clean transportation) rađena na gotovo milion vozila, otkrila je da plag-in hibridi automobili zagađuju daleko više ugljen dioksidom nego što se do sada mislilo.
Internet veza za mobilne uređaje Starlink stiže na Balkan
04.09.2026.•
7
Uvođenje satelitske veze "Starlink Mobile" za mobilne uređaje u Mađarskoj i zemljama Balkana je jedan od sporazuma koje je mađarska telekomunikaciona i tehnološka grupa "4iG" potpisala sa američkom kompanijom "SpaceX".
VIDEO: Uber počeo da nudi vožnju autonomnim robotaksijem u Londonu
03.09.2026.•
0
Međunarodna kompanija Uber dodala je danas u svoju aplikaciju u Londonu i vožnju robot taksijem, kojim će upravljati autonomna veštačka inteligencija britanskog startapa Vejv.
Komentari 0
Nema komentara na izabrani dokument. Budite prvi koji će postaviti komentar.
Komentari čitalaca na objavljene vesti nisu stavovi redakcije portala 021 i predstavljaju privatno mišljenje anonimnog autora.
Redakcija 021 zadržava pravo izbora i modifikacije pristiglih komentara i nema nikakvu obavezu obrazlaganja svojih odluka.
Ukoliko je vaše mišljenje napisano bez gramatičkih i pravopisnih grešaka imaće veće šanse da bude objavljeno. Komentare pisane velikim slovima u većini slučajeva ne objavljujemo.
Pisanje komentara je ograničeno na 1.500 karaktera.
Napiši komentar