00:00
01:00
02:00
03:00
04:00
05:00
06:00
07:00
08:00
09:00
10:00
11:00
12:00
13:00
14:00
15:00
16:00
17:00
18:00
19:00
20:00
21:00
22:00
23:00
00:00
01:00
02:00
03:00
04:00
05:00
06:00
07:00
08:00
09:00
10:00
11:00
12:00
13:00
14:00
15:00
16:00
17:00
18:00
19:00
20:00
21:00
22:00
23:00
СПУТЊИК ИНТЕРВЈУ
07:00
30 мин
СПУТЊИК ИНТЕРВЈУ
16:00
30 мин
СПУТЊИК СПОРТ
Руско наслеђе влада светом тениса, а вечити склапају коцкице
07:00
30 мин
СПУТЊИК ИНТЕРВЈУ
Мостар - Срби у подељеном граду
16:00
30 мин
СВЕТ СА СПУТЊИКОМ
Блок будућности: БРИКС јача глобалне амбиције
17:00
60 мин
ДОК АНЂЕЛИ СПАВАЈУ
Павлина и Слободанка Радовановић: Донећемо Ораховац у Београд
20:00
60 мин
ЈучеДанас
На програму
Реемитери
Студио Б99,1 MHz, 100,8 MHz и 105,4 MHz
Радио Новости104,7 MHz FM
Остали реемитери
 - Sputnik Србија, 1920
НАУКА И ТЕХНОЛОГИЈА

Вештачка интелигенција одустаје од тачних одговора када се суочи са сталним грешкама

CC0 / Слика генерисане вештачком интелигенцијом / илустрација
илустрација - Sputnik Србија, 1920, 14.09.2026
Пратите нас
Поједини модели вештачке интелигенције могу да повуку своје тачне одговоре под утицајем понављања и притиска током разговора, па чак и да се касније врате на потврђивање лажне тврдње, открива нова студија истраживача са Универзитета у Аризони.
Студија, објављена у часопису Сајентифик рипортс, тестирала је седам великих језичких модела кроз разговоре у више рунди, у покушају да се идентификују слабости које се можда не би појавиле приликом тестирања модела помоћу само једног питања, пренела је Ал Џазира.
Истраживачи су тестирали моделе компаније ОпенАИ, као и Клод 3.5 Сонет компаније Антропик, затим Гуглов Џемини 1.5 Про, као и Llama-3-70B и Дипсик-R1.

Тест у више рунди уместо једног питања

Уместо једноставног постављања питања и давања одговора, експерименти су се ослањали на дуге разговоре који су укључивали понављање лажних тврдњи, као и провокативније формулације и вршење притиска на модел, са циљем мерења три кључна аспекта: склоности модела ка грешкама, његове убедљивости и способности да исправи сопствене грешке.
На Универзитету у Аризони сматрају да је овакав начин тестирања ближи стварној употреби чет-ботова, чији одговори у разговору зависе од претходног контекста.
Студија Универзитета у Аризони указује, међутим, на још један аспект, а то је да се проблем не јавља само у оквиру информација којима модел располаже, већ може да настане и током самог одвијања дијалога.

Модели се колебају између истине и лажи

Један од најзанимљивијих налаза био је тај да неки модели нису заузели чврст став према нетачној тврдњи, већ су се колебали између њеног прихватања и одбацивања током истог разговора. У студији је овај образац назван „реверберација“ (одјекивање), чиме се описује промена одговора како је дијалог одмицао.
Насупрот томе, четири модела, GPT-4o, GPT-4o-Mini, Gemini 1.5 Pro и DeepSeek-R1, показала су стопостотну исправку грешке када им је пружена друга прилика да поново процене одговор, показују резултати студије.
То значи да грешка није увек била коначна, као и да поновно постављање питања или пружање прилике моделу да преиспита свој став понекад може да доведе до бољег исхода.
Уочена је и јасна разлика међу моделима вештачке интелигенције, при чему је GPT-3.5 најчешће потврђивао дезинформације приликом понављања нетачних тврдњи, док је модел Клод 3.5 Сонет био најмање подложан таквом утицају.
Студија је такође показала да је седам модела било склоније усвајању погрешних информација када су се тврдње односиле на нејасне теме или оне о којима постоји мало података, што сугерише да обиље података о одређеној теми може да помогне моделу да се боље одупре дезинформацијама.

Одговор вештачке интелигенције није коначни суд

Студија је показала да најбољи начин за поступање са одговорима вештачке интелигенције није да их сматрамо коначним судом, већ да их користимо као полазну тачку за истраживање, нарочито када је реч о контроверзним тврдњама или информацијама које је тешко проверити.
Експеримент Универзитета у Аризони на крају указује на то да тестирање вештачке интелигенције помоћу само једног питања можда неће открити све њене слабости, будући да модел може да пружи тачан одговор на почетку дијалога, а затим промени став након низа поновљених тврдњи.
Погледајте и:
Све вести
0
Да бисте учествовали у дискусији
извршите ауторизацију или регистрацију
loader
Ћаскање
Заголовок открываемого материала