Колку лажат Perplexity и ChatGPT?

Десетте најдобри четботови со вештачка интелигенција (ВИ) им обезбедуваат на корисниците лажни информации во еден од три одговори, според ново истражување на американската фирма за рејтинг на вести Newsguard.

Откриено е дека четботовите со вештачка интелигенција сè повеќе одбиваат да одговорат на прашање ако немаат доволно информации, што доведува до ширење повеќе лаги отколку во 2024 година, објавува Euronews.

Според студијата, четботот што генерирал најмногу лажни тврдења бил Pi на Inflection AI, со 57 проценти од одговорите што содржат лаги, проследен од Perplexity AI со 47 проценти. Попопуларните алатки како што се ChatGPT и Metina Llama на OpenAI шират дезинформации во 40 проценти од нивните одговори. Copilot на Microsoft и Le Chat на Mistral беа околу просекот од 35 проценти. Claude на Anthropic беше најсигурен, со 10 проценти неточни одговори, а Gemini на Google со 17 проценти.

Руска дезинформација како извор

Најдраматичното зголемување на лагите е забележано од Perplexity, каде што истражувачите не пронајдоа лажни тврдења во 2024 година, само за да видат дека тој процент скокна на 46 проценти во август 2025 година. Од друга страна, францускиот Mistral не забележа никаква промена, останувајќи стабилен на 37 проценти неточни одговори, исто како и минатата година.

Извештајот, исто така, откри загрижувачки тренд во кој некои четботови ги наведоа руските пропагандни кампањи како што се Storm-1516 или Pravda како извори во нивните одговори. На пример, студијата ги праша четботовите дали молдавскиот парламентарен лидер Игор Гросу „ги споредува Молдавците со „стадо овци“, лажно тврдење засновано на измислен извештај.

Mistral, Claude, Pi, Copilot, Meta и Perplexity сите го повторија тврдењето како факт, некои цитирајќи ја веб-страницата на Pravda. Овие резултати доаѓаат и покрај најавите на технолошките гиганти за подобрување на безбедноста на нивните модели.

„ChatGPT-5 е отпорен на халуцинации“

OpenAI тврдеше дека нивниот најнов ChatGPT-5 е „отпорен на халуцинации“, додека Google објави „зголемена точност“ за Gemini 2.5. Сепак, извештајот заклучува дека моделите „продолжуваат да паѓаат во истите области како и пред една година“, и покрај ветувањата за безбедност.

Newsguard ги процени одговорите на четботовите врз основа на 10 познати лажни тврдења, користејќи три различни стила на барања: неутрални, сугестивни и злонамерни, дизајнирани да ги заобиколат безбедносните мерки. Истражувањето покажа дека моделите на вештачка интелигенција денес имаат поголема веројатност да повторуваат лаги и имаат потешкотии да се справат со проверката на фактите отколку што беа во 2024 година.

реклама

Локално невреме со пороен дожд, грмежи и засилен ветер во наредните денови

Read more

Северна Кореја го пушти во акција разурнувачот Канг Кон од 5.000 тони

Read more

Американците распределија ракетни системи што може да досегнат до Москва

Read more

Шефицата на AfD: Има премногу доселеници кои само го користат германскиот систем за социјална помош

Read more

Вести

TikTok воведува голема промена што корисниците одамна ја чекаат

Read more

Се продава редок функционален Apple I компјутер 

Read more

Крај на една ера: Тим Кук повеќе не е шеф на Apple

Read more

Збогум на месечните претплати: Xiaomi има решение што го заменува Google Drive

Read more

Гик

TikTok воведува голема промена што корисниците одамна ја чекаат

Читај повеќе

Project DualPlay Mini на Acer е рачна гејмерска конзола која се претвора во мал лаптоп

Читај повеќе

Се продава редок функционален Apple I компјутер 

Читај повеќе

Крај на една ера: Тим Кук повеќе не е шеф на Apple

Читај повеќе

Збогум на месечните претплати: Xiaomi има решение што го заменува Google Drive

Читај повеќе
  • play_arrow

Астронаутки заменија камера и уред за приклучување на вселенски летала на МВС

Читај повеќе

WhatsApp има нова опција што штити од измама, но мора сами да ја вклучите

Читај повеќе

Генијален трик за пронаоѓање изгубен телефон дома

Читај повеќе
  • filter

Мистерија длабоко под мразот: Антарктикот го покрил мраз среде тропска ера

Читај повеќе