Google objavio statistike tačnosti AI četbotova
Zahvaljujući upotrebi FACTS Benchmark Suite paketa, Google je bio u mogućnosti da testira i odredi efikasnost, kao i tačnost podataka koje pružaju popularni AI četbotovi. Zaključci iz ovog istraživanja nisu pozitivni.
TEKST SE NASTAVLJA ISPOD OGLASA
Kako pokazuju podaci iz izvještaja, nijedan od 15 četbotova koje je kompanija testirala nije uspio da pređe prag od 70 procenata tačnosti u odnosu na činjenice.
TEKST SE NASTAVLJA ISPOD OGLASA
To znači da u prosjeku skoro jedan od tri odgovora nije u skladu sa stvarnošću.
TEKST SE NASTAVLJA ISPOD OGLASA
Najbolji model prema testovima je Gemini 3 Pro od Google, koji je postigao 69 procenata tačnosti. Sljedeća mjesta zauzeli su Gemini 3.5 Pro i GPT 5, koji su jedini još prešli prag od 60 procenata.
Ovo pokazuje da kreatore AI četbotova još čeka dug put do postizanja zadovoljavajućeg nivoa pouzdanosti.
To je takođe upozorenje da sve podatke koje nude ova sredstva treba pažljivo provjeravati, prenosi "Blic".











