Wyszukiwarki oparte na sztucznej inteligencji: czy warto poświęcać im czas? (ChatGPT, Perplexity, Bliźnięta)

Badania wskazują, że Twoje ulubione chatboty nie radzą sobie najlepiej w wyszukiwarkach.

Wszyscy wiemy, że narzędzia AI potrafią dziś wiele. Ale jak dobrze radzą sobie z przeszukiwaniem internetu?

To ważne pytanie, które ma dużą wagę. Według badań Future (wydawcy TechRadar), prawie jedna trzecia respondentów w USA deklaruje, że korzysta teraz ze sztucznej inteligencji zamiast tradycyjnych wyszukiwarek, takich jak Google.

Niektórzy korzystają z ChatGPT i innych chatbotów. Inni korzystają z narzędzi AI zaprojektowanych specjalnie do badań i analiz, takich jak Perplexity. Nawet jeśli nie wybieramy aktywnie narzędzi AI, AI i tak pojawia się w naszych wyszukiwaniach, jak te małe podsumowania Google, które teraz pojawiają się na górze wyników wyszukiwania.

Krótko mówiąc, wyszukiwanie wspomagane sztuczną inteligencją jest wszechobecne. Ale prawdziwe pytanie pozostaje: czy to w ogóle działa? Naukowcy zaczynają to kwestionować, a pierwsze recenzje nie są imponujące.

Technologia sztucznej inteligencji i biznesmen pokazujący wirtualny wykres globalnego Internetu połączonego z ChatGPT. Czatuj ze sztuczną inteligencją.

Czy ChatGPT to nowy Google? Nie tak szybko…

Ludzie mogą używać narzędzi AI do celów badawczych, ale nie oznacza to, że powinni to robić.

W naszych ostatnich testach porównaliśmy cztery najlepsze chatboty oparte na sztucznej inteligencji (AI) ze sobą, aby sprawdzić, jak radzą sobie z wyszukiwaniem: ChatGPT firmy OpenAI, Gemini firmy Google, Claude firmy Anthropic i Perplexity AI.

Wyniki były… mieszane. Nie była to kompletna katastrofa – wszystkim udało się znaleźć jakieś istotne informacje – ale dokładność nie była imponująca. A sposób, w jaki podsumowywali te informacje? Często mylący lub nieprzydatny.

Wyniki te potwierdzają bardziej kompleksowe testy przeprowadzone przez Tow Center for Digital Journalism, o których donoszono w Przegląd dziennikarski ColumbiaIch zespół przetestował osiem głównych modeli sztucznej inteligencji — w tym ChatGPT, Perplexity, Copilot, Grok i Gemini — i odkrył powtarzające się problemy: „pewne przedstawianie nieprawdziwych informacji, mylące przypisywanie udostępnianych treści i niespójne praktyki wyszukiwania informacji”. Ojej.

Ogólnie rzecz biorąc, modele sztucznej inteligencji udzieliły niepoprawnych odpowiedzi na ponad 60% zapytań. Perplexity był najdokładniejszy (co jest zgodne z jego marketingiem jako narzędzia badawczego), ale i tak 37% odpowiedzi było błędnych. Grok wypadł najgorzej, z szokującym wskaźnikiem błędów na poziomie 94%. Bez komentarza.

Centrum Tao oceniało wyniki w skali od całkowicie poprawnych do całkowicie niepoprawnych (lub braku odpowiedzi). Niektóre z najgorszych przykładów to ewidentne halucynacje, w których sztuczna inteligencja po prostu… zmyślała. Ale nawet gdy odpowiedzi nie były całkowicie błędne, nadal występowały poważne problemy z ponownym wypełnianiem wiadomości i wyników wyszukiwania przez narzędzia.

Badania bez źródeł nie są w ogóle badaniami.

Podstawowy problem polega na takim przeformułowaniu informacji. Nawet jeśli technologie sztucznej inteligencji nie dostarczają fałszywych informacji, to i tak podsumowują i przekształcają treści w sposób nieprzydatny, a często mylący. Jak wyjaśnia Tow Center:

„Podczas gdy tradycyjne wyszukiwarki zazwyczaj działają jako pośrednicy, kierując użytkowników do serwisów informacyjnych i treści wysokiej jakości, narzędzia wyszukiwania generatywnego same analizują i przepakowują informacje, odcinając przepływ ruchu do oryginalnych źródeł”.

„Wyniki czatów tych botów często przesłaniają poważne, ukryte problemy związane z jakością informacji. Istnieje pilna potrzeba oceny, w jaki sposób te systemy uzyskują dostęp do treści informacyjnych, prezentują je i cytują”.

Jednym z najbardziej oczywistych problemów jest to, jak słabo narzędzia AI cytują źródła. Na przykład ChatGPT często linkuje do niewłaściwego artykułu, odsyła do strony głównej witryny lub całkowicie pomija cytowania.

To problem z dwóch głównych powodów. Po pierwsze, wydawcy tracą ruch, mimo że ich treści są wykorzystywane.

Po drugie, weryfikacja faktów staje się trudna. Jednym z niewielu sposobów weryfikacji wyników sztucznej inteligencji jest odwołanie się do oryginalnego źródła – a jest to jeszcze trudniejsze, jeśli go nie ma.

Jeśli więc sztuczna inteligencja dostarcza informacji, ale bez jasnego źródła, czy naprawdę warto jej używać do badań – zwłaszcza jeśli i tak sprawdzasz wszystko w Google? Prawdopodobnie nie.

Tak, narzędzia AI stale się rozwijają. I tak, niektóre, jak Perplexity, działają lepiej niż inne. Ale nawet najlepsze wciąż wymagają nadzoru ze strony człowieka. Obecnie, jeśli chodzi o badania, roboty nie są gotowe do działania autonomicznego.

Idź do góry przycisk