Najnowsza aktualizacja ChatGPT firmy OpenAI stanowi znaczący krok naprzód w generowaniu obrazów z wykorzystaniem modelu GPT-4o. Zamiast migracji do DALL-E 3, można teraz generować obrazy o wyjątkowo wysokiej jakości bezpośrednio za pomocą GPT-4o, bez konieczności rozpoczynania nowej konwersacji. To udoskonalenie upraszcza proces tworzenia treści wizualnych oraz zwiększa dokładność i jakość generowanych obrazów.
Istnieją jednak ograniczenia dla użytkowników darmowej wersji ChatGPT, przynajmniej na razie.

Ogromne ulepszenia w generowaniu obrazów w ChatGPT
Model GPT-4o firmy OpenAI to idealny wybór do większości wirtualnych rozmów na ChatGPT. Odpowiada na szeroki zakres pytań, a OpenAI klasyfikuje go jako „odpowiedni do większości pytań”. I rzeczywiście tak jest, szybko i dokładnie odpowiadając na szeroki zakres informacji, ale tylko w formie tekstowej.
Po aktualizacji z 25 marca 2025 r. możliwe jest teraz GPT-4o Generuje wysokiej jakości obrazy o oszałamiającej szczegółowości, przewyższając jakością model, który zasadniczo zastąpił (DALL-E 3). Co więcej, GPT-4o może teraz wykonywać modyfikacje i ulepszenia obrazu znacznie wykraczające poza możliwości DALL-E 3. Teraz można edytować obrazy, dostosowywać kolory i wzory, wprowadzać subtelne zmiany, manipulować elementami pierwszego planu i tła i wiele więcej.
Generowanie tekstu również uległo znaczącej poprawie. Generowanie tekstu nie było mocną stroną DALLE-3 (choć nie jest nią w przypadku większości modeli AI). Teraz GPT-4o może generować szczegółowe infografiki z dokładnymi objaśnieniami praktycznie na każdy temat. Umieszczanie tekstu na obrazach jest teraz precyzyjne, dzięki zastosowaniu określonych stylów i instrukcji, bez ryzyka rozmycia generowanych obrazów. Zachowanie szczegółów to kolejna wyraźna poprawa, ponieważ określone funkcje można teraz łatwo przenosić z jednego obrazu na drugi bez konieczności wprowadzania przez ChatGPT drastycznych zmian w scenie lub generowania zupełnie nowego obrazu.
Poprawa jakości obrazu jest częściowo zasługą współpracy OpenAI z firmami takimi jak Shutterstock i grupą trenerów, którzy poświęcili godziny na identyfikację błędów popełnianych przez GPT-4o podczas generowania obrazów. W rozmowie z The Wall Street JournalJak wyjaśnił główny badacz Gabriel Gu, technika uczenia się przez wzmacnianie pozwala GPT-4o na dokładne wykonywanie instrukcji wydawanych przez człowieka w szerokim zakresie żądań generowania obrazu, ale do ukończenia procesu potrzeba „nieco ponad 100 operatorów”.

Nowa funkcja generowania obrazów w ChatGPT jest naprawdę niesamowita i polecam ją każdemu, kto chce wypróbować ją w dowolnym interesującym go temacie. Oczywiście, nie jest idealna; żadne narzędzie do generowania obrazów oparte na sztucznej inteligencji nie jest idealne. To jednak ogromny krok naprzód w porównaniu z modelami generowania obrazów opartymi na sztucznej inteligencji, takimi jak DALL-E 3, które były przydatne, ale niezbyt imponujące, do jakości, jaką oferuje teraz GPT-4o.
Niesamowita aktualizacja obrazów ChatGPT jest już dostępna dla (prawie) wszystkich
Niestety, ze względu na bezprecedensowe zapotrzebowanie na GPT-4o, użytkownicy darmowej wersji ChatGPT będą musieli ponownie poczekać na tę nową funkcję. 26 marca 2025 roku, dyrektor generalny OpenAI, Sam Altman, potwierdził opóźnienie, nie podając jednak daty premiery.
Spodziewano się wzrostu zainteresowania, ale nie aż tak dużego. Niestety, oznacza to, że trzeba będzie poczekać trochę dłużej lub dokonać aktualizacji do ChatGPT Plus za 20 dolarów miesięcznie. Można śmiało powiedzieć, że przy takich aktualizacjach, aktualizacja do ChatGPT Plus jest warta swojej ceny – bardziej niż premiera poprzedniej aktualizacji modelu OpenAI, GPT-4.5.
Warto również zauważyć, że w ramach aktualizacji GPT-4o, DALL-E 3 staje się „starszym modelem generowania obrazów” OpenAI. Oznacza to, że OpenAI ostatecznie usunie DALL-E 3 z ChatGPT, choć na razie nie ma konkretnego harmonogramu tej zmiany.













