Google Gemini: ulepszony generator obrazów Imagen 3 już dla wszystkich

Generowanie obrazów za pomocą ulepszonego modelu Imagen 3 jest już dostępne dla wszystkich użytkowników Gemini na całym świecie.

Mieszko Zagańczyk (Mieszko)
1
Udostępnij na fb
Udostępnij na X
Google Gemini: ulepszony generator obrazów Imagen 3 już dla wszystkich

Twórcy Google Gemini ogłosili dziś zapowiadaną już wcześniej zmianę – we wszystkich wersjach Gemini i na całym świecie będzie teraz można korzystać z najbardziej wydajnego i dokładnego modelu generowania obrazu, Imagen 3.

Dalsza część tekstu pod wideo

Model Imagen 3 został ogłoszony przez Google w sierpniu, wtedy jednak nowa funkcja miała trafić w pierwszej kolejności do płatnych Gemini Advanced, Business i Enterprise w języku angielskim. Jak wynika z dzisiejszej zapowiedzi, teraz o zaletach nowego modelu przekonają się także użytkownicy podstawowego wariantu Gemini. 

Imagen 3 umożliwi tworzenie fotorealistycznych obrazów

Google zachwala Imagen 3 jako swój najdoskonalszy model generowania obrazu. Zapewnia jeszcze wyższy stopień fotorealizmu, lepsze wykonywanie instrukcji i tworzy mniej rozpraszających artefaktów niż kiedykolwiek wcześniej. 

Google Gemini: ulepszony generator obrazów Imagen 3 już dla wszystkich

Imagen 3 generuje obrazy na podstawie zaledwie kilku słów. Można poprosić Gemini o stworzenie obrazów w różnych stylach — np. fotorealistycznego krajobrazu, teksturowanego obrazu olejnego czy fantazyjnej sceny w stylu animacji plastelinowej.

Google Gemini: ulepszony generator obrazów Imagen 3 już dla wszystkich

Porównanie jakości obrazu generowanego przez Imagen 2 a Imagen 3 przedstawia powyższa grafika powstała na podstawie promptu: 

Wygeneruj obraz połyskujących kropelek rosy na aksamitnym płatku czerwonej róży. Uchwyć skomplikowane szczegóły kropelek wody odbijających poranne promienie słońca oraz delikatne żyłki na płatku.

Różnica jest kolosalna i widać ją na pierwszy rzut oka. Wciąż jednak istnieją pewne ograniczenia – w darmowym Gemini nie można generować obrazów przedstawiających ludzi. Jest to na razie funkcja eksperymentalna w Gemini Advanced, Business i Enterprise. Jednocześnie nawet w tych planach Imagen 3 nie pozwoli na generowanie fotorealistycznych twarzy rozpoznawalnych osób, obrazów przedstawiających osoby małoletnie ani krwawych, brutalnych czy seksualnych scen.

Imagen 3 używa SynthID, narzędzia Google do znakowania wodnego obrazów generowanych przez AI. Dzięki temu zmniejsza się możliwość nadużyć z wykorzystaniem AI.