Premiera MAI-Image-2.6 od Microsoftu. Grafika AI staje się tańsza

Premiera MAI-Image-2.6 od Microsoftu. Grafika AI staje się tańsza

Microsoft zaprezentował flagowy model do generowania obrazów MAI-Image-2.6 oraz jego szybszą, tańszą wersję MAI-Image-2.6-Flash. Nowe narzędzia w wersji zapoznawczej trafiły do Microsoft Foundry, odpowiadając na rosnące zapotrzebowanie firm na masową produkcję materiałów wizualnych. Model podstawowy zdobył drugie miejsce w rankingu Arena, natomiast wariant Flash oferuje wysoką wydajność przy o połowę niższych kosztach wygenerowania obrazu. Narzędzia zapewniają obsługę do pięciu obrazów referencyjnych, weryfikację informacji w sieci oraz precyzyjne nanoszenie zmian.

MAI-Image-2.6 zdobywa wysoką notę w benchmarku Arena

Microsoft dostrzega wyraźną zmianę w sposobie wykorzystania sztucznej inteligencji przez przedsiębiorstwa. Tworzenie oprawy wizualnej przestało być jedynie technologiczną ciekawostką, a stało się stałym elementem pracy zespołów marketingowych, handlowych i produktowych. Zmiana ta stawia przed modelami generatywnymi zupełnie nowe wyzwania.

Generowanie obrazów wyszło poza etap wersji demonstracyjnych. Zespoły marketingu dostarczają aktywa kampanii, sprzedawcy detaliczni budują katalogi, a zespoły produktowe generują oprawę wizualną bezpośrednio w używanych narzędziach. Ta zmiana wpływa na to, co jest naprawdę istotne. Model musi robić coś więcej niż tylko tworzyć efektowne, pojedyncze obrazy. Musi renderować czytelny tekst, zachowywać spójność w różnych formatach i precyzyjnie podążać za wskazówkami kreatywnymi - czytamy na blogu Microsoft AI.

Odpowiedzią na te potrzeby jest wprowadzenie do Microsoft Foundry nowej rodziny modeli obejmującej podstawowy wariant MAI-Image-2.6 oraz zoptymalizowaną wersję MAI-Image-2.6-Flash. Zaprezentowane narzędzia dołączają do portfolio rozwiązań Microsoft AI i są już dostępne w ramach publicznej wersji zapoznawczej.

Premiera MAI-Image-2.6 od Microsoftu. Grafika AI staje się tańsza

Standardowy wariant zastępuje dotychczasową wersję MAI-Image-2.5 z maja 2026 r., przynosząc skok jakościowy poparty wynikami niezależnych testów. Model zajął drugą pozycję w ogólnym rankingu generowania obrazów na podstawie tekstu na platformie Arena (ustępując jedynie modelowi GPT-Image-2), uzyskując wynik wyższy o 79 punktów Elo od swojego poprzednika. W klasyfikacji edycji obrazów uplasował się na trzecim miejscu, wyprzedzając rozwiązania takie jak Nano Banana od Google czy Muse Image od Meta.

Zaawansowane funkcje nowego generatora obrazów AI

MAI-Image-2.6 wprowadza zestaw funkcji pozwalających programistom i designerom na sprawne zarządzanie procesem twórczym. Najważniejszym udoskonaleniem jest funkcja edycji z wykorzystaniem do pięciu obrazów referencyjnych w jednym zapytaniu. Umożliwia to zachowanie pełnej identyfikacji wizualnej postaci, produktów czy znaków firmowych podczas modyfikacji kompozycji i formatu.

Narzędzie wspiera dynamiczne proporcje stron oraz generowanie materiałów w rozdzielczości 1.5K. Narzędzie oferuje też weryfikację kontekstu w sieci za pośrednictwem wyszukiwarki Bing, co przekłada się na dokładne odwzorowanie realiów, miejsc i obiektów ze świata rzeczywistego. Użytkownicy otrzymują również bezpośrednią kontrolę nad czasem namysłu modelu, kształtem wyjściowym i stopniem szczegółowości.

MAI-Image-2.6-Flash został z kolei zaprojektowany z myślą o zastosowaniach, w których kluczowe są niska latencja oraz niski koszt przy dużej skali. Mimo nacisku na przyspieszenie działania wariant Flash oferuje te same kluczowe możliwości w zakresie generowania i edycji punktowej, co wersja podstawowa. Pozwala na zmianę poszczególnych obiektów, układu czy tekstu bez naruszania pozostałych elementów grafiki.

Pod względem wydajności MAI-Image-2.6-Flash działa ponad dwukrotnie szybciej (dokładnie 2,8-krotnie) niż GPT-Image-2-Medium, zapewniając przy tym o 72% do 78% wyższą efektywność energetyczną i procesową w porównaniu do GPT-Image-2. Z tego względu jest zalecany do aplikacji interaktywnych, automatycznych linii produkcyjnych, personalizacji i szybkiego testowania pomysłów.

Który model wybrać i ile on kosztuje?

Zastanawiasz się, który model generowania obrazów wybrać? Microsoft zaleca stosowanie standardowego wariantu MAI-Image-2.6 przy produkcji finalnych materiałów reklamowych, skomplikowanych edycjach, komercyjnym projektowaniu i zadaniach wymagających najwyższej jakości renderowania tekstu. Z kolei wariant Flash idealnie sprawdza się w etapach koncepcyjnych oraz przy generowaniu treści na dużą skalę.

Cennik wersji MAI-Image-2.6 wynosi 5 USD za milion tokenów tekstu wejściowego, 8 USD za milion tokenów obrazu wejściowego i 38 USD za milion tokenów obrazu wyjściowego. W przypadku opcji MAI-Image-2.6-Flash opłaty są znacząco niższe i wynoszą odpowiednio 1,75 USD za wejście tekstowe, 2,50 USD za wejście obrazowe i 19 USD za wyjściowe tokeny graficzne.

Źródło: https://techcommunity.microsoft.com/blog/azure-ai-foundry-blog/mai-image-2-6-and-mai-image-2-6-flash-quality-and-speed-at-production-scale/4550970

Webinar: Jak przygotować firmę na erę AI z nowym planem M365 E7 Frontier Suite?
Webinar: Jak przygotować firmę na erę AI z nowym planem M365 E7 Frontier Suite?