Microsoft je predstavio MAI‑Image‑2, novu generaciju vlastitog modela za generiranje slika. Odmah je zasjeo na treće mjesto Arena.ai ljestvice najuspješnijih text‑to‑image sustava. Time se Microsoftova tehnologija smjestila odmah iza Google Gemini 3.1 Flash modela i OpenAI GPT Image 1.5 rješenja.
MAI‑Image‑2 nadograđuje prethodnu verziju iz listopada 2025., prvog Microsoftovog interno razvijenog modela za generiranje vizualnog sadržaja. Kako navode iz kompanije, nova generacija razvijana je uz kontinuirane povratne informacije fotografa, dizajnera i umjetnika, s fokusom na tri ključna područja: fotorealizam, generiranje čitljivog teksta unutar slike i kompleksne, kinematografski oblikovane scene.
Microsoft posebno ističe napredak u prikazu prirodnog svjetla, tonova kože i tekstura, čime se smanjuje potreba za dodatnom obradom. Poboljšano je i generiranje teksta unutar slika — područje koje i dalje predstavlja izazov za većinu AI modela — kao i sposobnost stvaranja detaljnih scena s višeslojnim kompozicijama.
MAI‑Image‑2 već je dostupan kroz MAI Playground, a postupno se integrira i u Copilot te Bing Image Creator, navodi Bug. Poslovnim korisnicima model je dostupan putem API‑ja, dok se šira dostupnost za developere očekuje uskoro kroz platformu Microsoft Foundry.
Više o Microsoftovom novom modelu za generiranje slika dostupno je na ovoj poveznici.


