MAI-Image-2.6 Flash je generativní model založený na difuzi a údajně lepší jak GPT-Image-2
Microsoft představuje MAI-Image-2, text-to-image generativní model dosahující třetí pozice na leaderboardu Arena.ai. Model je zaměřen na práci tvůrců s důrazem na fotorealismus, přesné renderování textu v obrázcích a detailní generování scén.
Difuzní modely vypadají jako velká budoucnost. Je mi až záhadou, že se zatím nepoužívají ve větším měřítku. Vše si může vyzkoušet zde https://playground.microsoft.ai/chat
Co je to difuzní model v generování obrázků?
Difuzní modely jsou třída generativních modelů, které postupně transformují náhodný šum na detailní obrázky iterativním procesem. Fungují tak, že se "naučí" obrácený proces degradace obrázku, což jim umožňuje vytvářet nové jedinečné obrázky z textových popisů nebo dalších podmínících signálů.
Jak se liší MAI-Image-2 od předchozích verzí?
MAI-Image-2 se zaměřuje na lepší fotorealismus, přesnější renderování textu přímo v obrázku a schopnost vytvářet komplexní, detailní scény. Model byl vyvíjen v součinnosti s profesionálními tvůrci jako fotografové a designéři.
Kde můžou uživatelé MAI-Image-2 vyzkoušet?
Model je dostupný v MAI Playground, začíná se nasazovat na Copilotu a Bing Image Creator. API přístup mají v prvotní fázi vybrani zákazníci Microsoftu a brzy bude dostupný všem vývojářům přes Microsoft Foundry.
- SpaceXAI vydává Imagine Image 2.0 přední obrazový model určený pro „skutečnou práci" — x.ai 74 % shoda
- Srovnání AI při tvorbě webovek - jedna výzva, 11 modelů, velmi odlišné výsledky — netlify.com 72 % shoda
- Mysl mimozemšťana: Hlavní vědec OpenAI v nové eseji říká, že jsme vytvořili intelekt, kterému doopravdy nerozumíme — openai.com 72 % shoda
- MAI-Image-2
- Microsoft4
- Arena.ai
- MAI Playground
- Copilot
- Bing Image Creator
- Microsoft Foundry