TECH FLOW Svět Androida
← Zpět do proudu
microsoft.ai · vybral Petr Mišák · před 28 dny

MAI-Image-2.6 Flash je generativní model založený na difuzi a údajně lepší jak GPT-Image-2

Náhled zdroje: MAI-Image-2.6 Flash je generativní model založený na difuzi a údajně lepší jak GPT-Image-2
Shrnutí AI

Microsoft představuje MAI-Image-2, text-to-image generativní model dosahující třetí pozice na leaderboardu Arena.ai. Model je zaměřen na práci tvůrců s důrazem na fotorealismus, přesné renderování textu v obrázcích a detailní generování scén.

Shrnutí píše AI ze zdroje, není to stanovisko redakce. Podrobnosti najdete ve zdroji.

129 lidí už zdroj otevřelo

Poznámka autora tipu

Difuzní modely vypadají jako velká budoucnost. Je mi až záhadou, že se zatím nepoužívají ve větším měřítku. Vše si může vyzkoušet zde https://playground.microsoft.ai/chat

Otázky a odpovědi AI
Co je to difuzní model v generování obrázků?

Difuzní modely jsou třída generativních modelů, které postupně transformují náhodný šum na detailní obrázky iterativním procesem. Fungují tak, že se "naučí" obrácený proces degradace obrázku, což jim umožňuje vytvářet nové jedinečné obrázky z textových popisů nebo dalších podmínících signálů.

Jak se liší MAI-Image-2 od předchozích verzí?

MAI-Image-2 se zaměřuje na lepší fotorealismus, přesnější renderování textu přímo v obrázku a schopnost vytvářet komplexní, detailní scény. Model byl vyvíjen v součinnosti s profesionálními tvůrci jako fotografové a designéři.

Kde můžou uživatelé MAI-Image-2 vyzkoušet?

Model je dostupný v MAI Playground, začíná se nasazovat na Copilotu a Bing Image Creator. API přístup mají v prvotní fázi vybrani zákazníci Microsoftu a brzy bude dostupný všem vývojářům přes Microsoft Foundry.

Otázky i odpovědi píše AI podle tématu, ne ze zdroje. Není to stanovisko redakce.
Souvisí z proudu
Zmiňuje
  • MAI-Image-2
  • Microsoft4
  • Arena.ai
  • MAI Playground
  • Copilot
  • Bing Image Creator
  • Microsoft Foundry