TECH FLOW Svět Androida
← Zpět do proudu
mistral.ai · vybral Petr Mišák · před 60 dny

Shieldstral: 3B open-weights model pro multimodální moderaci obsahu od Mistralu

Náhled zdroje: Shieldstral: 3B open-weights model pro multimodální moderaci obsahu od Mistralu
Shrnutí AI

Mistral vydal Shieldstral, 3B otevřený model pro bezpečnostní klasifikaci textu a obrázků, který pracuje jako dotazovací systém přijímající politiky v přirozeném jazyce bez potřeby přetrénování. Model dosahuje výkonu srovnatelného s modely 7x větší velikosti a lze ho spustit na jednotné GPU, přičemž je dostupný pod licencí Apache 2.0.

Shrnutí píše AI ze zdroje, není to stanovisko redakce. Podrobnosti najdete ve zdroji.

11 lidí už zdroj otevřelo

Otázky a odpovědi AI
Jak se Shieldstral liší od tradičních modelů pro moderaci obsahu?

Shieldstral přijímá politiky moderace jako text v přirozeném jazyce při inference, což umožňuje adaptaci na různé kontexty bez nutnosti přetrénování. Tradiční modely mají pevně zakódované kategorie škod v trénovacích vahách, takže změna cílového nasazení vyžaduje nové trénování.

Jaký hardware je potřebný pro spuštění Shieldstral?

Model se dá spustit na jediné 16GB NVIDIA GPU. Jeho velikost 3 miliardy parametrů jej činí výpočetně efektivním ve srovnání s většími modely pro moderaci.

Jak se Shieldstral naučil rozlišovat různé bezpečnostní politiky?

Model byl trénován na umělých kontrastních párech, které LLM vytvořila speciálně tak, aby porušovaly jednu politiku, ale ne její podobnou variantu. To učí model rozlišovat přesné hranice různých politik místo pouhého memorování.

Otázky i odpovědi píše AI podle tématu, ne ze zdroje. Není to stanovisko redakce.
Souvisí z proudu
Zmiňuje