TECH FLOW Svět Androida
← Zpět do proudu
arcprize.org · vybral Petr Mišák · před 57 dny

DeepSeek V4 Flash 0731 dosahuje 89% na ARC-AGI-1

Náhled zdroje: DeepSeek V4 Flash 0731 dosahuje 89% na ARC-AGI-1
Shrnutí AI

DeepSeek představil V4 Flash 0731, variantu svého modelu se třemi úrovněmi reasoning. Model dosahuje 89,0 % na ARC-AGI-1 Semi-Private za 0,02 USD na úlohu a 61,4 % na ARC-AGI-2 Semi-Private za 0,04 USD na úlohu.

Shrnutí píše AI ze zdroje, není to stanovisko redakce. Podrobnosti najdete ve zdroji.

2 lidí už zdroj otevřelo

Poznámka autora tipu

Je skvělé a zároveň děsiví vidět, jak čínské free AI modely, konkurují těm TOP americkým. Mít kvalitní AI modely, které si můžeme spustit lokálně, hlavně proto aby pomyslné AI klíče nedrželo jen pár vybraných firem na světě. Navíc to extrémně akceleruje globální vývoj AI.

Otázky a odpovědi AI
Co je ARC-AGI benchmark a k čemu se používá?

ARC-AGI (Abstraction and Reasoning Corpus for General Intelligence) je benchmark navržený k testování obecné inteligence umělých modelů. Jedná se o sadu úloh zaměřených na abstraktní myšlení a logické uvažování, které vyžadují schopnost rozpoznávat vzory a aplikovat je na nové situace.

Jaký je rozdíl mezi Max, High a Low variantami reasoning?

Varianty označují tři úrovně intensive reasoning přístupu modelu. Max varianta používá největší výpočetní úsilí, High střední úsilí a Low minimální úsilí. Výkonnost se obvykle liší s tím, jak se zvyšuje výpočetní náročnost.

Proč je cena za úlohu v ARC-AGI-2 vyšší než v ARC-AGI-1?

ARC-AGI-2 obsahuje obtížnější úlohy, které vyžadují více výpočetního času a složitějšího uvažování. Vyšší cena odráží větší složitost a delší dobu zpracování potřebnou k vyřešení těchto úloh.

Otázky i odpovědi píše AI podle tématu, ne ze zdroje. Není to stanovisko redakce.
Souvisí z proudu
Zmiňuje