TECH FLOW Svět Androida
← Zpět do proudu
cerebras.ai · vybral Petr Mišák · před 44 dny

Cerebras představil CS-4 akcelerátor umělé inteligence o kterém tvrdí že je až 30krát výkonnější

Náhled zdroje: Cerebras představil CS-4 akcelerátor umělé inteligence o kterém tvrdí že je až 30krát výkonnější
Shrnutí AI

Společnost Cerebras představila čtvrtou generaci svého AI akcelerátoru CS-4, který je postaven na procesorech Wafer Scale Engine 3 Turbo a dosahuje až 30krát vyšší rychlosti inference než GPU systémy. Nový systém Nexus s modulárním designem nabízí lepší energetickou účinnost, nižší latenci komunikace mezi procesory a nativní podporu pro disagregovanou inferenci. Výrobce slibuje, že CS-4 kombinuje vysokou interaktivitu pro jednotlivé uživatele s vysokou agregovanou propustností a první dodávky začínají v Q3 2026.

Shrnutí píše AI ze zdroje, není to stanovisko redakce. Podrobnosti najdete ve zdroji.

3 lidí už zdroj otevřelo

Poznámka autora tipu

Jestli se nepletu, tak právě díky společnost Cerebras může OpenAI nabízet své AI modely téměř zadarmo.

Otázky a odpovědi AI
Co je to Wafer Scale Engine a jaký má výkon?

Wafer Scale Engine je vlastní procesor Cerebras vyrobený v podobě celého wafer křemíku místo tradičních malých čipů. Třetí generace (WSE-3) používaná v CS-4 dosahuje nižší latence komunikace mezi procesory a vyšší operačních frekvencí, což umožňuje generovat tokeny až 30krát rychleji než GPU.

Jak se CS-4 liší od předchozí generace CS-3?

CS-4 má až 10krát vyšší kapacitu tokenů a až 2krát vyšší výkon než CS-3. Hlavní zlepšení spočívá v novém designu Nexus platformy s modulárním přístupem, efektivnější dodávkou energie (2krát větší výkon k procesorům) a programovatelným I/O subsystémem.

Co je disagregovaná inference a kdy se používá?

Disagregovaná inference rozděluje proces na dvě fáze: prefill (zpracování promptu, typicky na GPU nebo ASIC) a decode (generování odpovědi, optimalizováno na CS-4). Tento přístup umožňuje kombinovat efektivní prefill s ultrarychlým decode a je užitečný pro operátory, kteří chtějí optimalizovat náklady na energie.

Otázky i odpovědi píše AI podle tématu, ne ze zdroje. Není to stanovisko redakce.
Souvisí z proudu
Zmiňuje
  • Cerebras3
  • CS-4
  • Wafer Scale Engine 3 Turbo
  • Nexus
  • AMD Helios
  • AWS Trainium
  • RoCE v2 RDMA