Celeris-1 – nejrychlejší AI model s 2000+ tokeny za sekundu
Celeris-1 je nový jazykový model postaven na diffusní architektuře, který dosahuje 1 664 tokenů za sekundu a zároveň si udržuje srovnatelnou přesnost s nejpokročilejšími modely. Má kompatibilní API s OpenAI a stojí až 15× méně na latenci než GPT-5.
Jak se Celeris-1 liší od tradičních autoregresivních modelů?
Celeris-1 používá novou diffusní architekturu pro inferenci namísto tradičního autoregresivního přístupu. Tradiční modely generují jeden token po druhém, kde každý token závisí na předchozím, což vytváří sekvenční latenci. Diffusní architektura Celeris umožňuje generovat tokeny paralelně, čímž dosahuje výrazně nižší latence.
Jaké jsou hlavní výhody migrace z OpenAI API na Celeris?
Celeris nabízí OpenAI-kompatibilní API, takže stačí změnit endpoint na inference.celeris.ai a zbytek kódu zůstane stejný. Zároveň poskytuje také nižší latenci a vyšší propustnost – Celeris generuje až 24× více tokenů za sekundu než GPT-5 při porovnatelné přesnosti.
Jak se Celeris-1 srovnává s konkurencí v přesnosti?
Celeris-1 dosahuje 75,9% přesnosti na benchmarku MMLU-Pro, což jej řadí blízko k hranici pokročilosti – jen o pár bodů pod GPT-5 (81,9%) a dalšími top modely. Zároveň to dosahuje ve velmi krátké latenci 158 ms, zatímco GPT-5 potřebuje 2 sekundy.
Jak se fakturuje използití Celeris-1?
Celeris-1 se fakturuje podle počtu vygenerovaných tokenů. Uživatelé platí pouze za tokeny, které model vygeneruje, takže zvýšená rychlost nemá na ceníku žádný vliv – generování 1 000 tokenů stojí stejně bez ohledu na to, zda mu to trvá 100 ms nebo 1 sekundu.
- OpenAI násobně zrychluje GPT-5.6 Sol v Ultrafast modu pomocí Cerebras — cerebras.ai 74 % shoda
- Cerebras představil CS-4 akcelerátor umělé inteligence o kterém tvrdí že je až 30krát výkonnější — cerebras.ai 72 % shoda
- Runway Solaris by mohl změnit způsob, jakým se vytvářejí webové stránky a aplikace — runway.com 70 % shoda