TECH FLOW Svět Androida
← Zpět do proudu
celeris.ai · vybral Petr Mišák · před 60 dny

Celeris-1 – nejrychlejší AI model s 2000+ tokeny za sekundu

Náhled zdroje: Celeris-1 – nejrychlejší AI model s 2000+ tokeny za sekundu
Shrnutí AI

Celeris-1 je nový jazykový model postaven na diffusní architektuře, který dosahuje 1 664 tokenů za sekundu a zároveň si udržuje srovnatelnou přesnost s nejpokročilejšími modely. Má kompatibilní API s OpenAI a stojí až 15× méně na latenci než GPT-5.

Shrnutí píše AI ze zdroje, není to stanovisko redakce. Podrobnosti najdete ve zdroji.

4 lidí už zdroj otevřelo

Otázky a odpovědi AI
Jak se Celeris-1 liší od tradičních autoregresivních modelů?

Celeris-1 používá novou diffusní architekturu pro inferenci namísto tradičního autoregresivního přístupu. Tradiční modely generují jeden token po druhém, kde každý token závisí na předchozím, což vytváří sekvenční latenci. Diffusní architektura Celeris umožňuje generovat tokeny paralelně, čímž dosahuje výrazně nižší latence.

Jaké jsou hlavní výhody migrace z OpenAI API na Celeris?

Celeris nabízí OpenAI-kompatibilní API, takže stačí změnit endpoint na inference.celeris.ai a zbytek kódu zůstane stejný. Zároveň poskytuje také nižší latenci a vyšší propustnost – Celeris generuje až 24× více tokenů za sekundu než GPT-5 při porovnatelné přesnosti.

Jak se Celeris-1 srovnává s konkurencí v přesnosti?

Celeris-1 dosahuje 75,9% přesnosti na benchmarku MMLU-Pro, což jej řadí blízko k hranici pokročilosti – jen o pár bodů pod GPT-5 (81,9%) a dalšími top modely. Zároveň to dosahuje ve velmi krátké latenci 158 ms, zatímco GPT-5 potřebuje 2 sekundy.

Jak se fakturuje използití Celeris-1?

Celeris-1 se fakturuje podle počtu vygenerovaných tokenů. Uživatelé platí pouze za tokeny, které model vygeneruje, takže zvýšená rychlost nemá na ceníku žádný vliv – generování 1 000 tokenů stojí stejně bez ohledu na to, zda mu to trvá 100 ms nebo 1 sekundu.

Otázky i odpovědi píše AI podle tématu, ne ze zdroje. Není to stanovisko redakce.
Souvisí z proudu
Zmiňuje