

LLM inference a serving — Synthszr Charts
Tato kategorie zahrnuje frameworky a enginy používané k provozu velkých jazykových modelů v produkci – od inferenčních serverů přes vrstvy pro batching a plánování až po optimalizace latence a propustnosti. Patří sem projekty jako vLLM, SGLang a TGI, které se používají k nasazení modelů za API nebo ve vlastních datacentrech. Využívají je týmy, které potřebují modely provozovat škálovatelně a nákladově efektivně, nejen je trénovat.
Synthszr Charts měří pro tuto kategorii momentum ze zmínek napříč tisíci zdroji zpráv a newsletterů, s váhou podle aktuálnosti a granularitou podle verzí, takže nová vydání jako EAGLE 3.1 jsou sledována samostatně. Žebříček se aktualizuje denně a ukazuje, která serving řešení právě získávají nebo ztrácejí pozornost.
- 1vLLMvllm · 59× · 13. 8. 2026100
- 2Lightningnvidia · 4× · 13. 8. 202672
- 3Computercloudflare · 3× · 07. 8. 202651
- 4SubQsubquadratic · 18× · 17. 8. 202646
- 5TabFMgoogle · 9× · 27. 7. 202642
- 6SGLanglmsys · 11× · 05. 8. 202638
- 7Workers AIcloudflare · 2× · 08. 8. 202629
- 8Mooncakemoonshot · 2× · 19. 7. 202619
- 9ModelOptnvidia · 2× · 15. 7. 202616
- 10Yansubentoml · 3× · 01. 6. 20263
- 11TGIhugging-face · 2× · 19. 6. 20263
- 12CoreWeave Sandboxescoreweave · 3× · 24. 5. 20262
- 13Text Generation Inferencehugging-face · 2× · 28. 5. 20261
- 14Groq Llamagroq · 2× · 17. 5. 20261
- 15vLLM 0.20.0vllm · 4× · 29. 4. 20261
- 16TokenSpeedlightseeking · 2× · 12. 5. 20261
- 17Docker Model Runnerdocker · 2× · 08. 5. 20261
- 18HybridClawhybridai · 2× · 29. 4. 20260
- 19NEAR AI Cloudnear-ai · 7× · 03. 4. 20260
- 20IronClawnear-ai · 7× · 03. 4. 20260
- 21TensorRT-LLMnvidia · 2× · 29. 4. 20260
- 22ClawProtencent · 2× · 04. 5. 20260
- 23HDNA Workbenchunknown · 2× · 15. 4. 20260
- 24Crusoe Managed Inferencecrusoe · 2× · 07. 4. 20260