

LLM-Inferenz & Serving — Synthszr Charts
Disse Kategorie ümfaat Frameworks un Engines, mit de grote Spraakmodelle in Produktion loopt warrt – vun Inferenz-Servers över Batching- un Scheduling-Lagen bit hen to Optimeren vun Latenz un Dörsatz. Dorto höört Projekte as vLLM, SGLang un TGI, de bruukt warrt, üm Modelle achter APIs oder in egen Datenzentren praatstellt to kriegen. Bruukt warrt se vun Teams, de Modelle skaleerbor un kostengünstig bedrieven mööt, nich blots trainen.
De Synthszr Charts meet för disse Kategorie dat Momentum ut Nennen in Dusende vun News- un Newsletter-Bronnen, recency-wicht un na Version fien opdeelt, so dat t.B. nee Releases as EAGLE 3.1 eenzeln erfaat warrt. Dat Ranking warrt jeden Dag nee maakt un wiest so, welk Serving-Lösungen jüst mehr oder weniger Andacht kriegt.
- 1vLLMvllm · 59× · 13. Aug. 2026100
- 2Lightningnvidia · 4× · 13. Aug. 202672
- 3Computercloudflare · 3× · 07. Aug. 202651
- 4SubQsubquadratic · 18× · 17. Aug. 202646
- 5TabFMgoogle · 9× · 27. Juli 202642
- 6SGLanglmsys · 11× · 05. Aug. 202638
- 7Workers AIcloudflare · 2× · 08. Aug. 202629
- 8Mooncakemoonshot · 2× · 19. Juli 202619
- 9ModelOptnvidia · 2× · 15. Juli 202616
- 10Yansubentoml · 3× · 01. Juni 20263
- 11TGIhugging-face · 2× · 19. Juni 20263
- 12CoreWeave Sandboxescoreweave · 3× · 24. Mai 20262
- 13Text Generation Inferencehugging-face · 2× · 28. Mai 20261
- 14Groq Llamagroq · 2× · 17. Mai 20261
- 15vLLM 0.20.0vllm · 4× · 29. Apr. 20261
- 16TokenSpeedlightseeking · 2× · 12. Mai 20261
- 17Docker Model Runnerdocker · 2× · 08. Mai 20261
- 18HybridClawhybridai · 2× · 29. Apr. 20260
- 19NEAR AI Cloudnear-ai · 7× · 03. Apr. 20260
- 20IronClawnear-ai · 7× · 03. Apr. 20260
- 21TensorRT-LLMnvidia · 2× · 29. Apr. 20260
- 22ClawProtencent · 2× · 04. Mai 20260
- 23HDNA Workbenchunknown · 2× · 15. Apr. 20260
- 24Crusoe Managed Inferencecrusoe · 2× · 07. Apr. 20260