

LLM-Inferenz & Serving — Synthszr Charts
Diese Kategorie umfasst Frameworks und Engines, mit denen große Sprachmodelle in Produktion ausgeführt werden – von Inferenz-Servern über Batching- und Scheduling-Layer bis zu Optimierungen für Latenz und Durchsatz. Dazu zählen Projekte wie vLLM, SGLang und TGI, die für das Bereitstellen von Modellen hinter APIs oder in eigenen Rechenzentren eingesetzt werden. Genutzt werden sie von Teams, die Modelle skalierbar und kosteneffizient betreiben müssen, statt nur zu trainieren.
Die Synthszr Charts messen für diese Kategorie das Momentum aus Erwähnungen in tausenden News- und Newsletter-Quellen, recency-gewichtet und versions-granular, sodass etwa neue Releases wie EAGLE 3.1 einzeln erfasst werden. Das Ranking wird täglich aktualisiert und bildet so ab, welche Serving-Lösungen gerade an Aufmerksamkeit gewinnen oder verlieren.
- 1vLLMvllm · 59× · 13. Aug. 2026100
- 2Lightningnvidia · 4× · 13. Aug. 202672
- 3Computercloudflare · 3× · 07. Aug. 202651
- 4SubQsubquadratic · 18× · 17. Aug. 202646
- 5TabFMgoogle · 9× · 27. Juli 202642
- 6SGLanglmsys · 11× · 05. Aug. 202638
- 7Workers AIcloudflare · 2× · 08. Aug. 202629
- 8Mooncakemoonshot · 2× · 19. Juli 202619
- 9ModelOptnvidia · 2× · 15. Juli 202616
- 10Yansubentoml · 3× · 01. Juni 20263
- 11TGIhugging-face · 2× · 19. Juni 20263
- 12CoreWeave Sandboxescoreweave · 3× · 24. Mai 20262
- 13Text Generation Inferencehugging-face · 2× · 28. Mai 20261
- 14Groq Llamagroq · 2× · 17. Mai 20261
- 15vLLM 0.20.0vllm · 4× · 29. Apr. 20261
- 16TokenSpeedlightseeking · 2× · 12. Mai 20261
- 17Docker Model Runnerdocker · 2× · 08. Mai 20261
- 18HybridClawhybridai · 2× · 29. Apr. 20260
- 19NEAR AI Cloudnear-ai · 7× · 03. Apr. 20260
- 20IronClawnear-ai · 7× · 03. Apr. 20260
- 21TensorRT-LLMnvidia · 2× · 29. Apr. 20260
- 22ClawProtencent · 2× · 04. Mai 20260
- 23HDNA Workbenchunknown · 2× · 15. Apr. 20260
- 24Crusoe Managed Inferencecrusoe · 2× · 07. Apr. 20260