

Inférence & serving LLM — Synthszr Charts
Cette catégorie regroupe les frameworks et moteurs utilisés pour exécuter de grands modèles de langage en production – des serveurs d'inférence aux couches de batching et d'ordonnancement, en passant par les optimisations de latence et de débit. On y trouve des projets comme vLLM, SGLang et TGI, utilisés pour servir des modèles derrière des API ou dans des centres de données auto-hébergés. Ils sont utilisés par des équipes qui doivent faire tourner des modèles à grande échelle et à coût maîtrisé, et non plus seulement les entraîner.
Les Synthszr Charts mesurent pour cette catégorie le momentum à partir des mentions dans des milliers de sources d'actualités et de newsletters, pondéré par la récence et granulaire par version, de sorte que les nouvelles versions comme EAGLE 3.1 sont suivies individuellement. Le classement est mis à jour chaque jour et montre quelles solutions de serving gagnent ou perdent en visibilité.
- 1vLLMvllm · 74× · 23 sept. 2026100
- 2TabPFN-3.5prior-labs · 5× · 30 sept. 202682
- 3SubQsubquadratic · 22× · 22 sept. 202658
- 4Crusoe Managed Inferencecrusoe · 4× · 21 sept. 202643
- 5TensorRT-LLMnvidia · 6× · 22 sept. 202642
- 6SGLanglmsys · 17× · 08 sept. 202642
- 7SIE (Superlinked Inference Engine)superlinked · 2× · 10 sept. 202623
- 8vLLM-Omnivllm · 3× · 03 sept. 202623
- 9FastH3fastvideo · 2× · 03 sept. 202623
- 10Lightningnvidia · 4× · 13 août 202617
- 11Mojomodular · 2× · 24 août 202614
- 12Tritonopenai · 2× · 26 août 202610
- 13Computercloudflare · 3× · 07 août 202610
- 14TabFMgoogle · 9× · 27 juil. 20267
- 15Workers AIcloudflare · 2× · 08 août 20265
- 16Mooncakemoonshot · 2× · 19 juil. 20263
- 17ModelOptnvidia · 2× · 15 juil. 20262
- 18Yansubentoml · 3× · 01 juin 20260
- 19TGIhugging-face · 2× · 19 juin 20260
- 20CoreWeave Sandboxescoreweave · 3× · 24 mai 20260
- 21Text Generation Inferencehugging-face · 2× · 28 mai 20260
- 22Groq Llamagroq · 2× · 17 mai 20260
- 23vLLM 0.20.0vllm · 4× · 29 avr. 20260
- 24TokenSpeedlightseeking · 2× · 12 mai 20260
- 25Docker Model Runnerdocker · 2× · 08 mai 20260
- 26HybridClawhybridai · 2× · 29 avr. 20260
- 27NEAR AI Cloudnear-ai · 7× · 03 avr. 20260
- 28IronClawnear-ai · 7× · 03 avr. 20260
- 29ClawProtencent · 2× · 04 mai 20260
- 30HDNA Workbenchunknown · 2× · 15 avr. 20260