N'importe quel modèle rentre dans ton GPU.Trop gros pour ton GPU ? Il le réduit, récupère après un plantage mémoire, et retient le réglage qui marche.
Gratuit pendant la bêta — sans compte, sans inscription.
Trop gros pour ta VRAM ? Il réduit jusqu'à rentrer — quant, contexte, offload.
Un dépassement mémoire est capturé et récupéré. Le serveur reste debout.
Ton propre matériel — jamais un GPU loué.
Fait tenir les modèles sur le GPU que tu as déjà, au lieu d'en louer plus — moins de matériel, moins de gâchis.
Ajuste un modèle au-dessus de ton budget VRAM.
par conceptionCapture le dépassement mémoire et continue de servir.
mesuréNVIDIA, AMD, Apple — ou le CPU.
vérifiéChaque chiffre est mesuré et public. Lis les runs bruts et reproduis-les toi-même.
vrampilot est conçu par ZMLabs — un studio de deep-engineering à Sète, dans le sud de la France, qui rend le logiciel puissant accessible.
Pointe-le sur un modèle — il s'adapte et continue de servir.