Le runtime qui s'ajuste

Infatigable.Il sature la mémoire à ta place.

N'importe quel modèle rentre dans ton GPU.Trop gros pour ton GPU ? Il le réduit, récupère après un plantage mémoire, et retient le réglage qui marche.

Gratuit pendant la bêta — sans compte, sans inscription.

auto-ajuste · tout GPU récupère après OOM Multiplateforme · Windows · macOS · Linux
AUTO-FIT
Garde ton contexte, récupère, retient ce qui a démarré.
En clair

Le modèle rentre, ou il survit à l'essai.

Ça rentre.

Trop gros pour ta VRAM ? Il réduit jusqu'à rentrer — quant, contexte, offload.

Ça survit.

Un dépassement mémoire est capturé et récupéré. Le serveur reste debout.

C'est local.

Ton propre matériel — jamais un GPU loué.

Plus écologique.

Fait tenir les modèles sur le GPU que tu as déjà, au lieu d'en louer plus — moins de matériel, moins de gâchis.

Preuves

Pas des promesses. Des mesures.

auto-ajuste

Ajuste un modèle au-dessus de ton budget VRAM.

par conception
OOM → récup.

Capture le dépassement mémoire et continue de servir.

mesuré
tout GPU

NVIDIA, AMD, Apple — ou le CPU.

vérifié

Envie de plus de preuves ?

Chaque chiffre est mesuré et public. Lis les runs bruts et reproduis-les toi-même.

Voir les benchmarks sur GitHub →
Le studio

Engineering what comes next.

vrampilot est conçu par ZMLabs — un studio de deep-engineering à Sète, dans le sud de la France, qui rend le logiciel puissant accessible.

Sète · Occitanie · Francecontact.zmlabs@proton.me
Arrête de surveiller la VRAM

Ça rentre, point.

Pointe-le sur un modèle — il s'adapte et continue de servir.

Restez informé — nouvelles versions & lancement memown
Une seule liste pour tous les outils ZMLabs. Zéro spam, désinscription à tout moment.