Pas d’engagement minimum · facturation à la seconde
Qu’est-ce que RunPod ?
RunPod est une marketplace cloud GPU fondée en 2022, désormais l’une des plateformes les plus populaires pour développeurs IA. Elle fonctionne sur deux niveaux :
- Community Cloud — GPU hébergés par des tiers. Prix les plus bas, pas de garantie d’uptime. À partir de 0,16 $/h. Idéal pour batch tolérant aux pannes.
- Secure Cloud — matériel datacenter dédié. Fiable, légèrement plus cher. À partir de 0,27 $/h. Idéal pour inférence et runs longs.
RunPod propose aussi des endpoints d’inférence Serverless — votre modèle scale à zéro à l’idle, vous payez par compute-unit. Vraiment compétitif face à Modal et Replicate pour l’inférence intermittente. Il occupe la 1re place dans notre comparatif GPU serverless.
Tarifs RunPod (juillet 2026)
| GPU | VRAM | Community Cloud | Secure Cloud | Idéal pour |
|---|---|---|---|---|
| RTX A5000 | 24 GB | $0.16/h | $0.27/h | Fine-tuning 7B, SD XL |
| RTX 3090 | 24 GB | $0.22/h | $0.46/h | Fine-tuning 7B, SD |
| RTX 4090 | 24 GB | $0.34/h | $0.69/h | Inférence rapide, SD XL |
| RTX A6000 | 48 GB | $0.33/h | $0.49/h | Fine-tuning 7B, SD XL |
| L40S | 48 GB | $0.79/h | $0.99/h | Inférence rapide, SD XL |
| A100 80GB | 80 GB | $1.19/h | $1.39/h | Gros entraînements |
| H100 PCIe | 80 GB | $1.99/h | $2.89/h | Inférence la plus rapide |
| H100 SXM | 80 GB | $2.69/h | $2.99/h | Inférence la plus rapide |
| H200 | 141 GB | $3.59/h | $4.39/h | Modèles 70B, entraînement |
Les deux niveaux ont été relevés sur runpod.io/pricing le 20 juillet 2026. Les tarifs Community Cloud dépendent des hôtes ayant de la capacité disponible et varient donc plus que ceux du Secure Cloud.
Là où la facture RunPod surprend : le stockage
Les frais GPU s'arrêtent à la seconde où vous stoppez un pod. Le stockage fait l'inverse. Un volume disk coûte 0,10 $/Go/mois tant que le pod tourne et 0,20 $/Go/mois dès qu'il est inactif : stopper un pod pour économiser double donc le tarif de tout ce qui y est rattaché.
Un volume de 200 Go contenant des poids de modèle et un jeu de données coûte 20 $/mois pendant que vous travaillez et 40 $/mois une fois arrêté. Laissé un an sur un projet terminé, cela fait 480 $ pour du stockage que personne ne lit. Au tarif Community de la RTX A5000, 40 $ auraient payé 250 heures de GPU.
Le network storage évite cette pénalité : 0,07 $/Go/mois sous 1 To, 0,05 $/Go/mois au-delà, et le tarif ne change pas quand rien ne tourne. Les mêmes 200 Go y coûtent 14 $/mois, soit 2,9 fois moins qu'un volume disk inactif. Gardez sur le network storage tout ce qui doit survivre entre deux sessions et laissez les volumes de pod jetables.
Avantages & inconvénients RunPod
- Cheapest community GPUs from $0.16/h
- Massive GPU variety including H100
- Serverless endpoints for inference APIs
- Great UI and pod management
- Community cloud less reliable than dedicated
- Storage costs add up over time
- Support can be slow on free tier
Community Cloud vs Secure Cloud — Lequel choisir ?
Utilisez Community Cloud pour des batchs tolérants aux pannes (entraînement avec checkpointing, rendus Stable Diffusion, traitement de données). Les économies sont massives et le downtime est acceptable.
Utilisez Secure Cloud quand le downtime coûte plus cher que la différence de prix : APIs d’inférence en production, fine-tuning multi-jours, tout ce qui a des SLA. Le matériel est dédié et nettement plus fiable.
RunPod Serverless — Cela vaut-il le coup ?
RunPod Serverless est vraiment excellent pour l’inférence intermittente. Vous déployez une image Docker une fois, RunPod gère le scaling. Les cold starts sont la principale préoccupation (~5–15s pour gros modèles), mais des workers chauds peuvent être épinglés moyennant un coût supplémentaire. Comparé à Modal et Replicate, RunPod Serverless est typiquement 30–50 % moins cher à grande échelle.
Alternatives à RunPod
- Vast.ai — Cloud communautaire encore moins cher. UI moins polie, économies brutes plus importantes.
- Lambda Labs — Meilleure fiabilité, idéal pour H100 on-demand sans la complexité marketplace.
- Paperspace — Environnement notebook mieux intégré pour équipes de recherche.
- CoreWeave — Clusters Kubernetes-natifs entreprise pour l’entraînement de foundation models.
Verdict
RunPod est notre choix #1 pour la plupart des développeurs IA. La combinaison prix, variété GPU et facilité est inégalée. Secure Cloud est assez fiable pour la plupart des workloads de production. Serverless est vraiment compétitif pour les APIs d’inférence. La principale faiblesse est la réactivité du support en plans gratuits/hobby. Pour des SLA entreprise blindés, regardez Lambda Labs ou CoreWeave.
FAQ RunPod
RunPod est-il fiable ?
Le Secure Cloud de RunPod utilise du matériel datacenter dédié avec une bonne uptime. Le Community Cloud dépend des hôtes individuels et peut être interrompu. Pour de l'inférence en production ou de longs entraînements, utilisez Secure Cloud.
RunPod a-t-il des H100 ?
Oui, RunPod propose des instances H100 SXM et PCIe sur les deux tiers. La disponibilité fluctue — les H100 partent en premier. Vérifiez la carte de disponibilité en temps réel sur RunPod.io.
Comment fonctionne la facturation RunPod ?
RunPod facture à la seconde avec un minimum d'1 minute, et les frais GPU s'arrêtent dès que vous stoppez un pod. Le stockage, non. Un volume disk coûte 0,10 $/Go/mois tant que le pod tourne et 0,20 $/Go/mois une fois à l'arrêt : stopper un pod double donc le tarif de stockage au lieu d'y mettre fin. Le network storage est moins cher, à 0,07 $/Go/mois sous 1 To et 0,05 $/Go/mois au-delà.
Qu’est-ce que RunPod Serverless ?
RunPod Serverless déploie des endpoints d’inférence qui scalent à zéro. Vous payez seulement par requête (compute-unit), pas par heure idle. Idéal pour des APIs d’inférence à faible trafic.
Puis-je utiliser des images Docker custom ?
Oui — toute image Docker publique fonctionne. RunPod a aussi 50+ templates officiels (vLLM, Ollama, ComfyUI, Kohya, etc.) qui démarrent préconfigurés en quelques secondes.