Precios de GPU en Modal (2026): tarifas por segundo para H100, A100 y T4
Precios de GPU de Modal.com verificados en julio de 2026: H100 a $3.95/h, A100 80GB a $2.50/h, T4 a $0.59/h, facturados por segundo. Más los cargos de CPU y memoria que se suman a cada factura.
Modal (modal.com) alquila GPUs por segundo mediante un runtime sin servidor centrado en Python. No hay que dimensionar ninguna instancia ni cumplir un mínimo por hora: se decora una función, Modal levanta un contenedor cuando se la invoca, y la facturación se detiene en cuanto el contenedor escala a cero. Las tarifas siguientes se verificaron contra modal.com/pricing el 31 de julio de 2026.
Tarifas de GPU en Modal
| GPU | Por segundo | Por hora |
|---|---|---|
| B300 | $0.001972 | $7.10 |
| B200 | $0.001736 | $6.25 |
| H200 | $0.001261 | $4.54 |
| H100 | $0.001097 | $3.95 |
| A100 80GB | $0.000694 | $2.50 |
| A100 40GB | $0.000583 | $2.10 |
| L40S | $0.000542 | $1.95 |
| A10 | $0.000306 | $1.10 |
| L4 | $0.000222 | $0.80 |
| T4 | $0.000164 | $0.59 |
El cargo de CPU y memoria que nadie presupuesta
La tarifa de GPU no es toda la factura. Modal cobra la CPU a $0.0000131 por núcleo-segundo con un mínimo de 0.125 núcleos por contenedor, y la memoria a $0.00000222 por GiB-segundo. Ambos cargos se acumulan junto con el de GPU mientras el contenedor esté activo.
En un contenedor H100 con 16 GiB de memoria, eso añade cerca de $0.13/h por la RAM y $0.006/h por la porción mínima de CPU, llevando la tarifa efectiva a aproximadamente $4.08/h en lugar de los $3.95/h anunciados. La brecha se amplía con inferencia intensiva en memoria: 64 GiB hacen que solo la línea de memoria supere los $0.51/h.
Planes
El plan Starter no tiene cuota base, incluye $30 de crédito cada mes y limita a 3 puestos, 10 GPUs concurrentes y 100 contenedores. El plan Team cuesta $250/mes, incluye $100 de crédito y eleva esos límites a puestos ilimitados, 50 GPUs concurrentes y 5,000 contenedores. Los $250 son una cuota de plataforma, no un prepago: el uso se factura aparte una vez agotado el crédito de $100.
Cómo se compara Modal con la misma GPU
Modal cuesta aproximadamente el doble que una instancia alquilada con el mismo silicio. Un H100 cuesta $3.95/h en Modal frente a $1.99/h en RunPod Community Cloud; un A100 80GB cuesta $2.50/h frente a $1.19/h. Lo que se paga es el escalado a cero y el modelo de despliegue, no un hardware más rápido.
Esa prima se amortiza cuando la utilización es baja. Un modelo que atiende 90 minutos de tráfico real al día cuesta cerca de $5.93/día en el H100 de Modal y $47.76/día en un pod de RunPod dejado corriendo las 24 horas. En cuanto la GPU está ocupada más de la mitad del día, el pod alquilado sale más barato. Consulta la comparación de GPU sin servidor para las diferencias de cold start y concurrencia.
Dónde se ubica Modal frente al mercado en general
| Proveedor | Tarifa inicial | Modelo de facturación |
|---|---|---|
| Vast.ai | $0.03/h | Mercado, por minuto |
| RunPod | $0.16/h | Pods por segundo + sin servidor |
| Paperspace | $0.45/h | Instancias por hora |
| AWS GPU (EC2) | $0.53/h | Por segundo, mínimo de 60 s |
| Azure GPU | $0.53/h | Por segundo |
| Modal | $0.59/h (T4) | Sin servidor por segundo |
| Lambda Labs | $0.69/h | Instancias por minuto |
| Google Cloud GPU | $0.71/h | Por segundo, mínimo de 60 s |
| CoreWeave | $1.25/h | Por nodo, facturado por hora |
Las tarifas iniciales son los pisos verificados de cada proveedor a julio de 2026 y corresponden a GPUs distintas, así que hay que leerlas como una banda de precios y no como una comparación directa. La comparación completa de nube de GPU enfrenta a los proveedores sobre el mismo hardware.
Preguntas frecuentes
¿Modal vende GPUs?
No. Modal no vende ni arrienda hardware, y no existe un contrato de capacidad reservada que firmar. Se alquila tiempo de GPU por segundo sobre infraestructura compartida, y el medidor se detiene cuando el contenedor escala a cero. Si se necesita una máquina propia, un servidor dedicado de Hetzner o una instancia reservada de un hyperscaler es la categoría adecuada.
¿Cuánto cobra Modal por un A100?
$2.50/h por la tarjeta de 80GB ($0.000694/s) y $2.10/h por la de 40GB ($0.000583/s), sin contar CPU ni memoria. Modal no ofrece un A100 de 48GB — esa capacidad no existe en la línea A100 de NVIDIA, que solo se fabricó en variantes de 40GB y 80GB.
¿Hay un nivel gratuito?
El plan Starter no tiene cuota base y renueva $30 de crédito cada mes, lo que alcanza para unas 7.5 horas en un H100 o cerca de 50 horas en un T4. El crédito no se acumula de un mes a otro, así que el saldo no usado se pierde al cierre de cada mes.
¿Cómo afecta la facturación por segundo lo que pago?
Se cobra por el tiempo que el contenedor está activo, no por el tiempo de la solicitud, y eso incluye el cold start. Cargar un modelo en 20 segundos en un H100 cuesta cerca de $0.022 cada vez que un contenedor arranca desde cero. El tráfico irregular que dispara cold starts repetidamente puede sumar una parte considerable a la factura, por eso Modal permite mantener contenedores calientes fijos a la tarifa habitual por segundo.