
Servidores GPU offshoreTarjetas enteras, por segundo. Nadie las comparte.
RTX 4090, L40S, A100, H100 y H200 en hosts EPYC con almacenamiento temporal NVMe local, en cualquiera de las ocho jurisdicciones. Nunca una fracción de tarjeta repartida por tiempo, y nada de lo que entrene se examina jamás.
- G1 · 4090GPURTX 409024 GB GDDR6XvCPU8 vCPUEPYC 9004Memoria48 GBDDR5 ECCScratch500 GBNVMe scratch0,27$/h
$0,34en otro lugar - G2 · 4090GPU2 × RTX 409048 GB GDDR6XvCPU16 vCPUEPYC 9004Memoria96 GBDDR5 ECCScratch1 TBNVMe scratch0,53$/h
$0,68en otro lugar - G1 · L40SMejor valorGPUL40S48 GB GDDR6vCPU12 vCPUEPYC 9004Memoria96 GBDDR5 ECCScratch1 TBNVMe scratch0,57$/h
$0,72en otro lugar - G1 · A100GPUA10080 GB HBM2evCPU16 vCPUEPYC 9004Memoria128 GBDDR5 ECCScratch1.5 TBNVMe scratch0,85$/h
$1,07en otro lugar - G1 · H100GPUH100 SXM80 GB HBM3vCPU20 vCPUEPYC 9004Memoria192 GBDDR5 ECCScratch2 TBNVMe scratch1,59$/h
$2,01en otro lugar - G4 · L40SGPU4 × L40S192 GB GDDR6vCPU48 vCPUEPYC 9004Memoria384 GBDDR5 ECCScratch4 TBNVMe scratch2,27$/h
$2,88en otro lugarAgotado - G1 · H200GPUH200 SXM141 GB HBM3evCPU24 vCPUEPYC 9004Memoria256 GBDDR5 ECCScratch3 TBNVMe scratch3,49$/h
$4,39en otro lugar - G8 · H100GPU8 × H100 SXM640 GB · NVLinkvCPU128 vCPUEPYC 9004Memoria1.5 TBDDR5 ECCScratch8 TBNVMe scratch12,69$/h
$16,08en otro lugarAgotado
Facturado por segundo en cadena, desde que está listo hasta que se destruye — los nodos detenidos no cuestan nada, y no hay plazo mínimo. Reserve por mes por aproximadamente un 30 % menos. En otro lugar es la tarifa bajo demanda publicada más barata para la misma tarjeta en una nube de GPU con nombre; los mercados interrumpibles de hardware de consumo no cuentan, porque una tarjeta que puede desaparecer a mitad de ejecución no es el mismo producto.
Incluido en cada nodo
- Facturado por segundo, sin plazo mínimo
- Root en bare metal o en un contenedor
- CUDA 12, PyTorch y TensorFlow preinstalados
- NVLink en nodos multitarjeta
- IPv4 + IPv6 dedicadas
- Sin cargo de salida por los pesos del modelo
- Reserve mensualmente para un 30 % adicional de descuento
- Pago en criptomonedas, sin verificación de identidad
¿Qué tarjeta se ajusta al trabajo?
RTX 4090
Inferencia, generación de imagen y vídeo, ajuste fino de modelos que caben en 24 GB. La forma más barata de mantener algo caliente.
L40S
48 GB con codificadores serios: renderizado, transcodificación e inferencia que superaron una 4090.
A100 · H100
Entrenamientos e inferencia de contexto amplio donde el límite es el ancho de banda HBM, no el número de núcleos.
H200 · 8 × H100
Modelos que no caben en nada más pequeño, y ejecuciones de varios días que no pueden interrumpirse.
¿Busca una tarjeta que no figura en la lista, o un proveedor construido en torno a varias de ellas? Especifíquelo en el configurador personalizado
La plataforma
La tarjeta entera, o no la vendemos.
Buena parte de la capacidad de GPU barata del mercado es una fracción de una tarjeta, una máquina de consumo en el piso de alguien, o una instancia que desaparece cuando aparece un postor mejor. Nada de eso se ofrece aquí.
- Aceleradores
- NVIDIA Ada y Hopper RTX 4090, L40S, A100, H100 y H200. Tarjetas completas asignadas por passthrough — nunca una fracción en time-slicing o virtualizada.
- Host
- AMD EPYC 9004 · DDR5 ECC Dimensionado para que la GPU sea el cuello de botella, no el cargador. PCIe 5.0 en todo el sistema, NVLink entre tarjetas en nodos multi-GPU.
- Scratch
- NVMe local, 0.5 – 8 TB En el propio nodo, no en un volumen de red. Los datasets se preparan a la velocidad plena del disco en lugar de arrastrarse por una red.
- Facturación
- Por segundo Detenga el nodo y la facturación se detiene con él. Reserve por mes por aproximadamente un 30 % menos si el trabajo es continuo.
- Runtime
- Bare metal o contenedor Tome la máquina entera, o un contenedor con CUDA 12, PyTorch y TensorFlow ya instalados. Las imágenes personalizadas son bienvenidas.
- Privacidad
- Nada inspeccionado No escaneamos pesos, conjuntos de datos ni salidas, y no se conserva nada después de destruir el nodo.
Precargado, o traiga un contenedor de cualquier registro
- Ubuntu 24.04 LTS
- CUDA 12.4
- PyTorch 2.5
- TensorFlow 2.18
- JupyterLab
- Hugging Face TGI
- ONNX Runtime
- Imágenes NVIDIA NGC
- Cualquier registro OCI
- Imagen personalizada
Disponible en cualquiera de los ocho
La tarifa nunca cambia con la región. Elija la jurisdicción, no el precio.
- ReikiavikIslandia
- BucarestRumanía
- SofíaBulgaria
- ChisináuMoldavia
- ZúrichSuiza
- ÁmsterdamPaíses Bajos
- Ciudad de PanamáPanamá
- SingapurSingapur
Incluido en cada tamaño
Cuatro cosas por las que cobra casi todo el sector, y una de ellas dos veces.
-
Mitigación
protección DDoS de 1.2 Tbit/s
Siempre activo en cada borde, tanto en el plan más barato como en el mayor. Sin tarifa por ataque, sin depuración medida y sin venta adicional de IP protegida.
-
Disponibilidad
SLA de 99.99 % de tiempo de actividad
Los créditos se calculan a partir del registro público de incidentes y se aplican a su saldo automáticamente. No hay formulario de reclamación, porque no hay nada que reclamar.
-
Liquidación
Pago en cripto, sin identidad
Ocho activos, Monero incluido. Sin tarjeta, sin datos bancarios, sin documento — ni al registrarse, ni al renovar, ni a ningún importe.
-
Traslado
Migración gratuita
Servidores completos, paneles de control, bases de datos y correo, migrados por un ingeniero sin coste. Usted prueba la copia antes de que se produzca el corte, y conserva el host anterior hasta que esté conforme.
Antes de lanzar.
¿Se comparte la tarjeta con alguien más?
No. Las tarjetas se asignan enteras a su nodo — nunca una partición MIG por tiempo compartido ni una fracción virtualizada. Lo que dice la especificación es lo que recibe durante todo el periodo, y no hay nadie más programado sobre ella.
¿Cómo se factura exactamente?
Por segundo, desde el momento en que el nodo está listo hasta el momento en que usted lo destruye. No hay plazo mínimo ni coste mientras está detenido. El trabajo continuo sale más barato reservado por mes — aproximadamente un 30 % por debajo de la tarifa por hora.
¿Puedo traer mi propia imagen?
Sí. Arranque un contenedor desde cualquier registro, o tome el nodo como bare metal e instale lo que quiera. Nuestras imágenes incluyen CUDA 12 con PyTorch y TensorFlow ya compilados, lo cual ahorra la primera hora habitual.
¿Cómo llevo un conjunto de datos grande hasta el nodo?
El almacenamiento temporal NVMe local, de medio terabyte a ocho terabytes, reside en la propia máquina, de modo que el preprocesamiento corre a la velocidad del disco y no a través de un volumen de red. La entrada nunca se cobra, ni tampoco la salida de pesos de modelo.
¿Miran lo que estoy entrenando?
No. Los pesos, los conjuntos de datos y las salidas no se escanean, indexan ni conservan, y destruir el nodo destruye con él el almacenamiento temporal. Aquí se aplica la misma política de contenido que en el resto del parque.
¿Y si la tarjeta que quiero está agotada?
El suministro de aceleradores se mueve por lotes y las configuraciones populares sí se agotan. Dígale a un ingeniero qué necesita y aproximadamente cuándo; la capacidad reservada se asigna antes que la demanda por hora, así que un compromiso mensual suele encontrar hardware más rápido.
