Servidores GPU offshoreTarjetas enteras, por segundo. Nadie las comparte.

RTX 4090, L40S, A100, H100 y H200 en hosts EPYC con almacenamiento temporal NVMe local, en cualquiera de las ocho jurisdicciones. Nunca una fracción de tarjeta repartida por tiempo, y nada de lo que entrene se examina jamás.

desde0,27$/h

Ver los ocho nodos

Facturado por segundo · Sin plazo mínimo · −30 % en reserva mensual

  • G1 · 4090
    GPURTX 409024 GB GDDR6X
    vCPU8 vCPUEPYC 9004
    Memoria48 GBDDR5 ECC
    Scratch500 GBNVMe scratch
    0,27$/h$0,34 en otro lugar
  • G2 · 4090
    GPU2 × RTX 409048 GB GDDR6X
    vCPU16 vCPUEPYC 9004
    Memoria96 GBDDR5 ECC
    Scratch1 TBNVMe scratch
    0,53$/h$0,68 en otro lugar
  • G1 · L40SMejor valor
    GPUL40S48 GB GDDR6
    vCPU12 vCPUEPYC 9004
    Memoria96 GBDDR5 ECC
    Scratch1 TBNVMe scratch
    0,57$/h$0,72 en otro lugar
  • G1 · A100
    GPUA10080 GB HBM2e
    vCPU16 vCPUEPYC 9004
    Memoria128 GBDDR5 ECC
    Scratch1.5 TBNVMe scratch
    0,85$/h$1,07 en otro lugar
  • G1 · H100
    GPUH100 SXM80 GB HBM3
    vCPU20 vCPUEPYC 9004
    Memoria192 GBDDR5 ECC
    Scratch2 TBNVMe scratch
    1,59$/h$2,01 en otro lugar
  • G4 · L40S
    GPU4 × L40S192 GB GDDR6
    vCPU48 vCPUEPYC 9004
    Memoria384 GBDDR5 ECC
    Scratch4 TBNVMe scratch
    2,27$/h$2,88 en otro lugar
    Agotado
  • G1 · H200
    GPUH200 SXM141 GB HBM3e
    vCPU24 vCPUEPYC 9004
    Memoria256 GBDDR5 ECC
    Scratch3 TBNVMe scratch
    3,49$/h$4,39 en otro lugar
  • G8 · H100
    GPU8 × H100 SXM640 GB · NVLink
    vCPU128 vCPUEPYC 9004
    Memoria1.5 TBDDR5 ECC
    Scratch8 TBNVMe scratch
    12,69$/h$16,08 en otro lugar
    Agotado

Facturado por segundo en cadena, desde que está listo hasta que se destruye — los nodos detenidos no cuestan nada, y no hay plazo mínimo. Reserve por mes por aproximadamente un 30 % menos. En otro lugar es la tarifa bajo demanda publicada más barata para la misma tarjeta en una nube de GPU con nombre; los mercados interrumpibles de hardware de consumo no cuentan, porque una tarjeta que puede desaparecer a mitad de ejecución no es el mismo producto.

Incluido en cada nodo

  • Facturado por segundo, sin plazo mínimo
  • Root en bare metal o en un contenedor
  • CUDA 12, PyTorch y TensorFlow preinstalados
  • NVLink en nodos multitarjeta
  • IPv4 + IPv6 dedicadas
  • Sin cargo de salida por los pesos del modelo
  • Reserve mensualmente para un 30 % adicional de descuento
  • Pago en criptomonedas, sin verificación de identidad

¿Qué tarjeta se ajusta al trabajo?

RTX 4090

Inferencia, generación de imagen y vídeo, ajuste fino de modelos que caben en 24 GB. La forma más barata de mantener algo caliente.

L40S

48 GB con codificadores serios: renderizado, transcodificación e inferencia que superaron una 4090.

A100 · H100

Entrenamientos e inferencia de contexto amplio donde el límite es el ancho de banda HBM, no el número de núcleos.

H200 · 8 × H100

Modelos que no caben en nada más pequeño, y ejecuciones de varios días que no pueden interrumpirse.

¿Busca una tarjeta que no figura en la lista, o un proveedor construido en torno a varias de ellas? Especifíquelo en el configurador personalizado

La plataforma

La tarjeta entera, o no la vendemos.

Buena parte de la capacidad de GPU barata del mercado es una fracción de una tarjeta, una máquina de consumo en el piso de alguien, o una instancia que desaparece cuando aparece un postor mejor. Nada de eso se ofrece aquí.

Aceleradores
NVIDIA Ada y Hopper RTX 4090, L40S, A100, H100 y H200. Tarjetas completas asignadas por passthrough — nunca una fracción en time-slicing o virtualizada.
Host
AMD EPYC 9004 · DDR5 ECC Dimensionado para que la GPU sea el cuello de botella, no el cargador. PCIe 5.0 en todo el sistema, NVLink entre tarjetas en nodos multi-GPU.
Scratch
NVMe local, 0.5 – 8 TB En el propio nodo, no en un volumen de red. Los datasets se preparan a la velocidad plena del disco en lugar de arrastrarse por una red.
Facturación
Por segundo Detenga el nodo y la facturación se detiene con él. Reserve por mes por aproximadamente un 30 % menos si el trabajo es continuo.
Runtime
Bare metal o contenedor Tome la máquina entera, o un contenedor con CUDA 12, PyTorch y TensorFlow ya instalados. Las imágenes personalizadas son bienvenidas.
Privacidad
Nada inspeccionado No escaneamos pesos, conjuntos de datos ni salidas, y no se conserva nada después de destruir el nodo.

Precargado, o traiga un contenedor de cualquier registro

Disponible en cualquiera de los ocho

La tarifa nunca cambia con la región. Elija la jurisdicción, no el precio.

  • ReikiavikIslandia
  • BucarestRumanía
  • SofíaBulgaria
  • ChisináuMoldavia
  • ZúrichSuiza
  • ÁmsterdamPaíses Bajos
  • Ciudad de PanamáPanamá
  • SingapurSingapur

Incluido en cada tamaño

Cuatro cosas por las que cobra casi todo el sector, y una de ellas dos veces.

  • Mitigación

    protección DDoS de 1.2 Tbit/s

    Siempre activo en cada borde, tanto en el plan más barato como en el mayor. Sin tarifa por ataque, sin depuración medida y sin venta adicional de IP protegida.

  • Disponibilidad

    SLA de 99.99 % de tiempo de actividad

    Los créditos se calculan a partir del registro público de incidentes y se aplican a su saldo automáticamente. No hay formulario de reclamación, porque no hay nada que reclamar.

  • Liquidación

    Pago en cripto, sin identidad

    Ocho activos, Monero incluido. Sin tarjeta, sin datos bancarios, sin documento — ni al registrarse, ni al renovar, ni a ningún importe.

  • Traslado

    Migración gratuita

    Servidores completos, paneles de control, bases de datos y correo, migrados por un ingeniero sin coste. Usted prueba la copia antes de que se produzca el corte, y conserva el host anterior hasta que esté conforme.

Antes de lanzar.

¿Se comparte la tarjeta con alguien más?

No. Las tarjetas se asignan enteras a su nodo — nunca una partición MIG por tiempo compartido ni una fracción virtualizada. Lo que dice la especificación es lo que recibe durante todo el periodo, y no hay nadie más programado sobre ella.

¿Cómo se factura exactamente?

Por segundo, desde el momento en que el nodo está listo hasta el momento en que usted lo destruye. No hay plazo mínimo ni coste mientras está detenido. El trabajo continuo sale más barato reservado por mes — aproximadamente un 30 % por debajo de la tarifa por hora.

¿Puedo traer mi propia imagen?

Sí. Arranque un contenedor desde cualquier registro, o tome el nodo como bare metal e instale lo que quiera. Nuestras imágenes incluyen CUDA 12 con PyTorch y TensorFlow ya compilados, lo cual ahorra la primera hora habitual.

¿Cómo llevo un conjunto de datos grande hasta el nodo?

El almacenamiento temporal NVMe local, de medio terabyte a ocho terabytes, reside en la propia máquina, de modo que el preprocesamiento corre a la velocidad del disco y no a través de un volumen de red. La entrada nunca se cobra, ni tampoco la salida de pesos de modelo.

¿Miran lo que estoy entrenando?

No. Los pesos, los conjuntos de datos y las salidas no se escanean, indexan ni conservan, y destruir el nodo destruye con él el almacenamiento temporal. Aquí se aplica la misma política de contenido que en el resto del parque.

¿Y si la tarjeta que quiero está agotada?

El suministro de aceleradores se mueve por lotes y las configuraciones populares sí se agotan. Dígale a un ingeniero qué necesita y aproximadamente cuándo; la capacidad reservada se asigna antes que la demanda por hora, así que un compromiso mensual suele encontrar hardware más rápido.