Máy chủ GPU ở nước ngoàiToàn bộ card đồ họa, tính theo giây. Không ai chia sẻ chung.

RTX 4090, L40S, A100, H100 và H200 trên máy chủ EPYC với bộ nhớ tạm NVMe nội bộ, tại bất kỳ khu vực pháp lý nào trong tám khu vực. Không bao giờ là một phần chia sẻ theo thời gian của card đồ họa, và không có gì quý khách huấn luyện từng bị xem xét.

từ0,27$/giờ

Xem tám node

Tính phí theo giây · Không kỳ hạn tối thiểu · −30 % khi đặt trước theo tháng

  • G1 · 4090
    GPURTX 409024 GB GDDR6X
    vCPU8 vCPUEPYC 9004
    Bộ nhớ48 GBDDR5 ECC
    Scratch500 GBNVMe scratch
    0,27$/giờ$0,34 nơi khác
  • G2 · 4090
    GPU2 × RTX 409048 GB GDDR6X
    vCPU16 vCPUEPYC 9004
    Bộ nhớ96 GBDDR5 ECC
    Scratch1 TBNVMe scratch
    0,53$/giờ$0,68 nơi khác
  • G1 · L40SGiá trị tốt nhất
    GPUL40S48 GB GDDR6
    vCPU12 vCPUEPYC 9004
    Bộ nhớ96 GBDDR5 ECC
    Scratch1 TBNVMe scratch
    0,57$/giờ$0,72 nơi khác
  • G1 · A100
    GPUA10080 GB HBM2e
    vCPU16 vCPUEPYC 9004
    Bộ nhớ128 GBDDR5 ECC
    Scratch1,5 TBNVMe scratch
    0,85$/giờ$1,07 nơi khác
  • G1 · H100
    GPUH100 SXM80 GB HBM3
    vCPU20 vCPUEPYC 9004
    Bộ nhớ192 GBDDR5 ECC
    Scratch2 TBNVMe scratch
    1,59$/giờ$2,01 nơi khác
  • G4 · L40S
    GPU4 × L40S192 GB GDDR6
    vCPU48 vCPUEPYC 9004
    Bộ nhớ384 GBDDR5 ECC
    Scratch4 TBNVMe scratch
    2,27$/giờ$2,88 nơi khác
    Đã bán hết
  • G1 · H200
    GPUH200 SXM141 GB HBM3e
    vCPU24 vCPUEPYC 9004
    Bộ nhớ256 GBDDR5 ECC
    Scratch3 TBNVMe scratch
    3,49$/giờ$4,39 nơi khác
  • G8 · H100
    GPU8 × H100 SXM640 GB · NVLink
    vCPU128 vCPUEPYC 9004
    Bộ nhớ1,5 TBDDR5 ECC
    Scratch8 TBNVMe scratch
    12,69$/giờ$16,08 nơi khác
    Đã bán hết

Tính phí theo giây trên chuỗi (on-chain), từ lúc sẵn sàng đến lúc bị hủy — các node đã dừng không tốn phí, và không có thời hạn tối thiểu. Đặt trước theo tháng để được giảm khoảng 30 %. Nơi khác là mức giá on-demand công bố thấp nhất cho cùng loại card tại một GPU cloud có tên tuổi; các nền tảng cho thuê phần cứng tiêu dùng có thể bị gián đoạn không được tính, vì một card có thể biến mất giữa lúc đang chạy không phải là cùng một sản phẩm.

Bao gồm trên mọi node

  • Tính phí theo giây, không có thời hạn tối thiểu
  • Quyền root trên bare metal hoặc container
  • CUDA 12, PyTorch và TensorFlow được cài sẵn
  • NVLink trên node nhiều card
  • Dedicated IPv4 + IPv6
  • Không tính phí egress đối với model weights
  • Đặt trước theo tháng để được giảm thêm 30 %
  • Thanh toán bằng crypto, không kiểm tra danh tính

Card nào phù hợp với công việc?

RTX 4090

Suy luận (inference), tạo hình ảnh và video, tinh chỉnh (fine-tuning) các mô hình vừa trong 24 GB. Cách rẻ nhất để giữ một thứ gì đó luôn sẵn sàng.

L40S

48 GB với bộ mã hóa đầy đủ: kết xuất, chuyển mã, và suy luận (inference) đã vượt quá khả năng của một chiếc 4090.

A100 · H100

Các quá trình huấn luyện và suy luận (inference) với ngữ cảnh lớn, nơi băng thông HBM chứ không phải số lõi mới là giới hạn.

H200 · 8 × H100

Các mô hình không thể chạy trên cấu hình nhỏ hơn, và các tác vụ chạy nhiều ngày không được phép gián đoạn.

Đang tìm một loại thẻ không có trong danh sách, hay một nhà cung cấp được xây dựng xoay quanh nhiều loại thẻ? Chỉ định trong công cụ tùy chỉnh

Nền tảng

Cả chiếc card nguyên vẹn, nếu không chúng tôi sẽ không bán.

Phần lớn năng lực GPU giá rẻ trên thị trường là một lát cắt của card, một máy tính tiêu dùng đặt trong căn hộ của ai đó, hoặc một instance biến mất khi có người trả giá cao hơn. Không có điều nào trong số đó được cung cấp ở đây.

Bộ tăng tốc
NVIDIA Ada và Hopper RTX 4090, L40S, A100, H100 và H200. Toàn bộ card được chuyển tiếp trực tiếp — không bao giờ là phần chia sẻ thời gian hay ảo hóa một phần.
Máy chủ
AMD EPYC 9004 · DDR5 ECC Được thiết kế để GPU là nút thắt cổ chai, không phải khâu nạp dữ liệu. Toàn bộ dùng PCIe 5.0, NVLink giữa các card trên node đa GPU.
Scratch
NVMe cục bộ, 0,5 – 8 TB Ngay trên chính node, không phải ổ lưu trữ mạng. Tập dữ liệu được xử lý ở tốc độ đĩa tối đa thay vì bò chậm qua hạ tầng mạng.
Thanh toán
Theo giây Dừng node thì tính phí cũng dừng theo. Đặt trước theo tháng để tiết kiệm khoảng 30% nếu công việc chạy liên tục.
Runtime
Bare metal hoặc container Nhận trọn máy chủ, hoặc một container đã cài sẵn CUDA 12, PyTorch và TensorFlow. Hình ảnh hệ thống tùy chỉnh đều được chấp nhận.
Quyền riêng tư
Không có gì bị kiểm tra Chúng tôi không quét weights, tập dữ liệu hay đầu ra, và không có gì được lưu lại sau khi quý khách hủy node.

Cài sẵn, hoặc mang container từ bất kỳ registry nào

Có sẵn tại bất kỳ vị trí nào trong tám địa điểm

Mức giá không thay đổi theo khu vực. Hãy chọn theo khu vực pháp lý, không phải theo giá.

  • ReykjavíkIceland
  • BucharestRomania
  • SofiaBulgaria
  • ChișinăuMoldova
  • ZurichThụy Sĩ
  • AmsterdamNetherlands
  • Panama CityPanama
  • SingaporeSingapore

Bao gồm ở mọi kích cỡ

Bốn thứ mà hầu hết các nhà cung cấp trong ngành tính phí, trong đó một thứ bị tính phí hai lần.

  • Giảm thiểu

    Chống DDoS 1.2 Tbit/s

    Luôn bật ở mọi điểm biên, trên gói rẻ nhất cũng như gói lớn nhất. Không phí theo từng đợt tấn công, không tính phí lọc theo lưu lượng, không bán thêm gói IP được bảo vệ.

  • Tính khả dụng

    99.99 % uptime SLA

    Khoản tín dụng được tính toán từ hồ sơ sự cố công khai và tự động cộng vào số dư của quý khách. Không có biểu mẫu yêu cầu bồi hoàn, vì không có gì cần yêu cầu.

  • Thanh toán bù trừ

    Thanh toán bằng tiền mã hóa, không cần danh tính

    Tám loại tài sản bao gồm cả Monero. Không cần thẻ, không cần thông tin ngân hàng, không cần giấy tờ — không khi đăng ký, không khi gia hạn, và không ở bất kỳ mức số tiền nào.

  • Chuyển vào

    Di chuyển miễn phí

    Toàn bộ máy chủ, bảng điều khiển, cơ sở dữ liệu và mail, được kỹ sư di chuyển miễn phí. Quý khách kiểm tra bản sao trước khi chuyển đổi hoàn toàn, và vẫn giữ nhà cung cấp cũ cho đến khi hài lòng.

Trước khi khởi chạy.

Thẻ này có được chia sẻ với ai khác không?

Không. Toàn bộ card được chuyển thẳng cho node của quý khách — không bao giờ là một phân vùng MIG chia theo thời gian hay một phần ảo hóa. Những gì thông số kỹ thuật ghi là những gì quý khách nhận được trong suốt thời gian sử dụng, không ai khác được lên lịch sử dụng chung.

Việc tính phí chính xác như thế nào?

Tính theo từng giây, từ thời điểm node sẵn sàng đến thời điểm quý khách xóa nó. Không có thời hạn tối thiểu và không tính phí khi đang dừng. Công việc liên tục sẽ rẻ hơn nếu đặt theo tháng — thấp hơn khoảng 30% so với mức giá theo giờ.

Tôi có thể mang image riêng của mình không?

Có. Khởi động một container từ bất kỳ registry nào, hoặc lấy node dưới dạng bare metal và tự cài đặt theo ý muốn. Các image của chúng tôi đi kèm CUDA 12 với PyTorch và TensorFlow đã được xây dựng sẵn, giúp tiết kiệm giờ đầu tiên thường mất.

Làm sao để đưa một tập dữ liệu lớn lên node?

Bộ nhớ NVMe cục bộ dung lượng từ nửa terabyte đến 8 terabyte nằm ngay trên máy, nên khâu chuẩn bị dữ liệu chạy ở tốc độ ổ đĩa thay vì qua một volume mạng. Ingress không bao giờ bị tính phí, và egress đối với trọng số mô hình cũng vậy.

Quý khách có xem những gì tôi đang training không?

Không. Trọng số mô hình, tập dữ liệu và kết quả đầu ra không bị quét, lập chỉ mục hay lưu giữ, và việc hủy node cũng hủy luôn bộ nhớ tạm đi kèm. Cùng một chính sách nội dung được áp dụng ở đây như ở mọi nơi khác trong toàn bộ hạ tầng.

Nếu chiếc card tôi muốn đã hết hàng thì sao?

Nguồn cung bộ tăng tốc về theo từng lô, và các cấu hình phổ biến thường hết hàng. Hãy cho kỹ sư biết quý khách cần gì và khoảng thời gian nào; công suất đặt trước được phân bổ trước nhu cầu theo giờ, nên cam kết theo tháng thường tìm được phần cứng nhanh hơn.