Sari la conținut

CUDA în conductă

alergători GPU

Runnerele NVIDIA L4 și A10G cu CUDA preinstalat, pentru evaluarea modelului și compilarea kernelului în CI.

L4 și A10G

24 GB de VRAM, suficient pentru suite de evaluare și teste de inferență de dimensiuni medii.

Șoferii gata

CUDA 12.6 și cuDNN 9 deja instalate și verificate.

Pe minut

Fără angajament de capacitate rezervată.

GitHub nu vinde rulare GPU, așa că căile codului GPU rămân de obicei netestate până la implementare. Per-minute GPU CI închide acest decalaj fără un cluster permanent.

Întrebări frecvente

De ce aș avea nevoie de un GPU în CI?
Deci prima rulare a unui nucleu CUDA nu este în producție. Runnerele GPU vă permit să compilați nuclee, să rulați evaluarea modelului pe cererile de extragere și să verificați bugetele de latență de inferență înainte de îmbinare.
Ce GPU-uri sunt disponibile?
NVIDIA L4 și A10G, ambele de 24 GB, cu CUDA 12.6 și cuDNN 9 preinstalate și verificate.
GitHub oferă rulare GPU?
Nu. Aceasta este o capacitate fără echivalent găzduit de GitHub, motiv pentru care echipele fie auto-găzduiesc, fie omit complet testele GPU.

Următorul tău build poate fi de două ori mai rapid, la jumătate de preț

Începe gratuit. Plecarea înseamnă aceeași linie, iar acel diff îl publicăm și noi.