Server dedicated NVIDIA L4 untuk inferensi AI dan video
NVIDIA L4 adalah GPU kelas pusat data yang dibangun di atas arsitektur Ada Lovelace. Kartu ini menggabungkan memori 24 GB dengan konsumsi daya hanya 72 W, menjadikannya salah satu kartu paling hemat biaya untuk menjalankan model AI di lingkungan produksi. Di IPHOST, L4 hadir dalam server dedicated: kartu, prosesor, memori, dan penyimpanan sepenuhnya milik Anda, tanpa lapisan virtualisasi dan tanpa klien lain di GPU yang sama.
Spesifikasi NVIDIA L4
| Arsitektur | Ada Lovelace |
|---|---|
| Memori GPU | 24 GB GDDR6 dengan ECC |
| Bandwidth memori | 300 GB/s |
| Core CUDA | 7.424 |
| Konsumsi daya (TDP) | 72 W |
| Mesin video | Encode dan decode perangkat keras untuk AV1, HEVC, dan H.264 |
| Antarmuka | PCIe Gen4 x16, slot tunggal |
Konfigurasi server
Paket L4 berjalan di HPE DL360 Gen10 dengan satu Intel Xeon Gold 6248 (20 core, 40 thread), RAM ECC 128 GB, dan dua SAS-SSD enterprise 1.6 TB. Termasuk port jaringan 1 Gbps dengan trafik 30 TB per bulan, satu alamat IPv4, proteksi DDoS dasar, dan manajemen jarak jauh iLO.
Apa yang dapat Anda jalankan di NVIDIA L4
- Inferensi LLM – model 7–8B seperti Llama 3.1 8B atau Mistral 7B dalam FP16, dan model hingga sekitar 30B jika dikuantisasi ke 4-bit, dilayani melalui Ollama atau vLLM.
- Transcoding dan streaming video – L4 adalah satu-satunya kartu dalam lini kami dengan encoding AV1 perangkat keras, sangat cocok untuk siaran langsung dan platform video.
- Computer vision dan suara – deteksi objek, OCR, speech-to-text Whisper, dan embedding dengan latensi stabil.
- Pembuatan gambar – Stable Diffusion dan SDXL pada resolusi standar.
- Desktop virtual – workstation jarak jauh berakselerasi GPU untuk desain dan CAD.
Harga dan penagihan NVIDIA L4
Harga dalam tabel di atas adalah harga bulanan dengan penagihan per kuartal, 3 bulan di muka. Jika Anda membayar untuk 12 bulan, harga bulanannya hingga 14% lebih rendah. Server GPU diserahkan secara pre-order dalam 14 hari; jika kami melewati tanggal tersebut, Anda mendapatkan pengembalian dana penuh.
L4 atau GPU yang lebih besar?
Pilih L4 jika model Anda muat dalam 24 GB dan Anda mengutamakan biaya per permintaan serta efisiensi daya. Untuk model 70B, pembuatan gambar resolusi tinggi, atau rendering 3D, lihat server dedicated NVIDIA A40. Untuk training dan fine-tuning, lihat server dedicated 2x NVIDIA A100. Semua paket tercantum di halaman hosting server GPU.