Solusi

VPS untuk API dengan latensi rendah dan backend waktu nyata

Clipper 8 · $49/moClipper 16 · $92/mo
Jawaban singkat

Respons API di bawah 10 ms adalah masalah penempatan sebelum masalah kode. Fisika memberi batas bawah sekitar 1 ms per 100 km serat, jadi tidak ada jumlah optimasi yang mengalahkan berada di kota yang salah. Terapkan instance Clipper di wilayah tempat pengguna Anda berada, jaga jalur cepat bebas dari panggilan lintas wilayah, dan ukur pada persentil ke-99 daripada rata-rata.

Apa yang Anda butuhkan

Batas bawah spesifikasi untuk api latency rendah
Sumber dayaApa yang sebenarnya Anda butuhkan
CPUInti khusus frekuensi tinggi; latensi ekor adalah masalah penjadwalan
RAM8–32 GB tergantung pada set kerja
DiskNVMe Gen4
JaringanWilayah berkemampuan Anycast untuk satu titik masuk global

Paket yang direkomendasikan

Clipper

Clipper 8

$ 46.55 /month

US$139,65 total · Hemat 5%

vCPU
4 × khusus
RAM
8 GB
Penyimpanan
200 GB NVMe Gen4 SSD
Transfer
20 TB
IPv4 / IPv6
1 / /64 routed
Konfigurasi
Clipper

Clipper 16

$ 87.4 /month

US$262,20 total · Hemat 5%

vCPU
8 × khusus
RAM
16 GB
Penyimpanan
400 GB NVMe Gen4 SSD
Transfer
30 TB
IPv4 / IPv6
1 / /64 routed
Konfigurasi
Clipper

Clipper 32

$ 165.3 /month

US$495,90 total · Hemat 5%

vCPU
12 × khusus
RAM
32 GB
Penyimpanan
800 GB NVMe Gen4 SSD
Transfer
40 TB
IPv4 / IPv6
1 / /64 routed
Konfigurasi

Lokasi yang direkomendasikan

Lokasi biasanya adalah keputusan yang paling menentukan untuk beban kerja ini — baik karena latensi mendominasi, atau karena yurisdiksi yang menentukan.

Mengapa OnionVPS untuk ini

  • Inti khusus frekuensi tinggi menghilangkan waktu mencuri yang menciptakan pencilan p99.
  • Wilayah berkemampuan Anycast memungkinkan satu alamat untuk merutekan ke instance sehat terdekat.
  • Lokasi di enam benua, karena penempatan adalah tuas tunggal terbesar yang Anda miliki.
  • Wilayah inti dengan peering yang baik di bursa utama, sehingga jalurnya pendek sekaligus cepat.

Cara mengaturnya

  1. Petakan dari mana permintaan Anda berasal

    Lalu sebarkan ke wilayah tersebut, bukan ke yang termurah.

  2. Sebarkan instance Clipper per wilayah

    Core frekuensi tinggi, dan pin prosesnya.

  3. Jaga jalur panas tetap lokal di wilayah

    Satu panggilan basis data lintas wilayah menghapus semua optimasi lainnya.

  4. Aktifkan HTTP/3 dan jaga koneksi tetap hidup

    Penyiapan koneksi mendominasi latensi permintaan pendek.

  5. Ukur p99, bukan rata-rata

    Rata-rata menyembunyikan persis permintaan yang dikeluhkan pengguna Anda.

Pertanyaan yang sering diajukan

Berapa latensi API yang realistis dari VPS?

Di bawah 1 ms waktu server dapat dicapai untuk penangan sederhana di core khusus. Total latensi yang dirasakan pengguna didominasi oleh jarak: kira-kira 1 ms per 100 km setiap arah, sehingga penempatan menentukan hasilnya.

Apakah anycast membantu latensi API?

Ya, dengan merutekan setiap pengguna ke instance sehat terdekat tanpa penundaan propagasi DNS. Ini membutuhkan instance di beberapa wilayah dan tersedia di lokasi kami yang mendukung anycast.

Mengapa p99 saya jauh lebih buruk daripada rata-rata?

Biasanya waktu curian CPU pada core bersama, atau pengumpulan sampah. Core khusus menghilangkan yang pertama; yang kedua adalah masalah kode.