Lösung

VPS für latenzarme API- und Echtzeit-Backends

Clipper 8 · $49/moClipper 16 · $92/mo
Kurze Antwort

Unter-10-ms-API-Antworten sind ein Platzierungsproblem, bevor sie ein Codeproblem sind. Die Physik setzt eine Grenze von etwa 1 ms pro 100 km Glasfaser, daher schlägt keine Optimierung das Sein in der falschen Stadt. Stellen Sie Clipper-Instanzen in den Regionen bereit, in denen Ihre Benutzer sind, halten Sie den heißen Pfad frei von regionsübergreifenden Aufrufen und messen Sie am 99. Perzentil statt am Mittelwert.

Was Sie benötigen

Mindestspezifikation für low-latency-apis
RessourceWas Sie tatsächlich benötigen
CPUHochfrequente dedizierte Kerne; Tail-Latenz ist ein Scheduling-Problem
RAM8–32 GB je nach Arbeitssatz
FestplatteNVMe Gen4
NetzwerkAnycast-fähige Regionen für einen einzigen globalen Einstiegspunkt

Empfohlene Tarife

Clipper

Clipper 8

$ 46.55 /month

139,65 $ gesamt · 5% sparen

vCPU
4 × dediziert
RAM
8 GB
Speicher
200 GB NVMe Gen4 SSD
Transfer
20 TB
IPv4 / IPv6
1 / /64 routed
Konfigurieren
Clipper

Clipper 16

$ 87.4 /month

262,20 $ gesamt · 5% sparen

vCPU
8 × dediziert
RAM
16 GB
Speicher
400 GB NVMe Gen4 SSD
Transfer
30 TB
IPv4 / IPv6
1 / /64 routed
Konfigurieren
Clipper

Clipper 32

$ 165.3 /month

495,90 $ gesamt · 5% sparen

vCPU
12 × dediziert
RAM
32 GB
Speicher
800 GB NVMe Gen4 SSD
Transfer
40 TB
IPv4 / IPv6
1 / /64 routed
Konfigurieren

Empfohlene Standorte

Der Standort ist normalerweise die Entscheidung, die für diese Arbeitslast am wichtigsten ist – entweder weil die Latenz dominiert oder weil die Rechtshoheit entscheidend ist.

Warum OnionVPS dafür

  • Dedizierte Hochfrequenz-Kerne eliminieren die Steal-Zeit, die p99-Ausreißer erzeugt.
  • Anycast-fähige Regionen lassen eine Adresse zur nächsten gesunden Instanz routen.
  • Standorte auf sechs Kontinenten, denn die Platzierung ist der größte einzelne Hebel, den Sie haben.
  • Gut verbundene Kernregionen an den großen Knotenpunkten, sodass die Pfade kurz und schnell sind.

So richten Sie es ein

  1. Karte mit den Herkunftsorten Ihrer Anfragen

    Dann in diesen Regionen bereitstellen, nicht in der günstigsten.

  2. Clipper-Instanzen pro Region bereitstellen

    Kerne mit hoher Taktfrequenz und den Prozess festsetzen.

  3. Den Hot Path in der Region halten

    Ein einziger regionsübergreifender Datenbankaufruf macht alle anderen Optimierungen zunichte.

  4. HTTP/3 aktivieren und Verbindungen offen halten

    Verbindungsaufbau dominiert die Latenz bei kurzen Anfragen.

  5. p99 messen, nicht den Durchschnitt

    Durchschnittswerte verbergen genau die Anfragen, über die sich Ihre Benutzer beschweren.

Häufig gestellte Fragen

Was ist eine realistische API-Latenz von einem VPS?

Unter 1 ms Serverzeit ist für einfache Handler auf dedizierten Kernen erreichbar. Die Gesamtlatenz, die Benutzer wahrnehmen, wird durch die Entfernung dominiert: etwa 1 ms pro 100 km pro Richtung, also entscheidet die Platzierung über das Ergebnis.

Hilft Anycast bei der API-Latenz?

Ja, indem jeder Benutzer ohne DNS-Verzögerung zur nächstgelegenen aktiven Instanz geroutet wird. Dies erfordert Instanzen in mehreren Regionen und ist in unseren anycast-fähigen Standorten verfügbar.

Warum ist mein p99 viel schlechter als mein Durchschnitt?

Normalerweise CPU-Steal-Zeit auf geteilten Kernen oder Garbage Collection. Dedizierte Kerne beheben das erste; das zweite ist ein Code-Problem.