Solução

VPS para APIs de baixa latência e backends em tempo real

Clipper 8 · $49/moClipper 16 · $92/mo
Resposta curta

Respostas de API abaixo de 10 ms são um problema de localização antes de serem um problema de código. A física impõe um limite de cerca de 1 ms por cada 100 km de fibra, pelo que nenhuma otimização compensa estar na cidade errada. Implemente instâncias Clipper nas regiões onde estão os seus utilizadores, mantenha o caminho crítico livre de chamadas entre regiões e meça no percentil 99 em vez da média.

O que precisa

Especificações mínimas para apis de baixa latência
RecursoO que realmente precisa
CPUNúcleos dedicados de alta frequência; a latência de cauda é um problema de escalonamento
RAM8–32 GB dependendo do conjunto de trabalho
DiscoNVMe Gen4
RedeRegiões com capacidade Anycast para um único ponto de entrada global

Planos recomendados

Clipper

Clipper 8

$ 49 /month
vCPU
4 × dedicado
RAM
8 GB
Armazenamento
200 GB NVMe Gen4 SSD
Transferência
20 TB
IPv4 / IPv6
1 / /64 routed
Configurar
Clipper

Clipper 16

$ 92 /month
vCPU
8 × dedicado
RAM
16 GB
Armazenamento
400 GB NVMe Gen4 SSD
Transferência
30 TB
IPv4 / IPv6
1 / /64 routed
Configurar
Clipper

Clipper 32

$ 174 /month
vCPU
12 × dedicado
RAM
32 GB
Armazenamento
800 GB NVMe Gen4 SSD
Transferência
40 TB
IPv4 / IPv6
1 / /64 routed
Configurar

Localizações recomendadas

A localização é geralmente a decisão que mais importa para esta carga de trabalho — seja porque a latência domina, seja porque a jurisdição domina.

Porquê a OnionVPS para isto

  • Os núcleos dedicados de alta frequência eliminam o tempo de roubo que cria outliers no p99.
  • Regiões com capacidade Anycast permitem que um único endereço encaminhe para a instância saudável mais próxima.
  • Localizações em seis continentes, porque a localização é a maior alavanca individual que tem.
  • Regiões centrais bem interligadas nos principais pontos de troca de tráfego, para que os caminhos sejam curtos e rápidos.

Como configurar

  1. Mapa das origens dos seus pedidos

    Depois, implante nessas regiões, não na mais barata.

  2. Implante instâncias Clipper por região

    Cores de alta frequência e fixe o processo.

  3. Mantenha o caminho rápido local à região

    Uma chamada de base de dados entre regiões anula todas as outras otimizações.

  4. Ative HTTP/3 e mantenha ligações persistentes

    O estabelecimento de ligações domina a latência de pedidos curtos.

  5. Meça o p99, não a média

    As médias escondem exatamente os pedidos de que os seus utilizadores se queixam.

Perguntas frequentes

Qual é a latência realista de API a partir de um VPS?

Menos de 1 ms de tempo de servidor é alcançável para handlers simples em cores dedicadas. A latência total percebida pelo utilizador é dominada pela distância: cerca de 1 ms por 100 km em cada sentido, por isso a localização decide o resultado.

O anycast ajuda na latência de API?

Sim, ao encaminhar cada utilizador para a instância saudável mais próxima sem atraso de propagação de DNS. Requer instâncias em várias regiões e está disponível nas nossas localizações com suporte anycast.

Porque é que o meu p99 é muito pior que a minha média?

Normalmente, tempo de roubo de CPU em cores partilhadas, ou coleção de lixo. Cores dedicadas eliminam o primeiro; o segundo é um problema de código.