Waar een dedicated CPU-server goed voor is in een AI-pijplijn

We verkopen vandaag geen GPU-nodes. Heeft een trainingsrun of een inference-workload met hoog volume GPU-doorvoer nodig, dan offreert sales die hardware rechtstreeks in plaats van hem als catalogus-SKU te vermelden. Wat wel uit de catalogus komt, is single-tenant CPU bare metal, en dat dekt een groter deel van een typische AI-pijplijn dan alleen de modelaanroep: retrieval, embeddings, feature-pijplijnen en de CPU-gebonden stappen eromheen. Niets ervan wordt gedeeld met een andere klant, dus de batchjob van een buurman duikt nooit op als latency op je inference-endpoint. Bekijk de huidige configuraties op onze dedicated-servers-pagina.

CPU-inference en embeddings

Gekwantiseerde inference via llama.cpp, ONNX Runtime of OpenVINO, en het genereren van embeddings, draaien op cores die geen andere klant deelt. Niets boven je eigen OS bepaalt wanneer je proces aan de beurt is.

Vector search en retrieval

De retrieval-stap van een RAG-pijplijn, een vector-index zoals FAISS, Qdrant of Milvus, of een feature store, hangt meer af van constante lokale schijfdoorvoer dan van een GPU. Bare metal geeft daar dedicated NVMe voor, geen gedeeld volume.

Datavoorbereiding en orkestratie

Tokenization, opschonen, chunking en de orkestratie die een trainingsrun voedt, zijn CPU-gebonden stappen. Ze hebben geen GPU nodig, en op een gedeelde host strijden ze met een GPU-job om de aandacht van de scheduler.

  • Inference
  • RAG
  • Vector search
  • Datapijplijnen

Waar CPU stopt en een GPU-offerte begint

De catalogus op deze pagina is CPU bare metal: single-tenant, geen virtualisatie, per uur te huren zolang je een pijplijn erop test. Een model vanaf nul trainen, of inference draaien op een schaal die GPU-doorvoer vraagt, is andere hardware die we niet als SKU vermelden. Sales offreert GPU-capaciteit rechtstreeks; de CPU-gebonden stappen van diezelfde pijplijn kun je direct bestellen.

Wat er op het platform draait

  • Windows Server- en Linux-images met één klik
  • Volledige root-toegang, uitgerold vanuit de cloud console
  • Lokale NVMe-opslag voor vector-indexen en datasets
  • Facturering per uur terwijl je een pijplijn test, per maand zodra hij in productie draait

Netwerk en betrouwbaarheid

  • AS55285 is ons eigen netwerk, verspreid over zeven live locaties: Amsterdam, Frankfurt, Londen, Chicago, Dallas, Los Angeles en New Jersey
  • 100% netwerk-uptime SLA: 5% van de maandelijkse vergoeding gecrediteerd per uur downtime die wij veroorzaakten, tot maximaal de volledige maand
  • DDoS-mitigatie inline op de poort, standaard actief
  • Publieke looking glass om het pad vanaf vijf van onze zeven locaties zelf te testen voordat je bestelt

Privénetwerk tussen je servers

  • Datasets en trainingsverkeer gaan over een layer 2-netwerk tussen je eigen servers, weg van hun publieke interfaces
  • Hetzelfde privénetwerk kan doorlopen naar je servers in onze andere datacenters
  • Kosteloos beschikbaar, beheerd vanuit de cloud console of via de API

Veelgestelde vragen

Wat er vandaag uit de catalogus komt, wat een offerte vraagt, en hoe het netwerk en de SLA gelden voor een AI-workload.

Niet als catalogus-SKU, vandaag niet. Wat je op onze dedicated-servers-pagina vindt, is single-tenant CPU bare metal. Heeft je workload GPU-doorvoer nodig, voor training of inference met hoog volume, neem dan contact op met sales met het model en de schaal die je voor ogen hebt; wij offreren de hardware rechtstreeks.

Vraag sales naar GPU-capaciteit

CPU bare metal in de catalogus, GPU-nodes op offerte
Bestel een CPU-configuratie rechtstreeks uit de catalogus, per uur of per maand. Voor GPU-capaciteit vertel je sales wat je traint of serveert en op welke schaal; die hardware wordt geoffreerd, niet vermeld.