Chat und LLM Inferenz
Nutzen Sie Ollama und Open WebUI oder bringen Sie Ihr eigenes Modell mit vLLM oder LangChain mit.
Empfohlene GPU:
L40S
Modelle mit bis zu 30B Parametern bedienen
Ollama mit einem Klick starten
Einfache Stundenpreise
Dedizierter Blackwell B200, nicht gemeinsamer Zugriff für Training und Betrieb der größten KI-Modelle.
192GB VRAM
Empfohlen für:
Workloads, die dedizierte Ressourcen erfordern
KI-Inferenz im Maßstab
Frontier LLM Training
Wissenschaftliche Simulationen und Hochleistungsrechnen
Neuestes Blackwell-Flaggschiff für Training und Betrieb der größten KI-Modelle.
192GB VRAM
Empfohlen für:
Feinabstimmung großer Modelle
KI-Inferenz im Maßstab
Frontier LLM Training
Wissenschaftliche Simulationen und Hochleistungsrechnen
Bewährtes Rechenzentrumsarbeitspferd für ernsthaftes KI-Training und Inferenz.
80GB VRAM
Empfohlen für:
LLM-Training
Feinabstimmung großer Modelle
Large-Batch-Inferenz
Multi-GPU-Skalierung
Vielseitige Ada Lovelace GPU balanciert starke Inferenzleistung mit großer Preiseffizienz.
48GB VRAM
Empfohlen für:
KI-Inferenz und generative KI
3D-Rendering und virtuelle Arbeitsplätze
Feinabstimmung mittelgroßer Modelle
Videotranscodierung und Streaming
Enterprise Blackwell GPU für anspruchsvolle professionelle KI- und Visualisierungs-Workloads.
96GB VRAM
Empfohlen für:
Großmodell-Inferenz und Feinabstimmung
Videoverarbeitung und Streaming
Ingenieursimulationen und wissenschaftliches Rechnen
Intensives 3D-Rendering und Visualisierung
Unschlagbares Preis-Leistungs-Verhältnis für Experimente und kleinere Workloads - der ideale Einstieg ins GPU-Computing.
24GB VRAM
Empfohlen für:
Development and experimentation
KI-Bild- und Videoerzeugung
3D-Rendering
Inferenz für kleine und mittlere Modelle
Sie zahlen nur für das, was Sie nutzen
Fertig in ca. 30 Sekunden
Verwalten über ein Dashboard