Chat og LLM inferanse
Strøm chatbots, copilots og API-er med lav latency GPU-ytelse, tilgjengelig døgnet rundt. Bruk Ollama og Open WebUI, eller ta med din egen modell med vLLM eller LangChain.
Anbefalt GPU:
L40S
Server modeller opp til 30B parametere
Launch Ollama med ett klikk
Enkel timespriser