Chat og LLM inference
Strøm chatbots, copilots og API'er med lav latency GPU ydeevne, der er tilgængelig døgnet rundt. Brug Ollama og Open WebUI, eller bringe din egen model med vLLM eller LangChain.
Anbefalet GPU:
L40S
Server modeller op til 30B parametre
Start Ollama med ét klik
Enkel prissætning