Chatt och LLM inferens
Använd Ollama och Open WebUI, eller ta med din egen modell med vLLM eller LangChain, så kan du snabbt och enkelt få tillgång till alla funktioner.
Rekommenderad GPU:
L40S
Servera modeller upp till 30B parametrar
Starta Ollama med ett klick
Enkel timprissättning