Chat a odvozování LLM
Posilujte chatboty, kopiloty a rozhraní API s nízkým výkonem GPU, které jsou k dispozici nepřetržitě. Použijte Ollama a Open WebUI, nebo si přineste vlastní model s vLLM nebo LangChain.
Doporučený GPU:
L40S .
Obsluhujte modely do 30B parametrů
Spustit Ollama na jedno kliknutí
Jednoduchá hodinová cena