Chat és LLM következtetés
Erősítse a chatbotokat, a kopilotokat és az API-kat alacsony késleltetésű GPU-tel, amelyek 24 órán át elérhetők. Használja az Ollamát és az Open WebUI-t, vagy hozzon létre saját modellt a vLLM vagy a LangChain segítségével.
Ajánlott GPU:
L40S
Modellek kiszolgálása legfeljebb 30B paraméterekkel
Elindítása Ollama egy kattintással
Egyszerű óránkénti árak