Chat dan inferensi LLM
Kekuatan chatbot, copilot, dan API dengan kinerja GPU latensi rendah, tersedia 24 jam. Gunakan Ollama dan Open WebUI, atau bawa model Anda sendiri dengan vLLM atau LangChain.
GPU yang direkomendasikan:
L40S
Melayani model hingga 30B parameter
Luncurkan Ollama dengan satu klik
harga jam sederhana