Discussion et inférence de LLM
Faites fonctionner vos chatbots, copilotes et API avec des GPU performants à faible latence, disponibles 24 h/24. Utilisez Ollama et Open WebUI, ou votre propre modèle avec vLLM ou LangChain.
GPU recommandé :
L40S
Déployez des modèles comptant jusqu'à 30 milliards de paramètres
Lancez Ollama en un clic
Tarification simple à l'heure