聊天和LLM推理
借助低延迟的 GPU 性能,全天候运行强大的聊天机器人、辅助工具和 API。您可以使用 Ollama 和 Open WebUI,也可以通过 vLLM 或 LangChain 部署自己的模型。
GPU推荐:
L40S
支持参数规模高达 30B 的模型
一键启动 Ollama
简单的按小时计费方式
专用 Blackwell B200,用于训练和运行最大人工智能模型的非共享访问。
192GB VRAM
推荐给:
需要专用资源的工作量
人工智能规模推理
前沿LLM培训
科学模拟和高性能计算
最新的 Blackwell 旗舰,用于训练和运行最大的人工智能模型。
192GB VRAM
推荐给:
大型模型的微调
人工智能规模推理
前沿LLM培训
科学模拟和高性能计算
Proven performance for serious AI training, inference, and research.
80GB VRAM
推荐给:
LLM inference with larger memory needs
Scientific computing and research
Data analytics at scale
AI model training
多功能Ada Lovelace GPU平衡了强大的推理性能与极高的性价比。
48GB VRAM
推荐给:
人工智能推理和生成人工智能
3D渲染和虚拟工作站
中型机型的微调
视频转码和流式传输
Enterprise Blackwell GPU 专为要求苛刻的专业 AI 和可视化工作负载而构建。
96GB VRAM
推荐给:
大模型推理和微调
视频处理和流媒体
工程模拟和科学计算
密集的3D渲染和可视化
高速运行且内存充足,专为大型项目设计——当较小容量的存储卡无法满足需求时,这是更上一层楼的选择。
32GB VRAM
推荐给:
大型模型的训练与运行
高质量的AI图像和视频生成
3D渲染与视觉特效
研究和大规模生产工作负载
无需长期承诺
大约30秒后准备完毕
通过一个仪表盘进行管理