预置权重与推理服务,选好 GPU 一键部署,开机即用 HTTP 调用。
671B MoE · 最低 141GB
顶尖开源 MoE 大语言模型,推理成本极低。
35B A3B · 最低 48GB
中英双语强、工具调用能力出色的通用模型。
12B · 最低 24GB
高保真文生图,细节与排版表现领先。
31B · 最低 40GB
Google 开源系列,指令跟随稳定。
14B · 最低 48GB
文本到视频生成,运动连贯、时长可控。
1.5B · 最低 10GB
多语种语音转写,长音频稳定。
109B MoE · 最低 80GB
超长上下文,检索增强场景友好。
8B · 最低 16GB
经典开源文生图,生态与 LoRA 丰富。