For the complete documentation index, see llms.txt. This page is also available as Markdown.

快速上手

步骤 1:创建账户并充值

  1. 前往 clore.ai注册

  2. 验证你的邮箱

  3. 前往 账户充值

  4. 通过以下方式充值 CLORE, BTC, USDT,或 USDC (起步最低约 $5)

步骤 2:选择 GPU

前往 市场 并根据你的任务选择:

我想做什么
最低 GPU
典型每小时价格

与 AI 聊天(7B 模型)

RTX 3060 12GB

$0.03–0.07

与 AI 聊天(27–32B 模型)

RTX 4090 24GB

$0.14–0.42

生成图片(FLUX)

RTX 3090 24GB

$0.07–0.21

生成视频

RTX 4090 24GB

$0.14–0.42

生成音乐

任何 4GB+ GPU

$0.03–0.07

声音克隆 / TTS

RTX 3060 12GB

$0.03–0.07

转录音频

RTX 3060 12GB

$0.03–0.07

微调模型

RTX 4090 24GB

$0.14–0.42

运行 70B+ 模型

2× RTX 5090 或更大的整机

$0.50–1.54

GPU 快速指南

GPU
显存
每张 GPU 每小时价格
最适合

RTX 3060

12GB

$0.03–0.07

TTS、音乐、小型模型

RTX 3090

24GB

$0.07–0.21

图像生成、27B Q4 模型

RTX 4090

24GB

$0.14–0.42

32B 及以下的一切,快速推理

RTX 5080 / 5070 Ti

16GB

$0.10–0.62

SDXL、FLUX、14B 模型

RTX 5090

32GB

$0.25–0.77

27B FP8、70B 量化,速度最快

RTX PRO 6000 Blackwell

96GB

$0.92–1.38

单卡运行大模型

价格按 每张 GPU 每小时 并按 每分钟计费。A100、H200 和 B200 不会在市场中列出——这部分算力作为 裸机出售。实时数据: GPU 价格与可用性.

步骤 3:部署

点击 租用 在你选定的服务器上,然后配置:

  • 订单类型: 按需(固定价格,保证)或现货(基于竞价,可能被更高出价抢走;大约三分之一的服务器定价低于按需)

  • Docker 镜像: 查看下面的方案

  • 端口: 务必包含 22/tcp (SSH)+ 你的应用端口

  • 环境: 添加所需的任何 API 密钥

🚀 一键方案

与 AI 聊天(Ollama + Open WebUI)

运行本地 AI 最简单的方法——任何开源模型都可使用的 ChatGPT 风格界面。

部署完成后,打开 HTTP URL → 创建账户 → 选择一个模型(Llama 4 Scout、Gemma 3、Qwen3.5)→ 开聊!

图像生成(ComfyUI)

面向 FLUX、Stable Diffusion 等的基于节点的工作流。

图像生成(Stable Diffusion WebUI)

适用于 Stable Diffusion、SDXL 和 SD 3.5 的经典界面。

LLM API 服务器(vLLM)

具有 OpenAI 兼容 API 的生产级服务。

音乐生成(ACE-Step)

生成带人声的完整歌曲——可在任何 4GB+ GPU 上运行!

通过 SSH 登录,然后:

步骤 4:连接

在你的订单开始后:

  1. 前往 我的订单 → 找到你当前的订单

  2. 网页界面: 点击 HTTP URL(例如, https://xxx.clorecloud.net)

  3. SSH: ssh -p <port> root@<proxy-address>

部署
典型启动时间

Ollama + Open WebUI

3–5 分钟

ComfyUI

10–15 分钟

vLLM

5–15 分钟(取决于模型大小)

SD WebUI

10–20 分钟

步骤 5:开始创作

服务运行后,查看适合你具体用途的指南:

🤖 语言模型(聊天、编程、推理)

  • Ollama ——最简单的模型管理

  • Llama 4 Scout ——Meta 最新款,1000 万上下文

  • Gemma 3 ——Google 的 27B 模型,性能超越 405B 模型

  • Qwen3.5 ——在数学上击败 Claude 4.5(2026 年 2 月!)

  • DeepSeek-R1 ——思维链推理

  • vLLM ——生产级 API 服务

🎨 图像生成

🎬 视频生成

🔊 音频与语音

  • Qwen3-TTS ——声音克隆,支持 10+ 种语言

  • WhisperX ——转录 + 说话人分离

  • Dia TTS ——多说话人对话

  • Kokoro ——超小型 TTS,只需 2GB 显存

🎵 音乐

  • ACE-Step ——< 4GB 显存即可生成完整歌曲

💻 AI 编程

  • TabbyML ——自托管 Copilot,$4.50/月

  • Aider ——终端 AI 编程助手

🧠 训练

  • Unsloth ——速度快 2 倍,显存占用减少 70%

  • Axolotl ——基于 YAML 的微调

💡 新手提示

  1. 从 Ollama 开始 ——这是在本地尝试 AI 的最简单方式

  2. RTX 4090 是最佳选择 ——以 $0.14–0.42/小时可覆盖 90% 的使用场景

  3. 使用现货订单 用于可中断实验——在约三分之一的服务器上更便宜,中位数约便宜 13%

  4. 使用按需 用于重要工作——有保证,不会中断

  5. 下载你的输出 在订单结束前——之后文件会被删除

  6. 使用 CLORE 代币支付 ——通常比稳定币汇率更好

  7. 检查内存和网络 ——内存不足是失败的首要原因

故障排查

问题
解决方案

HTTP 502 长时间不消失

首次启动请等待 10–20 分钟;检查内存 ≥ 16GB

服务无法启动

内存太低(需要 16GB+)或显存不足以运行该模型

模型下载缓慢

首次运行属正常;建议选择 500Mbps+ 的服务器

CUDA 内存不足

使用更小的模型或更大的 GPU;尝试量化版本

无法 SSH

检查端口是否 22/tcp 已在配置中设置;等待服务器完全启动

🐍 Python SDK 和 CLI(推荐)

更喜欢用代码而不是点点点?安装官方 SDK:

或者直接使用 Python:

完整 Python 快速入门 | SDK 指南 | CLI 自动化

需要帮助?

最后更新于

这有帮助吗?