A12
首页 / 开发者文档

开发者文档 Docs

像使用任何现代云 API 一样使用全域算力。本站为公测前版本,正式开发者文档随全球公测发布并持续更新。

01快速开始

三步跑通第一个任务

  1. 注册开通:邮箱注册公测账户;KYC 后解锁完整功能与公测激励资格。无需预付费,按量结算。
  2. 选择接入方式:控制台选卡 / API 自动路由 / CLI 批量提交,三种方式任选其一。
  3. 部署并监控:实时查看算力层级、费用明细与验收报告;训练任务支持 checkpoint 容错。
# 提交一个 LoRA 微调任务(接口形态示意,以正式文档为准)
curl https://api.a12.network/v1/jobs -H "Authorization: Bearer $A12_API_KEY" -d '{
  "type": "lora-finetune",
  "base_model": "llama-3.1-8b",
  "dataset": "s3://my-bucket/finetune.jsonl",
  "auto_tier": true          # 调度引擎自动选择成本最优层级
}'
OpenAI 兼容网关:存量代码把 base_url 改为 A12 端点即可迁移,SDK 兼容。

02实例类型

A12 提供三种实例类型,价差幅度参照主流 GPU 云市场的通行标准:

类型价格优先级适用
按需 On-Demand标准价(见 GPU 目录最高生产负载、在线服务、任何不能中断的任务
可抢占 Interruptible≈ 标准价 × 50%批处理、渲染、参数扫搜等可中断负载;可能被高优任务暂停
预留 Reserved最高 −50%有稳定月度用量的团队;承诺使用期换折扣,无 1–3 年长约要求
负载越灵活,省得越多。可抢占任务失败自动重试不另计费(重试占用的算力按可抢占价计)。

03计费细则

全部规则前置公开,无隐藏成本:

  • 按秒计费:任务从开始到结束按实际秒数结算,用多少算多少。
  • GPU 计算:按卡·时计价,价格随层级(Tier-S/A/B)与实例类型浮动;闲时折扣更深。
  • 存储:$0.10/GB/月,实例删除即停止计费。停机不删除实例则继续计费存储。
  • 带宽:按节点费率公示、双向计费,选卡前可见;数据密集负载请先估算带宽总成本。
  • 余额规则:余额归零时实例先停机,数据保留 72 小时,期间补足余额即可恢复;超时后才进入删除流程。
  • CPU-only 负载:$0.005/vCPU·时 + $0.001/GB,适合转码、批处理、爬虫等无 GPU 负载。
  • 结算币种:法币 / USDT(稳定币)计价结算,租户不被迫持有平台 Token。
诚实提示:数据密集型任务(大模型微调、海量数据搬运)的带宽成本可能接近甚至超过 GPU 成本,请用任务估算器先行测算总成本。

04存储与带宽

项目费率说明
实例存储(Container Disk)$0.10 / GB / 月实例运行与停止期间持续计费,删除实例即停
对象存储(数据集/模型)$0.10 / GB / 月公测期目标价,随公测公告
出口带宽按节点费率公示不同节点差异大,选卡前在控制台可见
入口带宽按节点费率公示双向计费

最佳实践:把数据集与模型放在对象存储,多任务共享读取,避免每个实例重复存储付费。

05API 入门

API 与 OpenAI SDK 形态完全兼容,三个入口:

# 1) 查询可用算力与实时价
curl https://api.a12.network/v1/offers -H "Authorization: Bearer $A12_API_KEY"

# 2) 提交任务(自动路由最优层级)
curl https://api.a12.network/v1/jobs -H "Authorization: Bearer $A12_API_KEY" -d '{...}'

# 3) OpenAI 兼容推理端点
client = OpenAI(base_url="https://api.a12.network/v1", api_key=os.environ["A12_API_KEY"])

任务状态机

QUEUED → SCHEDULED → RUNNING → [CHECKPOINT…] → DONE / FAILED / INTERRUPTED
                ↑__________________ 自动重试(可抢占任务) ______________|

想直接动手试?打开 API 交互中心 →——在浏览器里构造请求、查看模拟响应、复制 curl / Python / Node 示例。

06故障排查

症状可能原因处理
任务一直 QUEUED所选层级供给紧张 / 价格上限过低开启 auto_tier 或提高价格上限
可抢占任务被中断高优先级任务占用节点正常机制;自动重试不产生额外费用
冷启动慢容器镜像过大使用预置模板或精简镜像
实例突然停止余额归零(数据保留 72h)补足余额即恢复
带宽费异常数据集重复拉取改用对象存储共享读取

未解决?提交工单,公测期核心工程师驻 Discord 答疑。

07Worker 硬件清单

接入 A12 网络的硬件按能力分四级。以下为各 Tier 的准入门槛与收益特征:

层级典型设备最低要求收益特征
Tier-S 集中式数据中心 GPU 服务器(H100 / A100 集群)机构级机房 / 稳定公网 / 99.9% 在线承诺单价最高;高敏负载专属供给
Tier-A 专业专业工作站(L40S / A6000 / 5090)独显 ≥24GB / 4 核 CPU / 16GB RAM / 稳定宽带推理与微调主力供给
Tier-B 消费级游戏 / 设计 PC(RTX 4090 等)独显 ≥8GB / 4 核 CPU / 12GB RAM走量任务;LoRA / 批处理
Tier-C 边缘游戏本 / 轻量设备任意现代独显 / 核显(CPU 任务)轻量批处理 + CPU-only 负载

所有层级共同要求

  • 在线时长与任务占用率影响调度优先级(L5 历史声誉)
  • 通过五层核验(声明核验 → 能力实测 → 运行时遥测 → 任务验证 → 历史声誉)后才接单
  • 支持 Windows / Linux;容器化执行,宿主文件系统不可见
电费提示:电价较高地区的低端 GPU(Tier-C 及旧款卡)请先测算电费盈亏平衡点——收益以实收周报公示口径为准,不承诺保底在线率收益。

08Worker 长期收益保障

供给侧经济学全公开——你赚多少、平台分多少、规则怎么变,全部写明:

分成结构

  • 公测期:Worker 分成 80%——全网主要平台中最慷慨档(对比:主流消费级平台隐含抽成约 50%)。
  • 阶梯化路线(提前 30 天公告):网络稳定供给后调整为 75%,规模化成熟期 70%——同时上线存储 / 带宽收益分成与 CPU-only 负载补位,Worker 总收益不因阶梯调整而下降是设计目标。

收益透明承诺(参照行业透明度最高标准)

  • 公测后 30 天起发布「Worker 实收周报」:按 GPU 型号公示实收均值、多数机器区间、Top 分位与任务占用率,附统计口径说明。
  • 结算走 Earned → Pending(1–72h 观察)→ Released 三态托管,违约方罚没并赔付受损租户。
  • 系数调整受三重约束:±20% 上限 / 90 天间隔 / 提前 30 天公告
  • CPU-only 与带宽负载在 GPU 任务低谷期补位,提高节点利用率。
为什么敢公开 take rate:双边市场的信任 = 供给侧透明 × 需求侧低价。隐藏抽成的平台,价格战中先失去的是供给方。