Skip to main content
使用此接口将训练好的模型转换为可部署的格式。支持的格式包括 GGUF(量化)、MLX(Apple Silicon)、MNN(阿里巴巴移动端)与 QNN(高通)。导出异步运行;轮询 GET /v1/exports/:id 以跟踪完成状态。

方法与路径

认证

Authorization 头中以 Bearer 令牌的形式携带你的 PIN API 令牌或 JWT。

路径参数

string
required
模型标识符(例如 md_abc123def456)。

请求体

string
required
目标导出格式。必须为以下之一:ggufmlxmnnqnn

请求体示例

请求示例

响应

返回标准的 PIN 成功信封,包含导出任务。
integer
required
成功为 0,出错为非零值。
object
required
string
可读消息(成功时为空)。

响应示例

导出流程

  1. 若模型没有合并后的产物,系统会先将 LoRA 适配器自动合并进基座权重。
  2. 转换工具在后台 goroutine 中运行:
    • GGUF:先转换为 FP16,再使用 llama.cpp 量化为 Q4_K_M
    • MLX:运行 mlx_lm.convert 或由 ARIAPIN_CONVERT_MLX 配置的工具。
    • MNN:运行 mnnconvert 或由 ARIAPIN_CONVERT_MNN 配置的工具。
    • QNN:运行 qairt-converter 或由 ARIAPIN_CONVERT_QNN 配置的工具。
  3. 成功后,产物路径被登记,模型状态恢复为 ready

错误