Skip to main content
aria-engine 在本地运行 Aria 模型包(weight.bin + config.json),用于语言、视觉与 VLA/策略推理。它既可作为独立二进制分发,也可将 FFI 共享库嵌入你的应用。

安装

下载页获取你的平台最新发布,或以编程方式获取:
在中国站,同一接口从 Gitee 镜像。请使用 https://ariacompute.cn/api/download/engine-latest

获取模型包

用你的 API 密钥下载模型包,然后解包:
模型包包含 weight.binconfig.json 以及可选的 tokenizer 附属文件。完整的布局与量化矩阵参见模型

通过 CLI 运行推理

该服务在配置端口上暴露与 OpenAI 兼容的 /v1/chat/completions 接口。将任意 OpenAI 兼容客户端指向 http://127.0.0.1:8080/v1 即可。

通过 libaria-engine_ffi 嵌入

每个发布版都会在 CLI 旁附带一个共享库:libaria-engine_ffi-linux-x86_64.solibaria_engine_ffi.dylibaria_engine_ffi.dll。可从 C、Rust、Python(通过 ctypes/cffi)、Swift 或任何具备 C ABI 的语言链接它。
app.c
打包的 C 头文件随发布归档一同提供,位于 include/ 下。查阅它们可了解完整的 FFI 面:流式回调、KV 缓存管理、分词器辅助函数与清理函数。

引擎内部的模型拉取

aria-engine CLI 也可以直接从 Hugging Face(国际站)或 ModelScope(中国站)拉取模型。这与控制台的模型库相互独立,不消耗你的咏唱引擎钱包: