# AHA 命令行使用说明
## 概述
AHA 是一个基于 Candle 框架的高性能模型推理库,支持多种多模态模型,包括视觉、语言和语音模型。
```bash
aha [COMMAND] [OPTIONS]
```
## 全局选项
| 选项 | 说明 | 默认值 |
|------|------|--------|
| `-a, --address
` | 服务监听地址 | 127.0.0.1 |
| `-p, --port ` | 服务监听端口 | 10100 |
| `-m, --model ` | 模型类型(必选) | - |
| `--weight-path ` | 本地模型权重路径 | - |
| `--save-dir ` | 模型下载保存目录 | ~/.aha/ |
| `--download-retries ` | 下载重试次数 | 3 |
| `-h, --help` | 显示帮助信息 | - |
| `-V, --version` | 显示版本号 | - |
## 子命令
### cli - 下载模型并启动服务(默认)
下载指定的模型并启动 HTTP 服务。当不指定子命令时,默认使用此命令。
**语法:**
```bash
aha cli [OPTIONS] --model
```
**选项:**
| 选项 | 说明 | 默认值 |
|------|------|--------|
| `-a, --address ` | 服务监听地址 | 127.0.0.1 |
| `-p, --port ` | 服务监听端口 | 10100 |
| `-m, --model ` | 模型类型(必选) | - |
| `--weight-path ` | 本地模型权重路径(如指定则跳过下载) | - |
| `--save-dir ` | 模型下载保存目录 | ~/.aha/ |
| `--download-retries ` | 下载重试次数 | 3 |
**示例:**
```bash
# 下载模型并启动服务(默认端口 10100)
aha cli -m qwen3vl-2b
# 指定端口和保存目录
aha cli -m qwen3vl-2b -p 8080 --save-dir /data/models
# 使用本地模型(不下载)
aha cli -m qwen3vl-2b --weight-path /path/to/model
# 向后兼容方式(等同于 cli 子命令)
aha -m qwen3vl-2b
```
### run - 直接模型推理
直接运行模型推理,无需启动 HTTP 服务。适用于一次性推理任务或批处理。
**语法:**
```bash
aha run [OPTIONS] --model --input [--input ] --weight-path
```
**选项:**
| 选项 | 说明 | 默认值 |
|------|------|--------|
| `-m, --model ` | 模型类型(必选) | - |
| `-i, --input ` | 输入文本或文件路径(模型特定解释,支持1-2个参数, input1: 提示文本, input2: 文件地址) | - |
| `-o, --output