百炼 CLI 调用文本对话、图像、视频、语音、视觉理解等全模态模型的命令速查。
一条命令即可在终端调用百炼全模态模型:文本对话与 Omni 全模态、图像生成编辑、视频生成编辑、语音合成识别、视觉理解。
对话与全模态
| 能力 | 命令 | 典型模型 | 说明 | 常用参数 |
|---|---|---|---|---|
| 文本生成 | bl text chat | qwen3.8-max(默认) | 面向智能体时代的旗舰模型,擅长编程、办公与长周期自主执行 | --model 指定模型、--system 系统提示词、--temperature 温度、--max-tokens 最大输出长度、--stream 流式输出、--output json 格式化输出 |
| 全模态 | bl omni | qwen3.5-omni-plus | 文本 / 图像 / 音频 / 音视频理解与交互 | --image / --audio 输入、--voice 指定输出声音、--audio-format 音频格式、--audio-out 保存音频、--text-only 仅文本输出、--list-voices 查看声音列表 |
图像生成与编辑
| 能力 | 命令 | 典型模型 | 说明 | 常用参数 |
|---|---|---|---|---|
| 图像生成 | bl image generate | qwen-image-2.0 | 专业文字渲染、真实质感、强语义遵循 | --prompt 提示词、--model 指定模型、--size 尺寸、--async 异步任务 |
| 图像编辑 | bl image edit | qwen-image-2.0 | 支持多图合成 | --image 多次传入实现多图合并、--prompt 编辑指令 |
视频生成与编辑
| 能力 | 命令 | 典型模型 | 说明 | 常用参数 |
|---|---|---|---|---|
| 视频生成 | bl video generate | wan3.0-video(默认) | 文生视频/图生视频,高度还原动态画面 | --prompt 提示词、--image 首帧图片(图生视频)、--download 下载产物到指定路径、--async 异步任务 |
| 参考生视频 | bl video ref | wan3.0-video(默认) | 最多 9 张图片参考,稳定主体与场景 | --image 参考图(可多次)、--image-voice 主体配音、--prompt 提示词 |
| 视频编辑 | bl video edit | happyhorse-1.0-video-edit(默认) | 自然语言视频编辑 | --video 输入视频、--prompt 编辑指令、--download 下载产物到指定路径 |
| 视频下载 | bl video download | — | 下载已完成的视频任务 | --task-id 任务 ID(必填)、--out 输出路径(必填) |
| 视频任务查询 | bl video task get | — | 查询异步视频任务状态 | --task-id 任务 ID |
语音合成与识别
| 能力 | 命令 | 典型模型 | 说明 | 常用参数 |
|---|---|---|---|---|
| 语音合成 | bl speech synthesize | cosyvoice-v3-flash | 多音色流式 TTS,5–20s 样本即可克隆 | --list-voices 查看内置声音、--voice 指定声音、--instruction 自然语言控制风格、--enable-ssml 支持 SSML、--stream 流式输出、--concurrent 并发合成、--seed 可复现合成 |
| 语音识别 | bl speech recognize | fun-asr | 覆盖 30 种语言,含中文方言与口音 | --diarization 说话人分离、--speaker-count 指定人数、--vocabulary-id 热词词汇表、--language 语言、--async 异步模式、--out 保存结果、批量识别最多 100 个文件 |
视觉理解
| 能力 | 命令 | 典型模型 | 说明 | 常用参数 |
|---|---|---|---|---|
| 视觉理解 | bl vision describe | qwen3-vl-plus(默认) | 长视频分析、图表 / 文档解析、多语言 OCR | --image / --video 输入(支持本地路径与 URL)、多图输入、--prompt 指令、--output json 格式化输出 |