visionenginelisted
Install: claude install-skill vecai-dev/skills
# VisionEngine CLI
一个零依赖的 Python 脚本,覆盖 VisionEngine 平台的全部媒体 AI 能力。
## 何时用 / 何时不用
**用**:图片生成与编辑、图片识别与提示词反推、TTS 配音与音色克隆、字幕生成/打轴、图生视频/文生视频/风格重绘、视频理解、数字人对口型、Remotion 工作区文件读写与远端渲染、用 LLM 生成文案。
**不用**:与 VisionEngine 平台无关的本地视频处理(直接用 ffmpeg)、纯前端代码任务、需要更高权限的管理端点(API Key 无权访问,会 401)。
## 60 秒上手
```bash
python <skill>/scripts/ve.py env # 自检:确认凭据可用
python <skill>/scripts/ve.py image generate --prompt "一只橘猫在窗台晒太阳" --aspect-ratio 9:16
python <skill>/scripts/ve.py audio voices --gender female
python <skill>/scripts/ve.py audio tts --text "你好,欢迎使用视擎" --speaker zh_female_vv_uranus_bigtts
python <skill>/scripts/ve.py files list --path . --max-depth 1
```
所有命令输出统一 JSON(UTF-8、缩进 2);失败时向 stderr 输出 `{"success": false, "error": ..., "http_status": ...}` 并返回退出码 1。
## 命令地图
| 组 | 命令 | 说明 | 参考 |
|---|---|---|---|
| `env` | `env` | 诊断端点/密钥/鉴权 | [troubleshooting](references/troubleshooting.md) |
| `api` | `api <METHOD> <PATH> [--data\|--data-file] [--query K=V]` | 任意已开放接口透传 | troubleshooting |
| `image` | `generate` `edit` `edit-advanced` `generate-from-images` `recognize` `prompt-reverse` | 图片生成/编辑/识别/反推 | [image](references/image.md) |
| `audio` | `tts` `voices` | 语音合成 / 音色目录(本地) | [audio-subtitle](references/audio-subtitle.md) |
| `subtitle` | `generate` `align` | 字幕生成 / 强制对齐(自动落 .srt) | audio-subtitle |
| `video` | `img2video\|text2video\|style-transfer\|recognize` × `submit\|query`(recognize 另有 `result` `cancel`) | 视频生成与理解 | [video](references/video.md) |
| `dh` | `clone