使用指南
快速了解与使用
安装前先阅读能力边界、适用场景与配置要求。
能力说明
使用通义千问视觉模型理解图像和视频,支持分析、描述或提取信息,包括OCR文字识别。当用户需要处理图像或视频内容时触发。
适合场景
适合需要“通义视觉理解”能力的 Agent 工作流。原始 Skill 名称为 qwencloud-vision,发布者为 qwencloud/qwencloud-ai。
安装与使用
在项目根目录执行:npx skills add https://github.com/qwencloud/qwencloud-ai --skill qwencloud-vision。安装后请先阅读仓库内的完整 Skill 指令,再根据当前任务、权限范围和项目规范使用。
使用提醒
执行前检查命令、脚本、外部连接与凭据权限;生成或修改代码后,仍需运行项目自己的测试、类型检查和人工复核。
