首页 > 教程攻略 > ai资讯 >音述AI本地素材反推提示词调用操作方法

音述AI本地素材反推提示词调用操作方法

来源:互联网 时间:2026-08-26 08:41:24

要在本地运行音述AI反推工具,需满足Python 3.9+、PyTorch 2.1+(CUDA 12.1)以及≥8GB显存的条件,Mac M系列则必须安装torch-metal。下载解压后,运行setup脚本安装依赖,接着执行python app.py启动服务。之后,上传图片,选择高保真模式与细节强化,即可秒得结构化提示词。

想把手机里存的实拍照片、截图或设计稿直接变成可复用的AI绘画提示词,不用手动描述光影构图和风格细节,本地调用就能秒出结构化关键词。

确认本地环境是否满足运行条件

音述AI反推模块依赖本地Python 3.9+环境与PyTorch 2.1+(CUDA 12.1支持),显存需≥8GB。若你用的是Mac M系列芯片,必须安装arm64版本的torch-metal,否则模型加载会报错RuntimeError: no kernel image is a vailable

打开终端执行:python -c "import torch; print(torch.__version__, torch.cuda.is_a vailable())" → 输出应为类似

【2.1.2 True】

。若显示False,请先运行pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu121重装CUDA版。

下载并解压音述AI反推工具包

访问官方GitHub Release页(https://github.com/yinshu-ai/prompt-reverse/releases),下载最新版yinshu-prompt-reverse-v1.3.0-local.zip

解压后进入目录,双击运行setup.bat(Windows)或setup.sh(macOS/Linux)→ 自动安装依赖并校验模型权重完整性。若终端卡在Downloading clip_vit_l.pth...超2分钟,说明网络中断,需手动将该文件放入models/子目录再重试。

用命令行启动反推服务

在解压根目录下打开终端,输入:python app.py --port 8080 --device cuda → 服务启动后浏览器自动跳转至http://localhost:8080

要是出现OSError: [WinError 10013] 以一种访问权限不允许的方式做了一个访问套接字的尝试的提示,那就表明8080端口被占用了,此时你得改用--port 8081;Mac用户首次运行时可能会弹出一个要求“允许接收网络连接”的弹窗,这个时候必须点击“允许”才能访问Web界面哦。

上传图片并生成提示词

第一步:点击页面中央「选择文件」按钮,仅支持JPG/PNG/WebP,单张≤20MB。

第二步:在「输出精度」下拉菜单中选「高保真(含JSON结构)」→ 此模式会额外输出subjectlightingcomposition等12个字段的键值对,方便你后续接入ComfyUI工作流。

第三步:勾选「启用细节强化」→ 工具会自动放大图像边缘区域二次采样,对首饰反光、织物纹理、毛发走向等微特征识别率提升47%,但耗时增加1.8秒。不勾选则仅做全局语义解析。

第四步:点击「开始反推」→ 等待进度条走满,结果区自动展开两栏标签:「纯文本提示词」可直接复制粘贴到即梦/AI1505等平台;「结构化JSON」点击右上角「复制全部」即可导出为.json文件。