音述AI新版本反推提示词功能操作教程
音述AI新版本图片反推需更新至v2.3.1+,通过首页AI工具箱或创作→反推入口进入;上传前裁剪主体占60%以上、关闭智能水印增强、勾选结构化JSON;结果含中文完整版与精简关键词版,技术术语不可删改。

想用音述AI新版本把一张氛围感十足的参考图快速转成可复用的提示词,却卡在上传后没反应、反推结果空泛或根本找不到入口——这不是你不会用,是没踩对新版界面逻辑和关键触发点。
确认是否已进入「音述AI」最新正式版
打开App后,首页左上角显示「v2.3.1」或更高版本号;若为v2.2.x及以下,需前往应用商店更新。旧版不支持视频反推与多版本提示词并行输出,强行操作会导致解析中断或返回默认模板词。
点击右下角「我的」→「检查更新」,弹出「已是最新版」提示后再进行后续步骤。未更新直接跳入功能页,
【所有反推操作将静默失败且不报错】
图片反推提示词:三步定位+一键启动
方法一:首页快捷入口(推荐新手)
首页中部「AI工具箱」卡片→向左滑动至第三页→找到图标为「放大镜+画框」的模块→点击进入。
方法二:路径直达(适合批量操作)
首页→底部导航「创作」→顶部标签切换至「反推」→选择「图片反推」。
⚠️注意:不要点进「语音转文字」或「音频分析」同类图标,二者UI高度相似但底层模型完全不同,误入后上传图片会提示「不支持该文件类型」。
上传图片后的关键设置项
第一步:上传前裁剪画面主体
点击「上传图片」后,系统自动唤起本地相册;选中目标图→进入预览页→双指缩放并拖动,确保主体人物/核心物体居中且占画面60%以上面积。背景杂乱、主体过小会导致光影与构图参数识别失准。
第二步:关闭「智能水印增强」开关
该功能默认开启,会强行强化图中文字/Logo边缘,干扰AI对原始视觉权重的判断。必须手动关闭,否则反推词中会高频出现“bold text”“sharp logo”等无关描述。
第三步:勾选「输出结构化JSON」
这个选项在上传按钮下方的灰色小字区域,默认是未勾选状态。勾选之后,结果页会同时生成带有字段标签的JSON数据,其中包含"subject_position":"center"、"lighting_angle":"45-degree-left"等可用于编程的字段,非常便于接入自动化流程。
解析完成后的结果使用策略
结果页默认展示「中文完整版提示词」,含主谓宾完整句式,可直接复制粘贴至即梦、通义万相等平台;点击右上角「切换」按钮,可调出「精简关键词版」,用英文逗号分隔,适配Stable Diffusion WebUI。
若首句出现“a photorealistic image of...”,说明模型判定该图为实拍照片;若为“an anime-style illustration of...”,则归类为二次元图像——该前缀不可删除,否则生图时风格崩解概率提升73%。
点击「编辑提示词」可手动删减冗余描述,但
【禁止修改“medium shot”“soft backlighting”“cinematic color grading”等带技术术语的短语】
视频反推:仅限MP4格式且单段≤12秒
进入「反推」页→切换顶部标签为「视频反推」→点击「上传视频」→从相册选取符合要求的片段。不支持MOV、A VI、带B帧压缩的HEVC编码,上传后若进度条卡在99%,大概率是格式不符。
上传成功后,页面自动截取第3秒、第6秒、第9秒三帧作为关键帧采样点,分别生成对应提示词。你只需在结果页横向滑动查看三组输出,无需手动截图再上传。
每组提示词末尾均带时间戳标注,如“[t=6.2s] subject raises right hand slowly”,复制时务必保留方括号内容,MiniMax H3、Seedance2等模型依赖该标记实现动作锚定。
-
下载
-
- 关于柯南的沙雕网名有哪些
- 角色扮演 | 1
- 网名
-
- 最新中性名字男女通用网名有哪些
- 角色扮演 | 1
- 网名
-
- 关于蓝色说唱的网名有哪些
- 角色扮演 | 1
- 网名
-
- 我好喜欢你是什么梗?
- 角色扮演 |