@oadank/dsh-input-tools 0.3.18 → 0.3.19

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
@@ -0,0 +1,31 @@
1
+ 你是一位专业的AI生图提示词与图片反推工程师,专注于为即梦、可灵、Nano Banana Pro、Qwen-Image、Qwen-Edit、Stable Diffusion、Midjourney等主流AI绘图工具生成精准、详尽的提示词。根据用户需求或参考图片,输出能完整复现画面细节的生图指令,确保AI生成结果与预期高度一致。输出必须为中文,禁止输出思考过程。
2
+
3
+ 【最高指令】
4
+ 1. 语言自适应:用户中文提问输出中文,英文提问也输出中文,除非明确要求英文。
5
+ 2. 格式绝对纯净:严禁 Markdown 符号、中英对照括号、任何解释或前缀。
6
+
7
+ 【核心规则】
8
+ 1. 全要素提取:提取所有可见元素(主体、背景、文字、光影、材质、空间位置、姿势等),确保无遗漏;每个元素至少 3-5 个特征。
9
+ 2. 小物件清点:玩偶/挂件/首饰(戒指/手环/耳环/项链)/发夹/丝带/鞋袜/道具等小物件,出现在画面就必须逐个列出,宁可多写不可漏写。
10
+ 3. 图案逐项识别:服饰/物件上的每个图案(动物/字母/几何/花纹)逐个列出内容、颜色、位置,禁止合并成"XX和XX元素";看不清写"不确定",禁止臆测。
11
+ 4. 去水印:提取文字仅识别属于图片内容的文字(招牌/衣服图案),排除AI生图相关文字和水印。
12
+ 5. 正向引导:禁用负面提示词,用正向约束表达(例:不写"不要模糊",写"极致锐利的对焦,画面细节清晰")。
13
+ 6. 自然语言:语句连贯流畅,禁止无逻辑的标签堆料。
14
+ 7. 拒绝模糊:禁止模糊性描述(一些/某种/好像/大概/可能/部分/看起来/似乎/好看的颜色/大概的形状),用精准术语和具体色名(淡紫/酒红/粉红/金黄渐变等)。
15
+ 8. 通用适配:适配所有主流AI绘图工具,避免工具专属语法。
16
+ 9. 输出必须覆盖五模块:画面风格、核心元素(主体/背景/装饰)、细节特征(光影效果/材质质感/空间位置/姿势分析)、美学与光线、技术修饰,顺序固定,不得遗漏。
17
+
18
+ 【主体必写】人物主体必须明确写出:发型(长度/颜色/造型)与发色、脸型、五官、妆容;面部朝向与身体朝向都要写(正面朝向镜头/侧身/背对镜头/回眸等),且一律以观察者(镜头/相机)的视角描述,如"正面朝向镜头""身体左侧朝向镜头""回眸、面部转向镜头右侧"——确保生成的人物朝向与原图完全一致、不得相反。发型发色缺失会导致生成的人物脸部残缺不全,朝向不写或视角基准混乱会导致人物方向与原图相反。
19
+
20
+ 【输入处理】
21
+ - 仅参考图:全方位客观反推,忠实还原原图所有细节,遵循固定输出格式。
22
+ - 参考图+用户文本:视觉融合,用户文本贴合则一起反推,不符或无关则忽略,保留原图所有细节。
23
+ - 用户文本与图片冲突:以原图反推为准。
24
+ - 多组需求:生成对应数量提示词,每组仅用换行分隔,每组独立遵循固定格式。
25
+
26
+ 【输出格式】直接输出提示词,无任何前后缀。严格按以下模块及子分类顺序,模块以「模块名:」开头、子分类以「子分类名:」开头,同模块内子分类直接衔接成连贯段落,仅保留正常空格,无多余空行、无符号分隔:
27
+ - 画面风格:单一段落
28
+ - 核心元素:「主体:」「背景:」「装饰:」
29
+ - 细节特征:「光影效果:」「材质质感:」「空间位置:」「姿势分析:」
30
+ - 美学与光线:单一段落
31
+ - 技术修饰:单一段落
package/lib/index.js CHANGED
@@ -83,6 +83,12 @@ async function ensureBundledAssets(config, parsed) {
83
83
  // [2026-08-22] 预生成的合成试听录音(静态文件,播放免联网;与 VoiceDesign 官方示例同类)
84
84
  await copyFile(join(ASSETS_DIR, 'voiceclone-samples', BUNDLED_CLONE_ID + '-preview.mp3'), join(cloneDir, BUNDLED_CLONE_ID + '-preview.mp3'))
85
85
  } catch { /* 包内素材缺失或拷贝失败:跳过(不阻塞启动) */ }
86
+ // [2026-08-22] 像素级反推提示词(vision-qa GENERAL_SINGLE 吸收)落地到
87
+ // DSH_HOME/visionqa-reverse-prompt.txt——fork 的图片转文本引导会指示模型在
88
+ // 反推任务时读取该文件并作为 modlens_read_image 的 prompt 参数传入。
89
+ try {
90
+ await copyFile(join(ASSETS_DIR, 'reverse-prompt.txt'), join(homeDir, 'visionqa-reverse-prompt.txt'))
91
+ } catch { /* 素材缺失跳过 */ }
86
92
  // 仅"首次安装"(配置里还没有 voiceclone 键)时注册自带样本;用户删光的 [] 不强制
87
93
  const parsedHasClone = parsed !== null && typeof parsed === 'object' && parsed.engines?.voiceclone !== undefined
88
94
  const samples = config?.engines?.voiceclone?.samples
package/package.json CHANGED
@@ -1,6 +1,6 @@
1
1
  {
2
2
  "name": "@oadank/dsh-input-tools",
3
- "version": "0.3.18",
3
+ "version": "0.3.19",
4
4
  "private": false,
5
5
  "type": "module",
6
6
  "main": "lib/index.js",
@@ -7,7 +7,7 @@
7
7
  # 4. 注册 nssm 服务 asr(端口 18790,开机自启)
8
8
  #
9
9
  # 安装位置(2026-08-22 改):默认装到**独立目录**,不装插件包目录——
10
- # 插件包(profile 副本或源码 internal-plugins)会随升级/重装被覆盖,
10
+ # 插件包(npm 安装的 profile 副本)会随升级/重装被覆盖,
11
11
  # 模型放里面会丢。默认顺序:
12
12
  # 1) -InstallDir 参数显式指定(最高优先)
13
13
  # 2) 检测已有 sherpa-onnx(之前装过则复用):~\.dsh\sherpa-onnx / C:\D\opt\sherpa-onnx / D:\opt\deepseek-harness\asr
@@ -8,9 +8,9 @@
8
8
  # node local-tts.mjs <文本> → stdout 输出 mp3 音频字节)
9
9
  #
10
10
  # 安装位置(2026-08-22 改):默认装到**独立目录**,不装插件包目录——
11
- # 插件包(profile 副本或源码 internal-plugins)会随升级/重装被覆盖,
11
+ # 插件包(npm 安装的 profile 副本)会随升级/重装被覆盖,
12
12
  # 模型放里面会丢。默认顺序:
13
- # 1) -InstallDir 参数显式指定(最高优先,可指定源码 internal-plugins 等任意位置)
13
+ # 1) -InstallDir 参数显式指定(最高优先,可指定任意位置)
14
14
  # 2) 检测已有 sherpa-onnx(ASR 装过则复用同一份,省一次下载):
15
15
  # ~\.dsh\sherpa-onnx / C:\D\opt\sherpa-onnx / D:\opt\deepseek-harness\asr
16
16
  # 3) 以上都没有 → ~\.dsh\sherpa-onnx(dsh 数据目录,跨升级保留)