英语词汇 AI 素材 Skill 项目集成使用指南 一、Skill 整体概述整套体系包含三套独立 AI Skill分层生成词汇配套素材完全依据单词难度自动匹配生成规则例句生成 SKILLSKILL_EXAMPLE区分 primary /junior/senior /cet4 四套生成标准根据单词 category 生成对应难度英文例句小学词汇强制校园场景、短句四级偏向学术长句。文生图提示词 SKILLSKILL_IMAGE接收上一步例句提取画面元素生成绘图提示词适配 z-image-turbo 绘图模型。视频提示词 SKILLSKILL_VIDEO结合例句 图片提示词生成 LTX2.3 动态视频生成指令。配套流水线读取数据库单词 → 调用例句 Skill → 调用图片 Skill → 调用视频 Skill → 全部素材写入 PostgreSQL 词汇表。二、前置准备1. 环境依赖bash运行pip install requests psycopg2-binary2. 统一配置文件 config.py所有 Skill 文本、大模型地址、数据库信息统一存放核心配置项LLM 接口地址、模型名称、最大 token、温度等推理参数数据库连接信息vocabulary 词汇表库批量单次处理数量、接口休眠间隔三段 Skill 完整系统提示文本SKILL_EXAMPLE / SKILL_IMAGE / SKILL_VIDEO3. 数据库表基础要求数据表vocabulary必备字段用于读取单词、存储 Skill 产出内容表格字段用途id单词唯一主键word英文单词chinese_definition单词中文释义category难度标识 PRIMARY/JUNIOR/SENIOR/CET4example例句 Skill 输出结果qwen_image_prompt绘图 Skill 输出结果ltx23_prompt视频 Skill 输出结果status素材生成完成标记三、Skill 标准使用完整流程流程总链路读取指定难度单词 → Step1 执行例句 SKILL → Step2 执行图片 SKILL → Step3 执行视频 SKILL → 合并所有 Skill 输出入库步骤 1读取待处理单词从 PostgreSQL 词汇表批量筛选指定难度词汇获取字段单词、中文释义、难度分类 category。 自动兼容数据库大写难度标识PRIMARY 会统一转为 primary 匹配 Skill 规则。步骤 2调用例句生成 SKILL核心 SKILL入参单词、中文释义、标准化小写难度标识组装对话系统提示 SKILL_EXAMPLE用户输入 单词 释义 难度向 LLM 接口发起请求内置 2 次自动重试网络超时、JSON 错误、token 截断自动重试清洗模型返回内容剔除 json 等 markdown 代码标记解析 JSON提取当前难度专属例句输出结果仅携带 word、chinese_meaning、example 三个字段无其他难度冗余数据约束规则由 SKILL_EXAMPLE 文本控制primary4-10 词短句、小学课堂场景、仅简单时态junior8-15 词基础复合句senior长复合句、从句、非谓语cet425-45 词学术复杂句式步骤 3调用文生图 SKILL触发前置校验如果 Step1 例句为空直接跳过节省模型调用资源。入参Step1 完整返回数据、单词难度组装对话系统提示 SKILL_IMAGE用户输入 当前生成的英文例句发起 LLM 请求内置重试逻辑清洗返回 JSON提取绘图提示词 qwen_image_prompt步骤 4调用视频生成 SKILL触发前置校验无例句直接跳过。入参Step1 例句数据、Step2 图片提示词、单词难度组装对话系统提示 SKILL_VIDEO用户输入 例句 图片提示词请求大模型解析得到 LTX2.3 视频提示词 ltx23_prompt步骤 5合并三套 Skill 产出数据统一整合所有输出字段组装入库结构基础单词信息example例句 SKILL 结果qwen_image_prompt绘图 SKILL 结果ltx23_prompt视频 SKILL 结果skill原始数据库难度标识大写 PRIMARY/JUNIOR 等步骤 6数据库更新入库将合并后的完整素材更新至对应单词行填充 example、两类提示词修改 status 为完成标识。四、两种业务调用模式模式 1离线批量生成脚本模式适用场景后台批量补全词汇库素材定义目标难度PRIMARY / JUNIOR / SENIOR / CET4循环读取批次单词逐条执行完整 Skill 流水线单条单词生成失败自动回滚数据库不影响其他单词全部单词处理完毕自动退出模式 2Web 接口按需生成API 模式适用场景前端动态新增单词实时生成配套素材提供 HTTP 接口入参word、中文释义、难度 category内部串行执行三段 Skill直接返回整合后的全套素材 JSON可按需扩展自动写入数据库逻辑五、Skill 自定义修改方法修改例句难度规则 直接编辑 config 中SKILL_EXAMPLE文本调整各难度句子长度、句式、场景、词汇约束。修改图片 / 视频提示词风格 编辑SKILL_IMAGE、SKILL_VIDEO系统提示调整画风、镜头、时长、渲染风格。新增难度档位如 CET6配置文件难度列表新增标识在 SKILL_EXAMPLE 补充对应难度生成规则段落数据库 category 字段存入新标识即可自动适配 Skill六、使用注意事项 排错难度大小写不匹配 流程内置自动转小写逻辑数据库存 PRIMARY 也能匹配 primary 规则无需手动转换。图片提示词为空 检查图片 SKILL 函数返回逻辑确保解析到的 prompt 正常返回不要硬编码空字符串。模型返回带 markdown 代码块 流水线内置文本清洗逻辑自动去除json、标记无需额外处理。token 截断无有效例句 调高 config 中 LLAMA_STEP1_MAX_TOKENS 数值重试机制会自动重新生成。无例句仍调用图文模型 流程自带前置判断example 为空直接跳过图片、视频 SKILL减少无效请求。