ChatGPT-Web-MidJourney-Proxy 项目中的提示词组合优化实践
背景介绍
在AI绘画领域,MidJourney作为一款强大的图像生成工具,其提示词(prompt)的构造方式直接影响着生成图像的质量和准确性。ChatGPT-Web-MidJourney-Proxy项目作为一个中间件,负责将用户输入转换为MidJourney能够理解的完整提示词。
问题发现
在项目使用过程中,开发者发现原有的提示词组合逻辑存在一个关键问题:当用户输入包含MidJourney参数(如--seed)时,这些参数会被错误地放置在描述词中间,导致MidJourney无法正确解析整个提示词。
例如,当用户输入"一个女孩 --seed 312341243"时,系统会生成: "一个女孩 --seed 312341243 ,描述词1,描述词2,描述词3 --q 0.2 --ar 3:4"
这种组合方式会导致MidJourney无法正确识别--seed参数,因为它被错误地放置在了描述词中间。
解决方案
项目团队对提示词生成逻辑进行了重构,将提示词分为三个清晰的部分:
- 描述词选项组合:由系统预设的描述词组成,如"描述词1,描述词2,描述词3"
- 用户输入:用户直接输入的内容,可能包含描述词和参数
- 参数选项组合:由系统根据用户选择的选项生成的参数,如"--q 0.2 --ar 3:4"
新的组合逻辑确保这三部分按照正确的顺序拼接: 描述词选项组合 + 用户输入 + 参数选项组合
这样处理后,上面的例子将变为: "描述词1,描述词2,描述词3,一个女孩 --seed 312341243 --q 0.2 --ar 3:4"
技术实现细节
在代码层面,主要修改了src/views/mj/aiDrawInputItem.vue
文件中的createPrompt
函数。该函数现在:
- 分别构建参数组合字符串(rzp)和描述词组合字符串(rzk)
- 根据用户选择的不同选项(质量、风格、版本、比例等)生成相应的参数
- 特别注意处理了版本选择(MID_JOURNEY/NIJI_JOURNEY)的特殊情况
- 最后按照正确的顺序拼接三部分内容
优化效果
这一改进带来了以下好处:
- 更高的兼容性:确保MidJourney能够正确解析所有参数
- 更好的用户体验:用户输入的参数不再会被错误放置
- 更清晰的代码结构:明确区分了不同类型的提示词组成部分
- 更稳定的生成结果:减少了因提示词格式错误导致的生成失败
总结
在AI绘画应用中,提示词的构造看似简单,实则包含许多细节需要考虑。ChatGPT-Web-MidJourney-Proxy项目通过这次优化,不仅解决了一个具体的技术问题,也为类似项目提供了提示词处理的良好实践。这种将提示词明确分类并按固定顺序组合的方法,值得其他AI绘画相关项目参考。
HunyuanImage-3.0
HunyuanImage-3.0 统一多模态理解与生成,基于自回归框架,实现文本生成图像,性能媲美或超越领先闭源模型00ops-transformer
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。C++043Hunyuan3D-Part
腾讯混元3D-Part00GitCode-文心大模型-智源研究院AI应用开发大赛
GitCode&文心大模型&智源研究院强强联合,发起的AI应用开发大赛;总奖池8W,单人最高可得价值3W奖励。快来参加吧~0287Hunyuan3D-Omni
腾讯混元3D-Omni:3D版ControlNet突破多模态控制,实现高精度3D资产生成00Spark-Chemistry-X1-13B
科大讯飞星火化学-X1-13B (iFLYTEK Spark Chemistry-X1-13B) 是一款专为化学领域优化的大语言模型。它由星火-X1 (Spark-X1) 基础模型微调而来,在化学知识问答、分子性质预测、化学名称转换和科学推理方面展现出强大的能力,同时保持了强大的通用语言理解与生成能力。Python00GOT-OCR-2.0-hf
阶跃星辰StepFun推出的GOT-OCR-2.0-hf是一款强大的多语言OCR开源模型,支持从普通文档到复杂场景的文字识别。它能精准处理表格、图表、数学公式、几何图形甚至乐谱等特殊内容,输出结果可通过第三方工具渲染成多种格式。模型支持1024×1024高分辨率输入,具备多页批量处理、动态分块识别和交互式区域选择等创新功能,用户可通过坐标或颜色指定识别区域。基于Apache 2.0协议开源,提供Hugging Face演示和完整代码,适用于学术研究到工业应用的广泛场景,为OCR领域带来突破性解决方案。00- HHowToCook程序员在家做饭方法指南。Programmer's guide about how to cook at home (Chinese only).Dockerfile09
- PpathwayPathway is an open framework for high-throughput and low-latency real-time data processing.Python00
项目优选









