PicPrompt · 图片提示词解析器
把参考图拆成可编辑视觉字段,并适配四种生图模型格式
多模态 AI 产品案例 / 17
PicPrompt 把一张参考图拆成八项可编辑视觉字段,再为不同生图模型重新编排成可直接使用的提示词。
用户可拖入、粘贴或输入图片 URL,通过自选多模态供应商提取主体、风格、光线、构图、镜头、色彩、氛围和细节,并输出 Midjourney、Seedream、Nano Banana 或 GPT-Image-2 格式。产品无自有后端,密钥与归档保存在浏览器本地。
公开网站已上线,支持单图与最多 10 张批量解析。
支持 OpenAI、Anthropic、Gemini、豆包与 GLM 供应商配置。
结构化字段可编辑,并支持对话式局部调整与四种目标格式。
密钥、图片缩略图和结果存本地;解析时图片会从浏览器直发所选模型供应商。
反向提示词不应该只输出一段黑盒文本
一段完整提示词很难修改。产品先输出八项视觉字段和避免项,让用户可以只改光线、镜头或主体,而不破坏其余结构。
不同模型需要不同语言结构和参数。统一中间结构让一次解析可以被重新编排成 Midjourney 参数式、Seedream 中文自然语言或其他模型格式。
本地优先不等于不经过模型供应商
PicPrompt 不设自有后端,API Key 保存在 localStorage,归档保存在 IndexedDB;这减少了平台持有敏感数据的范围。
但执行视觉解析时,图片仍会直接发送到用户选择的模型 API。产品在帮助文档中明确这一点,并提示不要在他人设备保存密钥、定期导出归档。
PROCESS
关键决策
先结构化,再格式化
一个中间对象支撑多模型输出和局部编辑。
用户自带供应商与密钥
不建立统一代理后端,减少平台持有凭据与图片的责任范围。
归档可导入导出
本地 IndexedDB 便于隐私与速度,JSON 备份应对浏览器清理风险。
我的角色与协作
我负责产品闭环、结构化字段、供应商与格式器架构、隐私说明、批量解析和本地归档体验。
AI 协作实现与测试;数据边界、供应商差异、密钥提示和上线验收由我负责。
验证、结果与反思
公开网站已上线,主要上传、设置、解析、编辑、格式化与归档界面可用。
解析质量与费用取决于用户选择的模型和密钥;产品不承诺所有图片都能准确复现。
多模型产品需要把“模型能力”与“产品结构”分开:供应商可以替换,用户对结果的理解与控制不能丢。


