/EN联系
肖丽琴 / 作品
AI 产品2026

PicPrompt · 图片提示词解析器

把参考图拆成可编辑视觉字段,并适配四种生图模型格式

多模态 AI 产品案例 / 17

PicPrompt 把一张参考图拆成八项可编辑视觉字段,再为不同生图模型重新编排成可直接使用的提示词。

用户可拖入、粘贴或输入图片 URL,通过自选多模态供应商提取主体、风格、光线、构图、镜头、色彩、氛围和细节,并输出 Midjourney、Seedream、Nano Banana 或 GPT-Image-2 格式。产品无自有后端,密钥与归档保存在浏览器本地。

01

公开网站已上线,支持单图与最多 10 张批量解析。

02

支持 OpenAI、Anthropic、Gemini、豆包与 GLM 供应商配置。

03

结构化字段可编辑,并支持对话式局部调整与四种目标格式。

04

密钥、图片缩略图和结果存本地;解析时图片会从浏览器直发所选模型供应商。

反向提示词不应该只输出一段黑盒文本

一段完整提示词很难修改。产品先输出八项视觉字段和避免项,让用户可以只改光线、镜头或主体,而不破坏其余结构。

不同模型需要不同语言结构和参数。统一中间结构让一次解析可以被重新编排成 Midjourney 参数式、Seedream 中文自然语言或其他模型格式。

本地优先不等于不经过模型供应商

PicPrompt 不设自有后端,API Key 保存在 localStorage,归档保存在 IndexedDB;这减少了平台持有敏感数据的范围。

但执行视觉解析时,图片仍会直接发送到用户选择的模型 API。产品在帮助文档中明确这一点,并提示不要在他人设备保存密钥、定期导出归档。

PROCESS

关键决策

01

先结构化,再格式化

一个中间对象支撑多模型输出和局部编辑。

02

用户自带供应商与密钥

不建立统一代理后端,减少平台持有凭据与图片的责任范围。

03

归档可导入导出

本地 IndexedDB 便于隐私与速度,JSON 备份应对浏览器清理风险。

我的角色与协作

我负责产品闭环、结构化字段、供应商与格式器架构、隐私说明、批量解析和本地归档体验。

AI 协作实现与测试;数据边界、供应商差异、密钥提示和上线验收由我负责。

验证、结果与反思

公开网站已上线,主要上传、设置、解析、编辑、格式化与归档界面可用。

解析质量与费用取决于用户选择的模型和密钥;产品不承诺所有图片都能准确复现。

多模型产品需要把“模型能力”与“产品结构”分开:供应商可以替换,用户对结果的理解与控制不能丢。