deepseek-v4-pro 在「selfie 咖啡店自拍生图 prompt 构建」的评测结果
这是该 AI 模型在此测试用例上的详细评测结果。
基本信息
- 模型名称:deepseek-v4-pro
- 用例名称:selfie 咖啡店自拍生图 prompt 构建
- 测试类型:文本生成
- 评测维度:Alice 生图提示词构建
系统提示词(System Prompt)
这是给 AI 模型的背景设定和角色指令:
你是一个专业的插画生图 prompt 生成器。你的任务是根据提供的场景信息,生成一到多段完整的中文生图提示词,供下游图像模型直接使用。 你必须只返回一个 JSON 对象,包含三个字段: - "prompts":字符串数组,包含 1~4 段完整的中文生图提示词。张数由你根据场景丰富度决定,默认 1 张,宁少勿多: - 日常琐事、居家、纯记录、简单一餐或单件物品:1 张 - 美食、穿搭类场景:仅当两张构图差异足够大时才出 2 张,两张的主体和取景必须完全不同(例如一张带人物的环境全景加一张无人物的纯食物或衣物俯拍特写),想不出两个明显不同的画面就只出 1 张 - 旅行、出游、聚会等出片场景:3~4 张,不同瞬间、不同角度、不同构图,像真人发朋友圈的一组照片 - 多张时每段 prompt 必须是独立完整的画面描述,禁止「同上」「另一角度」这类依赖上下文的表述;人物穿着、发型、天气、时间段在所有 prompt 中保持完全一致,只变化视角、瞬间和构图 - 多张的每一张必须让人一眼看出是不同的照片:主体、景别、视角至少变化两项 - "homeRoom":场景在 Alice 家里时填对应房间标识,不在家里则填 null。可用标识:balcony(阳台)、balcony_small(生活阳台)、kitchen(厨房)、study(书房)、bedroom(卧室)、living(客厅内部)、living_window(客厅朝阳台方向)、corridor(走廊玄关) - "aspectRatio":画面宽高比,按构图需要选择最合适的值: - "3:4":人物半身竖构图(自拍、试衣、人物特写,最常用) - "4:3":横构图(多人合影、有宽阔背景的场景) - "16:9":宽屏(纯风景、全景) - "9:16":窄竖屏(全身站姿、窄巷等纵深场景) - "1:1":仅用于食物俯拍、物品特写等无人物的方形构图 各分类的构图规则(最高优先级,必须遵守): - selfie(自拍):半身近景(胸部以上),略微俯视角度的自拍感,表情自然匹配心情,背景可见但略虚化;画面中禁止出现手机或相机 - outing(出游):中景半身,人物自然融入场景,例如驻足欣赏风景、靠在栏杆上、坐在台阶上;禁止画全身站立看镜头 - food(美食):俯拍或斜角特写食物,画面中禁止出现任何人物,聚焦食物的质感、色泽、热气和桌面摆盘 - clothing(穿搭):半身构图(腰部以上),人物正在试穿新衣,可以是照镜子、整理衣领、低头端详的自然瞬间;禁止画全身 - hangout(聚会):群像半身构图,每个人都有自然的独立动作,无需所有人看镜头;朋友不戴发带,穿着颜色与 Alice 不同;禁止画全身 - scenery(风景):纯风景或环境照片,画面中禁止出现任何人物,聚焦环境的光影氛围和色彩 - mood(心情):氛围物品照片,画面中禁止出现任何人物,聚焦物品的质感和光影情绪 画风要求(每段 prompt 都必须包含以下描述):清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免 3D 渲染、照片写实和纯平涂赛璐璐上色。 生成 prompt 的原则: 1. 场景描述必须与朋友圈文案的内容严格对应;文案提到具体地点时,prompt 里必须包含该地点的真实视觉特征描述 2. 文案没有明确地点时,根据分类和当前城市合理推断一个具体场景 3. 人物描写要自然生动,表情和肢体语言与文案的情绪和场景吻合;人物要融入场景做自然的事情,禁止呆板站立看镜头 4. 光线和氛围要与时间段匹配 5. 天气细节必须体现在画面中:下雨天外出场景必须画撑开的雨伞,人物把伞举在头顶遮雨,地面有水洼和雨滴;禁止下雨天画成晴天,禁止画收拢折叠的伞 6. 穿着已经过应季校验,直接按【人物】描述的穿着如实绘制,禁止擅自更改 7. 含人物的每段 prompt 都必须写入人物外貌关键锚点(脸型、发色发型、发带、项链等),保证多张图之间人物形象一致 8. 屏幕内容约束:如果画面中出现笔记本电脑、手机、平板等带屏幕的设备,且屏幕背对观众,则禁止描述屏幕上显示的任何具体内容,只描述设备外观轮廓和屏幕发出的光晕 9. 当【分类】与【活动描述】出现矛盾时,以【分类】的构图规则为最高优先级,在该构图约束内尽量呼应描述与文案的内容 只返回 JSON,不要输出任何其他内容。
用户提示词(User Prompt)
这是用户给 AI 模型的具体任务要求:
请根据以下信息生成生图 prompt: 【分类】selfie(自拍) 【活动描述】下午在家附近的咖啡店喝拿铁,顺手发了张自拍 【朋友圈文案】午后的拿铁时间,今天的拉花是一只小熊 【当前城市】澳门(常住地:澳门) 【时间】下午(15点) 【心情】心情不错,放松愉快 【天气】晴 【人物 - Alice】Alice(白艾莉),亚洲女性,26岁,鹅蛋脸,黑色自然微卷长发搭配淡金色细发带,脖子上戴着细金链星星吊坠项链,身材纤细挺拔,穿着大地色系休闲穿搭(米白色或奶油色针织上衣、卡其色高腰西裤),佩戴细金链星星吊坠项链和小珍珠耳钉。心情不错,放松愉快。
任务要求
AI 模型需要满足以下要求:
- 只返回一个 JSON 对象,包含 prompts(字符串数组)、homeRoom、aspectRatio 三个字段
- 遵守 selfie 构图规则:半身近景(胸部以上)、略微俯视的自拍感、背景略虚化、画面中禁止出现手机或相机
- aspectRatio 应选 3:4,homeRoom 应为 null(场景在咖啡店)
- prompt 中保留 Alice 外貌锚点(鹅蛋脸、黑色微卷长发、淡金色发带、星星吊坠项链)并包含画风要求
评测结果
综合得分
该模型在此用例的得分为:92.4 分(满分 100 分),已通过
基础难度评测结果
- 得分:92.4 分
- 通过状态:已通过
模型生成产物
以下是该模型针对此任务的实际生成内容:
{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免3D渲染、照片写实和纯平涂赛璐璐上色。半身近景自拍构图,略微俯视角度,一位亚洲年轻女性Alice在澳门一家咖啡店内,鹅蛋脸,黑色自然微卷长发,额前佩戴淡金色细发带,耳垂小珍珠耳钉,脖颈戴细金链星星吊坠项链,身穿米白色针织上衣。她面带轻松愉快的微笑,眼神柔和自然看向镜头,背景是咖啡店靠窗座位,木质桌面上一杯拿铁咖啡,奶泡拉花是一只可爱小熊,午后阳光透过窗户洒入,形成温暖光斑,背景微微虚化,突出人物和咖啡。" ], "homeRoom": null, "aspectRatio": "3:4" }
AI 评审点评
以下是 AI 评审对该模型输出的点评:
【CLAUDE】候选输出整体质量良好,JSON 结构完全合规,selfie 构图规则基本遵守,画幅与场景归属完全正确,人物外貌锚点覆盖较全面,画风要求完整写入。主要不足在于:人物动作描写略显静态(未描述捧杯等手部动作),咖啡店氛围细节稍薄,以及「额前佩戴发带」的位置描述略有偏差。整体而言是一份合格的生图 prompt,可直接使用。 【GEMINI】候选模型的表现非常优秀。生成的 JSON 结构完全合规,完美遵循了画幅、场景归属以及人物外貌锚点的各项约束。生成的生图 prompt 画面细节丰富、光影自然,且完整嵌入了要求的画风描述。唯一可以微调的地方是在 prompt 中显式加入“无手机相机入画”的规避词,以完全确保下游生图模型不画出拍摄设备,但整体已达到极高水平。 【KIMI】候选输出整体合格,JSON 结构和基本参数选择正确,核心 selfie 构图规则与人物锚点大体满足。主要失分点在于:人物动作自然度不足(视线直看镜头而非与场景互动)、穿搭要素缺失下装、场景细节(澳门咖啡店特征、桌面互动)不够丰富、画风描述前置影响叙事流畅。属于可用但优化空间明显的输出。
进阶难度评测结果
- 得分:92.8 分
- 通过状态:已通过
模型生成产物
以下是该模型针对此任务的实际生成内容:
{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免3D渲染、照片写实和纯平涂赛璐璐上色。画面为半身近景自拍构图,略微俯视角度,背景是澳门一家咖啡店的靠窗座位,窗外傍晚日落前的黄金光线透过玻璃窗洒入,形成温暖的光晕,窗外虚化的街景带有葡式建筑轮廓。人物是亚洲女性Alice,26岁,鹅蛋脸,黑色自然微卷长发,额前淡金色细发带,脖子上戴着细金链星星吊坠项链,耳垂有小珍珠耳钉,身穿米白色针织上衣,卡其色高腰西裤,身材纤细挺拔。她坐在窗边,桌上摊着一台笔记本电脑,屏幕背对镜头只透出淡淡光晕,旁边有一杯咖啡。她微微俯视镜头,神情平静从容,嘴角带着一丝放松的笑意,表情自然,背景稍显虚化,人物与暖色调光线融为一体。" ], "homeRoom": null, "aspectRatio": "3:4" }
AI 评审点评
以下是 AI 评审对该模型输出的点评:
【CLAUDE】候选输出整体质量较高,JSON 结构完全合规,selfie 构图规则执行到位,笔记本屏幕约束处理正确,人物锚点保留完整,并加入了澳门葡式建筑等地域细节提升了场景真实感。主要不足在于光线对人物的具体影响描写(如发丝染色、逆光轮廓等)不如参考答案细腻,以及未显式声明无手机相机入画。总体而言是一份接近参考答案水准的高质量输出。 【GEMINI】候选输出表现极其优秀。模型不仅完美遵循了复杂的 JSON 结构和字段要求,还在 prompt 撰写中展现了极高的遵从度。人物锚点、穿搭、画风要求均无缝保留;对于“自拍”构图、傍晚黄金光线以及“屏幕背对观众”的特殊约束也处理得非常细腻。此外,模型还根据当前城市(澳门)合理延伸出了“葡式建筑轮廓”的背景细节,是一份高质量的评测答卷。 【KIMI】该输出整体质量良好,JSON 结构完美,核心约束(无手机、屏幕内容规避、3:4比例)执行到位。主要失分点在于:光线描写较为笼统,缺乏'发丝染成暖橙色'等具象画面语言;人物锚点中文化名缺失;'微微俯视镜头'的表述与 selfie 自然自拍感略有偏差;澳门场景特征挖掘不足。属于中等偏上水平,功能可用但画面感染力有提升空间。
困难难度评测结果
- 得分:81.9 分
- 通过状态:已通过
模型生成产物
以下是该模型针对此任务的实际生成内容:
{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔。澳门一家复古咖啡店内,墙上挂着一面复古黄铜边框的镜子,Alice站在镜子前,略微俯视的自拍视角,镜中映出她的上半身近景:亚洲女性,26岁,鹅蛋脸,黑色自然微卷长发搭配淡金色细发带,脖子上戴着细金链星星吊坠项链和小珍珠耳钉,身穿米白色针织上衣,神情放松愉快,嘴角带着浅浅微笑,眼神看向镜中的自己。镜子旁的桌上放着一束刚买的干花束,背景是虚化的咖啡店环境,下午16点的柔和自然光从窗户透入,多云天气,光线温柔明亮,整体氛围惬意。人物、背景、物体画风统一,避免3D渲染、照片写实和纯平涂赛璐璐上色。" ], "homeRoom": null, "aspectRatio": "3:4" }
AI 评审点评
以下是 AI 评审对该模型输出的点评:
【CLAUDE】候选输出在 JSON 结构、画幅选择和人物锚点方面表现尚可,但对本题核心陷阱「镜面自拍必拍到手机」的处理不够到位:未给出 Alice 在镜前的具体自然替代动作,也未显式声明画面中无拍摄设备,存在隐患。干花束虽然入画但与构图结合较生硬,放在桌上而非与人物互动。整体来看,候选输出完成了基本任务,但在最关键的镜面陷阱处理维度上明显弱于参考答案。 【GEMINI】候选输出表现非常优秀。模型不仅完美遵循了所有的格式和画风要求,更在核心难点“镜面自拍”上展现了极强的逻辑理解能力,成功在保留镜子元素的同时规避了手机入画。人物锚点、道具融入以及构图画幅均完全符合标准,是一份高质量的生图提示词。 【KIMI】该候选输出整体合格,成功通过了hard级别的镜面自拍陷阱测试,未让手机或相机入画,JSON结构完整。主要不足在于:构图逻辑上"站在镜子前"与selfie半身近景的协调性不如参考方案;干花束与人物缺乏互动,仅作为桌上静物存在;人物动作设计较为静态(仅"看向镜中的自己"),未充分利用双手做出自然pose来强化"非拍照瞬间"的叙事。画风描述位置前置虽不影响功能,但破坏了prompt描述的常规叙事顺序。
相关链接
您可以通过以下链接查看更多相关内容: