deepseek-v4-flash 在「selfie 咖啡店自拍生图 prompt 构建」的评测结果

这是该 AI 模型在此测试用例上的详细评测结果。

基本信息

  • 模型名称:deepseek-v4-flash
  • 用例名称:selfie 咖啡店自拍生图 prompt 构建
  • 测试类型:文本生成
  • 评测维度:Alice 生图提示词构建

系统提示词(System Prompt)

这是给 AI 模型的背景设定和角色指令:

你是一个专业的插画生图 prompt 生成器。你的任务是根据提供的场景信息,生成一到多段完整的中文生图提示词,供下游图像模型直接使用。 你必须只返回一个 JSON 对象,包含三个字段: - "prompts":字符串数组,包含 1~4 段完整的中文生图提示词。张数由你根据场景丰富度决定,默认 1 张,宁少勿多: - 日常琐事、居家、纯记录、简单一餐或单件物品:1 张 - 美食、穿搭类场景:仅当两张构图差异足够大时才出 2 张,两张的主体和取景必须完全不同(例如一张带人物的环境全景加一张无人物的纯食物或衣物俯拍特写),想不出两个明显不同的画面就只出 1 张 - 旅行、出游、聚会等出片场景:3~4 张,不同瞬间、不同角度、不同构图,像真人发朋友圈的一组照片 - 多张时每段 prompt 必须是独立完整的画面描述,禁止「同上」「另一角度」这类依赖上下文的表述;人物穿着、发型、天气、时间段在所有 prompt 中保持完全一致,只变化视角、瞬间和构图 - 多张的每一张必须让人一眼看出是不同的照片:主体、景别、视角至少变化两项 - "homeRoom":场景在 Alice 家里时填对应房间标识,不在家里则填 null。可用标识:balcony(阳台)、balcony_small(生活阳台)、kitchen(厨房)、study(书房)、bedroom(卧室)、living(客厅内部)、living_window(客厅朝阳台方向)、corridor(走廊玄关) - "aspectRatio":画面宽高比,按构图需要选择最合适的值: - "3:4":人物半身竖构图(自拍、试衣、人物特写,最常用) - "4:3":横构图(多人合影、有宽阔背景的场景) - "16:9":宽屏(纯风景、全景) - "9:16":窄竖屏(全身站姿、窄巷等纵深场景) - "1:1":仅用于食物俯拍、物品特写等无人物的方形构图 各分类的构图规则(最高优先级,必须遵守): - selfie(自拍):半身近景(胸部以上),略微俯视角度的自拍感,表情自然匹配心情,背景可见但略虚化;画面中禁止出现手机或相机 - outing(出游):中景半身,人物自然融入场景,例如驻足欣赏风景、靠在栏杆上、坐在台阶上;禁止画全身站立看镜头 - food(美食):俯拍或斜角特写食物,画面中禁止出现任何人物,聚焦食物的质感、色泽、热气和桌面摆盘 - clothing(穿搭):半身构图(腰部以上),人物正在试穿新衣,可以是照镜子、整理衣领、低头端详的自然瞬间;禁止画全身 - hangout(聚会):群像半身构图,每个人都有自然的独立动作,无需所有人看镜头;朋友不戴发带,穿着颜色与 Alice 不同;禁止画全身 - scenery(风景):纯风景或环境照片,画面中禁止出现任何人物,聚焦环境的光影氛围和色彩 - mood(心情):氛围物品照片,画面中禁止出现任何人物,聚焦物品的质感和光影情绪 画风要求(每段 prompt 都必须包含以下描述):清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免 3D 渲染、照片写实和纯平涂赛璐璐上色。 生成 prompt 的原则: 1. 场景描述必须与朋友圈文案的内容严格对应;文案提到具体地点时,prompt 里必须包含该地点的真实视觉特征描述 2. 文案没有明确地点时,根据分类和当前城市合理推断一个具体场景 3. 人物描写要自然生动,表情和肢体语言与文案的情绪和场景吻合;人物要融入场景做自然的事情,禁止呆板站立看镜头 4. 光线和氛围要与时间段匹配 5. 天气细节必须体现在画面中:下雨天外出场景必须画撑开的雨伞,人物把伞举在头顶遮雨,地面有水洼和雨滴;禁止下雨天画成晴天,禁止画收拢折叠的伞 6. 穿着已经过应季校验,直接按【人物】描述的穿着如实绘制,禁止擅自更改 7. 含人物的每段 prompt 都必须写入人物外貌关键锚点(脸型、发色发型、发带、项链等),保证多张图之间人物形象一致 8. 屏幕内容约束:如果画面中出现笔记本电脑、手机、平板等带屏幕的设备,且屏幕背对观众,则禁止描述屏幕上显示的任何具体内容,只描述设备外观轮廓和屏幕发出的光晕 9. 当【分类】与【活动描述】出现矛盾时,以【分类】的构图规则为最高优先级,在该构图约束内尽量呼应描述与文案的内容 只返回 JSON,不要输出任何其他内容。

用户提示词(User Prompt)

这是用户给 AI 模型的具体任务要求:

请根据以下信息生成生图 prompt: 【分类】selfie(自拍) 【活动描述】下午在家附近的咖啡店喝拿铁,顺手发了张自拍 【朋友圈文案】午后的拿铁时间,今天的拉花是一只小熊 【当前城市】澳门(常住地:澳门) 【时间】下午(15点) 【心情】心情不错,放松愉快 【天气】晴 【人物 - Alice】Alice(白艾莉),亚洲女性,26岁,鹅蛋脸,黑色自然微卷长发搭配淡金色细发带,脖子上戴着细金链星星吊坠项链,身材纤细挺拔,穿着大地色系休闲穿搭(米白色或奶油色针织上衣、卡其色高腰西裤),佩戴细金链星星吊坠项链和小珍珠耳钉。心情不错,放松愉快。

任务要求

AI 模型需要满足以下要求:

  1. 只返回一个 JSON 对象,包含 prompts(字符串数组)、homeRoom、aspectRatio 三个字段
  2. 遵守 selfie 构图规则:半身近景(胸部以上)、略微俯视的自拍感、背景略虚化、画面中禁止出现手机或相机
  3. aspectRatio 应选 3:4,homeRoom 应为 null(场景在咖啡店)
  4. prompt 中保留 Alice 外貌锚点(鹅蛋脸、黑色微卷长发、淡金色发带、星星吊坠项链)并包含画风要求

评测结果

综合得分

该模型在此用例的得分为:91.3 分(满分 100 分),已通过

基础难度评测结果

  • 得分:91.3 分
  • 通过状态:已通过

模型生成产物

以下是该模型针对此任务的实际生成内容:

{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔。下午三点,澳门一家温馨咖啡店内,阳光透过玻璃窗洒在木桌上。Alice,亚洲女性,26岁,鹅蛋脸,黑色自然微卷长发搭配淡金色细发带,脖子上戴着细金链星星吊坠项链,小珍珠耳钉。她身穿米白色针织上衣,卡其色高腰西裤。半身近景,略微俯视的自拍角度,她微微侧头,嘴角带着放松愉快的浅笑,眼神温柔看向镜头。背景中可见咖啡杯和吧台,桌上放着一杯拿铁,拉花是一只可爱的小熊形状,热气袅袅。背景略有虚化,突出人物。整体画风统一,避免3D渲染和照片写实。" ], "homeRoom": null, "aspectRatio": "3:4" }

AI 评审点评

以下是 AI 评审对该模型输出的点评:

【CLAUDE】候选输出整体质量良好,JSON 结构完全合规,画幅与场景归属判断准确,人物外貌锚点保留全面,画风要求覆盖到位。selfie 构图规则基本遵守,无手机/相机入画。主要不足在于:人物动作描写中「看向镜头」略显摆拍感,不如参考答案「视线落在杯中拉花」自然;拿铁杯的位置描述存在轻微歧义。总体而言是一份接近参考答案水平的高质量输出。 【GEMINI】候选模型的表现非常优秀。生成的 JSON 格式完全正确,完美保留了人物的所有外貌锚点与穿搭,画面细节(如小熊拉花、下午三点的光线、澳门咖啡店等)描写得非常生动,画风要求也完全融入。唯一可以改进的地方是在 prompt 中显式加入“无手机或相机入画”的规避词,以更严格地遵守 selfie 构图规则。 【KIMI】候选输出整体合格,JSON 结构和画幅选择完全正确,人物锚点和场景要素基本完整。主要失分点在于:'看向镜头'的表述与 selfie 禁止拍摄设备入画的规则存在隐性冲突,人物与咖啡的互动感偏弱('桌上放着'vs'双手轻捧'),以及部分画面细节的逻辑自洽性有待加强。建议在 selfie 场景中避免'看向镜头'类描述,改用'视线落在拉花上''自然低眸'等更符合无设备自拍情境的表达。

进阶难度评测结果

  • 得分:88.3 分
  • 通过状态:已通过

模型生成产物

以下是该模型针对此任务的实际生成内容:

{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免3D渲染、照片写实和纯平涂赛璐璐上色。傍晚,澳门一家温馨的咖啡店内,靠窗的座位。Alice(白艾莉),亚洲女性,26岁,鹅蛋脸,黑色自然微卷长发搭配淡金色细发带,脖子上戴着细金链星星吊坠项链,身穿米白色针织上衣,略微俯拍的自拍视角,半身近景(胸部以上),她微微侧头看向窗外,脸上带着平静从容的浅笑,被窗外的落日黄金光线照亮,背景是咖啡店木质桌椅和模糊的窗景,桌上摊着一台笔记本电脑(屏幕背对观众,只显示轮廓和键盘,屏幕发出暖色光晕),画面整体温暖治愈,光线柔和虚化背景。" ], "homeRoom": null, "aspectRatio": "3:4" }

AI 评审点评

以下是 AI 评审对该模型输出的点评:

【CLAUDE】候选输出整体质量良好,JSON 结构完全合规,selfie 构图规则执行到位,笔记本屏幕约束基本遵守,人物主要锚点保留完整,画风要求完整写入。主要不足在于:光线描述缺乏具体的画面语言(如斜射方向、发丝染色等细节);笔记本屏幕描述中「键盘」的出现与「屏幕背对观众」设定存在轻微逻辑矛盾;人物锚点中珍珠耳钉和西裤描述缺失。总体而言是一份合格且较为完善的输出,与参考答案差距不大。 【GEMINI】候选输出表现非常优秀。JSON 格式完全合规,完美执行了 selfie 构图规则和难度较高的笔记本屏幕背对观众约束。画面画风、场景要素和光线氛围均得到了很好的呈现,人物锚点保留也较为完整,仅有极个别微小细节(如耳钉)未完全写入,整体质量极高。 【KIMI】该输出整体合格,JSON 结构完美,核心约束(无手机、笔记本屏幕不描述内容、3:4比例)执行到位。主要失分点在于:selfie 构图的人物视线方向偏离(看向窗外而非镜头,削弱自拍感);黄金光线描述偏泛,缺乏"发丝边缘暖橙""斜射长影"等具象画面语言;人物锚点中小珍珠耳钉和卡其色高腰西裤遗漏;澳门城市视觉特征未落地。建议在 selfie 场景中强化人物与镜头的互动感,将光线描写拆解为可绘制的视觉元素(如边缘光、光斑、影子方向),并严格核对人物描述的全量复现。

困难难度评测结果

  • 得分:81.4 分
  • 通过状态:已通过

模型生成产物

以下是该模型针对此任务的实际生成内容:

{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免3D渲染、照片写实和纯平涂赛璐璐上色。下午四点多云天气,柔和的光线透过咖啡店窗户洒入,室内温暖。画面中,26岁的亚洲女性Alice(白艾莉)站在一面复古黄铜镜子前,镜子边框有雕花,反射出她的上半身半身像。她鹅蛋脸,黑色自然微卷长发扎着淡金色细发带,脖子上戴着细金链星星吊坠项链,佩戴小珍珠耳钉,穿着米白色或奶油色针织上衣搭配卡其色高腰西裤。她微微侧身,眼神看向镜子里的自己,嘴角带着轻松愉快的微笑,一只手自然垂在身旁,另一只手轻轻搭在桌边。桌上放着一束刚买的干花(尤加利叶和薰衣草色系),花瓶是简约的玻璃瓶。背景可见咖啡店的木质桌椅和装饰,略虚化。整体氛围放松惬意,人物表情自然,仿佛在随意自拍,但画面中没有任何手机或相机。" ], "homeRoom": null, "aspectRatio": "3:4" }

AI 评审点评

以下是 AI 评审对该模型输出的点评:

【CLAUDE】候选输出整体质量中等偏上,JSON 格式完全合规,人物锚点保留较好,画幅选择正确。主要短板在于镜面陷阱的处理深度不足——虽然明确禁止了手机入画并给出了自然替代姿势,但未充分描述镜中影像的细节与一致性,对这道「hard」难度陷阱题的核心考点处理不够彻底。干花束的融入方式(置于桌上花瓶中)与 selfie 半身近景构图的结合不够自然,不如参考答案中手持干花的处理方式。selfie 俯视角度的自拍感描述也有所欠缺。整体可用但在关键约束处理上未达到满分标准。 【GEMINI】候选输出在所有维度上表现都极其优秀。不仅完美避开了“镜面自拍必拍到手机”的核心陷阱,用自然动作替代了拍照姿势,还完整保留了人物的所有外貌锚点与穿搭细节。道具融入自然,画风要求完整,JSON 结构完全合规,是一份高质量的评测答卷。 【KIMI】该输出在硬性结构要求上完全合规,核心陷阱(镜面自拍禁手机)基本规避但处理手法不够彻底——保留了'自拍'的心理暗示却未消解其动作逻辑,镜中反射的构图方式也偏离了 selfie 应有的直接近景主体。干花道具入画但摆放方式刻板,人物动作偏向静态摆拍而非自然生活瞬间。整体属于'及格边缘的合规',在 hardest 难度的镜面陷阱测试中未能展现出参考方案那样的精巧设计:通过'一手拢发、一手抱花、侧头看镜'的完全无设备动作彻底切断自拍与手机的关联,并维持镜内外形象一致。

相关链接

您可以通过以下链接查看更多相关内容:

加载中...