deepseek-v4-flash 在「food 俯拍禁人物约束」的评测结果
这是该 AI 模型在此测试用例上的详细评测结果。
基本信息
- 模型名称:deepseek-v4-flash
- 用例名称:food 俯拍禁人物约束
- 测试类型:文本生成
- 评测维度:Alice 生图提示词构建
系统提示词(System Prompt)
这是给 AI 模型的背景设定和角色指令:
你是一个专业的插画生图 prompt 生成器。你的任务是根据提供的场景信息,生成一到多段完整的中文生图提示词,供下游图像模型直接使用。 你必须只返回一个 JSON 对象,包含三个字段: - "prompts":字符串数组,包含 1~4 段完整的中文生图提示词。张数由你根据场景丰富度决定,默认 1 张,宁少勿多: - 日常琐事、居家、纯记录、简单一餐或单件物品:1 张 - 美食、穿搭类场景:仅当两张构图差异足够大时才出 2 张,两张的主体和取景必须完全不同(例如一张带人物的环境全景加一张无人物的纯食物或衣物俯拍特写),想不出两个明显不同的画面就只出 1 张 - 旅行、出游、聚会等出片场景:3~4 张,不同瞬间、不同角度、不同构图,像真人发朋友圈的一组照片 - 多张时每段 prompt 必须是独立完整的画面描述,禁止「同上」「另一角度」这类依赖上下文的表述;人物穿着、发型、天气、时间段在所有 prompt 中保持完全一致,只变化视角、瞬间和构图 - 多张的每一张必须让人一眼看出是不同的照片:主体、景别、视角至少变化两项 - "homeRoom":场景在 Alice 家里时填对应房间标识,不在家里则填 null。可用标识:balcony(阳台)、balcony_small(生活阳台)、kitchen(厨房)、study(书房)、bedroom(卧室)、living(客厅内部)、living_window(客厅朝阳台方向)、corridor(走廊玄关) - "aspectRatio":画面宽高比,按构图需要选择最合适的值: - "3:4":人物半身竖构图(自拍、试衣、人物特写,最常用) - "4:3":横构图(多人合影、有宽阔背景的场景) - "16:9":宽屏(纯风景、全景) - "9:16":窄竖屏(全身站姿、窄巷等纵深场景) - "1:1":仅用于食物俯拍、物品特写等无人物的方形构图 各分类的构图规则(最高优先级,必须遵守): - selfie(自拍):半身近景(胸部以上),略微俯视角度的自拍感,表情自然匹配心情,背景可见但略虚化;画面中禁止出现手机或相机 - outing(出游):中景半身,人物自然融入场景,例如驻足欣赏风景、靠在栏杆上、坐在台阶上;禁止画全身站立看镜头 - food(美食):俯拍或斜角特写食物,画面中禁止出现任何人物,聚焦食物的质感、色泽、热气和桌面摆盘 - clothing(穿搭):半身构图(腰部以上),人物正在试穿新衣,可以是照镜子、整理衣领、低头端详的自然瞬间;禁止画全身 - hangout(聚会):群像半身构图,每个人都有自然的独立动作,无需所有人看镜头;朋友不戴发带,穿着颜色与 Alice 不同;禁止画全身 - scenery(风景):纯风景或环境照片,画面中禁止出现任何人物,聚焦环境的光影氛围和色彩 - mood(心情):氛围物品照片,画面中禁止出现任何人物,聚焦物品的质感和光影情绪 画风要求(每段 prompt 都必须包含以下描述):清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免 3D 渲染、照片写实和纯平涂赛璐璐上色。 生成 prompt 的原则: 1. 场景描述必须与朋友圈文案的内容严格对应;文案提到具体地点时,prompt 里必须包含该地点的真实视觉特征描述 2. 文案没有明确地点时,根据分类和当前城市合理推断一个具体场景 3. 人物描写要自然生动,表情和肢体语言与文案的情绪和场景吻合;人物要融入场景做自然的事情,禁止呆板站立看镜头 4. 光线和氛围要与时间段匹配 5. 天气细节必须体现在画面中:下雨天外出场景必须画撑开的雨伞,人物把伞举在头顶遮雨,地面有水洼和雨滴;禁止下雨天画成晴天,禁止画收拢折叠的伞 6. 穿着已经过应季校验,直接按【人物】描述的穿着如实绘制,禁止擅自更改 7. 含人物的每段 prompt 都必须写入人物外貌关键锚点(脸型、发色发型、发带、项链等),保证多张图之间人物形象一致 8. 屏幕内容约束:如果画面中出现笔记本电脑、手机、平板等带屏幕的设备,且屏幕背对观众,则禁止描述屏幕上显示的任何具体内容,只描述设备外观轮廓和屏幕发出的光晕 9. 当【分类】与【活动描述】出现矛盾时,以【分类】的构图规则为最高优先级,在该构图约束内尽量呼应描述与文案的内容 只返回 JSON,不要输出任何其他内容。
用户提示词(User Prompt)
这是用户给 AI 模型的具体任务要求:
请根据以下信息生成生图 prompt: 【分类】food(美食) 【活动描述】在家给自己做了一份牛油果吐司加溏心蛋的早餐 【朋友圈文案】给自己的周末早餐打个卡,溏心蛋完美 【当前城市】澳门(常住地:澳门) 【时间】上午(9点) 【心情】心情不错,放松愉快 【人物 - Alice】Alice(白艾莉),亚洲女性,26岁,鹅蛋脸,黑色自然微卷长发搭配淡金色细发带,脖子上戴着细金链星星吊坠项链,身材纤细挺拔,穿着大地色系休闲穿搭(米白色或奶油色针织上衣、卡其色高腰西裤),佩戴细金链星星吊坠项链和小珍珠耳钉。心情不错,放松愉快。
任务要求
AI 模型需要满足以下要求:
- 只返回 JSON,prompts、homeRoom、aspectRatio 三字段齐全
- 遵守 food 构图规则:俯拍或斜角特写食物,画面中禁止出现任何人物
- 场景在家中用餐,homeRoom 应填厨房或客厅等合理房间标识
- aspectRatio 应选 1:1,聚焦食物质感、色泽与摆盘
评测结果
综合得分
该模型在此用例的得分为:95.3 分(满分 100 分),已通过
基础难度评测结果
- 得分:95.3 分
- 通过状态:已通过
模型生成产物
以下是该模型针对此任务的实际生成内容:
{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔。俯拍视角,白色陶瓷盘上放着一片烤好的牛油果吐司,吐司上摆放着切片的牛油果,中间有一个溏心蛋,蛋白边缘微焦,蛋黄晶莹剔透,旁边点缀几颗樱桃番茄和一小撮芝麻菜。桌面是浅色木纹,旁边有一杯冒着热气的咖啡,阳光从窗户斜射进来,在桌面上投下柔和的光影。" ], "homeRoom": "kitchen", "aspectRatio": "1:1" }
AI 评审点评
以下是 AI 评审对该模型输出的点评:
【CLAUDE】候选输出整体表现良好,JSON 结构合规,严格遵守禁人物约束,俯拍构图与 1:1 画幅选择正确,homeRoom 判断准确。主要不足在于食物细节描写的精准度:溏心蛋蛋黄的流动感与暖橙色未能准确体现,牛油果和吐司的质感描述也略显不足。整体达到基本要求,属于合格输出。 【GEMINI】候选输出表现非常优秀。模型严格遵守了 System Prompt 中针对 food 场景的所有高优先级规则,包括 1:1 俯拍构图、严禁人物出现、以及 homeRoom 的准确判断。生成的提示词画面感强,食物细节精致,画风融合度高,是一份高质量的评测答卷。 【KIMI】candidate_output 整体符合 food 类别的基本约束,无人物、画幅正确、homeRoom 判断准确。主要问题在于食物画面质量:擅自添加文案未提及的配料和饮品(樱桃番茄、芝麻菜、咖啡),违背了严格对应原则;溏心蛋的核心特征"流动蛋黄"刻画不足;俯拍构图的光影处理偏向侧光而非典型垂直俯拍。建议在 food 场景中更严格遵循文案内容,避免自由发挥添加元素,同时加强对核心食物质感的精准描写。
进阶难度评测结果
- 得分:100.0 分
- 通过状态:已通过
模型生成产物
以下是该模型针对此任务的实际生成内容:
```json { "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免 3D 渲染、照片写实和纯平涂赛璐璐上色。夜晚八点,澳门旧城区一条狭窄小巷深处的日式居酒屋,俯拍视角,木纹吧台桌面上整齐摆放着一盘烤串拼盘——五串烤鸡肉串与烤蔬菜串呈扇形搭在粗陶浅盘上,鸡肉表面微微焦黄泛着油润光泽,竹签尖端略碳化,袅袅热气升腾;旁边是切块叠放的玉子烧,金黄柔软层次分明,配小碟酱汁与一双木筷;画面边缘放着一杯梅酒,半透明琥珀色酒液里冰块半融,浮着一颗腌渍青梅;窗外是被小雨打湿的石仔路,屋檐下灯笼的光晕映在湿润路面,形成暖黄倒影;背景隐约可见木格窗棂、日式纸灯笼和门外半幅暖帘,暖光与潮湿夜色交融,小而温馨,整体安静治愈。", "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔,人物、背景、物体画风统一,避免 3D 渲染、照片写实和纯平涂赛璐璐上色。斜侧 45 度近景特写,对准居酒屋吧台上的一盘烤串:两根鸡肉串上葱段被炭火烧出微微焦边,酱汁与肉汁在暖光下透出晶莹油亮,边缘泛起细小的白热蒸汽;烤香菇表面微皱,散发着炭火香气;画面右下角是一杯梅酒,冰块半融,酒液清澈透亮,一颗青梅浮在杯中,杯壁凝着细密水珠;背景虚化处露出木质吧台、竹帘和暖黄纸灯笼的一圈柔光,窗外小雨在玻璃上晕开灰蓝色的湿润光斑,模糊间隐约透出一碟金黄玉子烧的柔影;整幅画面强调烤串焦香的质感、梅酒的清冽和雨夜居酒屋里安静熨帖的疲惫消融感。" ], "homeRoom": null, "aspectRatio": "1:1" } ```
AI 评审点评
以下是 AI 评审对该模型输出的点评:
【GEMINI】候选输出表现极其优秀。模型不仅完美遵循了 JSON 格式、1:1 画幅和 food 分类的禁人物约束,而且在多菜品布局上做到了主次分明、构图多样化。最出色的是对雨天和疲惫氛围的间接处理,通过窗外湿润的街景和玻璃雨痕来表达,既切合主题又没有违反 food 类的构图限制,是一份高质量的专业级输出。
困难难度评测结果
- 得分:88.3 分
- 通过状态:已通过
模型生成产物
以下是该模型针对此任务的实际生成内容:
{ "prompts": [ "清透干净的日式水彩风数码插画,细腻柔和的线稿,透明水彩叠色,低饱和明亮通透的暖色调,光线温柔。俯拍视角,澳门一家温馨的甜品店内,浅色木桌上摆着两盘精致甜点:一盘草莓千层蛋糕,酥皮与奶油层次分明,顶部堆满鲜艳的草莓果粒、淋着淡粉色草莓酱汁;另一盘提拉米苏,表面均匀撒着深棕色可可粉,点缀一颗咖啡豆形状的巧克力。桌面上散落着银色甜品叉、两杯冒着热气的伯爵红茶、几片散落的草莓切片。午后三点的阳光透过窗户斜照在桌面上,在甜点边缘投下柔和阴影,餐具反射出微光,画面弥漫着甜腻温暖的气息。" ], "homeRoom": null, "aspectRatio": "1:1" }
AI 评审点评
以下是 AI 评审对该模型输出的点评:
【CLAUDE】候选模型在核心抗诱导约束上表现良好,成功规避了「我和闺蜜一起」的强诱导,输出了纯甜品无人物画面,JSON 结构与画幅选择也完全正确。主要不足在于甜品画面质量未能体现「吃剩一半、叉痕、最后一口被抢」等分享叙事痕迹,两盘蛋糕被描述为完整精美状态,与文案情绪和故事感脱节;此外双份餐具的「两副」细节也不够明确,弱化了双人分享的隐性叙事表达。整体属于合格但有明显提升空间的输出。 【GEMINI】模型表现非常优秀。在结构合规性、抗人物诱导、构图画幅以及氛围光线方面都拿到了满分。唯一美中不足的是在甜品画面质量上,虽然对食物质感的描绘很生动,但缺乏对文案中“吃剩/抢最后一口”这一核心叙事痕迹的刻画,导致画面故事感略显不足。整体而言是一份高质量的输出。 【KIMI】candidate_output在核心约束(禁人物、JSON结构、俯拍1:1)上表现优秀,成功抵抗了强烈的双人入画诱导。但在叙事细节还原上存在明显不足:未能体现「最后一口被抢」的关键情节,两份甜品均呈现完整摆盘状态,与文案中「消灭掉」「抢了我最后一口」的动态叙事严重脱节。此外,「伯爵红茶」替代了更合理的饮品选择,食物状态过于静态完美。整体为合格的food类prompt,但故事性和场景还原度有较大提升空间。
相关链接
您可以通过以下链接查看更多相关内容: