90% 的可分类案例只有两个审美答案:电影质感,或者真人写实
我们给视觉风格设了 8 个值:电影质感、真人写实、二维动画、三维动画、慢动作、定格拼贴、黑白影像,以及「待复核」。
跑完统计后,前两个值的占比高到让我们回头检查了一遍代码。没写错。
数据是怎么来的
风格标签由自动候选产生、经人工复核。421 条(33.0%)带「待复核」标记,说明这一维度的复核进度是四个维度里最慢的。为了让结论不被缺失值污染,本文所有比例都以「至少带一个已复核风格标签」的 853 条为分母。
| 风格 | 条数 | 占全库 |
|---|---|---|
| 电影质感 | 605 | 47.5% |
| 真人写实 | 550 | 43.2% |
| 待复核 | 421 | 33.0% |
| 二维动画 | 193 | 15.1% |
| 慢动作 | 176 | 13.8% |
| 三维动画 | 107 | 8.4% |
| 定格拼贴 | 66 | 5.2% |
| 黑白影像 | 24 | 1.9% |
发现一:853 条里,767 条只用了两个答案之一
前两个值的条数加起来(1,155)比案例总数还多——因为一条案例可以同时带两个标签。所以我们做了去重统计:
| 条件 | 条数 | 占可分类样本(853) |
|---|---|---|
| 至少带「电影质感」或「真人写实」 | 767 | 89.9% |
| 两个都不带 | 86 | 10.1% |
90% 的可分类案例,视觉上落在两个答案里。
再拆细一点:
| 组合 | 条数 |
|---|---|
| 同时带电影质感 + 真人写实 | 388 |
| 只带电影质感,不带真人写实 | 217 |
| 只带真人写实,不带电影质感 | 162 |
| 合计 | 767 |
同时带两个(388 条)是最多的——这两者在多数案例里其实是同一件事的两种说法:用电影感的布光和景深,把真人拍得像真的。
发现二:另外 86 条是什么样
那 10.1% 不用这两个答案的案例,构成很清楚:
| 风格 | 条数(在这 86 条里) |
|---|---|
| 二维动画 | 51 |
| 定格拼贴 | 23 |
| 慢动作 | 19 |
| 三维动画 | 9 |
| 黑白影像 | 7 |
这 86 条几乎就是「动画 / 手工质感」这一整类。 也就是说,公开案例的审美地图可以极简地二分:要么追求像实拍电影,要么是明确的非写实动画。 中间地带(比如插画风、绘本风、像素风、拼贴实验)在 1,274 条里几乎不存在。
发现三:黑白影像只有 24 条,而且不是用来「炫技」的
最低的那个值我们单独看了:
| 黑白影像的题材分布 | 条数 |
|---|---|
| 音乐舞蹈 | 6 |
| 人物表演 | 6 |
| 视觉设计 | 5 |
| 时尚美妆 | 4 |
| 动画游戏 | 4 |
| 短剧对话 | 3 |
24 条里没有一条武打格斗,主力是音乐舞蹈和人物表演——也就是最依赖氛围而非信息的品类。黑白在这批数据里不是风格实验,是一个氛围工具。
这些数字能拿来干什么
如果你在给新项目定视觉方向:知道 90% 的人选了哪两个答案,本身就是决策信息。选「电影质感」意味着你在一个极度拥挤的赛道里,需要靠内容和钩子区分;选两个之外的方向(比如定格拼贴,66 条)意味着参考极少但辨识度天然更高。
如果你在评估自己的产出为什么「看起来像别人的」:原因可能不在你的提示词细节,而在风格标签这一层就没做出区分。90% 的收敛度意味着,风格词汇的选择空间已经被压缩得很小了。
如果你在做视频模型评测:目前公开案例的评测几乎都发生在「电影质感 + 真人写实」这一个组合内。用同一批审美标准去评一个动画模型,会系统性地低估它。
方法与局限
- 待复核 421 条是最大风险:33% 的样本未复核,如果这批的风格构成与已复核的不同,本文比例会移动。目前无法验证。
- 标签是「候选 + 复核」,不是严格的双人标注,不同标注者对「电影质感」的门槛判断可能不同。
- 「电影质感」的定义未在标签体系里写死,这是一个实务上的模糊点,我们把它列为待改进项。
- 全部数字基于 1,274 条索引记录;按原始发布去重后(924 条),风格收敛的结论方向一致。
数据可查
按「视觉风格」筛选即可复核,也支持与题材交叉:https://cases.aishifu.shop/