← 返回目录


为什么百合高质量作品比其他类型的作品少?

钻研人类记忆,探索复习算法。改善教育公平,践行自由学习。

88 👍 / 0 💬

问题描述

今天我刷到了一个视频,说为什么百合的受众少?

这个是原帖

是因为百合的高质量作品比较少,百合作者应该提高百合作品的质量。还有评论区下面说,百合需要一个mxtx,但我觉得这个观点并不正确,所以想问问该如何反驳这个观点,还有为什么百合高质量作品比其他类型作品少?


秉承知乎精神,先问是不是,再问为什么。

百合高质量作品真的比其他类型作品少吗?

首先光问题定义就能扯一篇论文出来:

对任何一个口径稍作修改,都可能得出大相径庭的结论。

当然,有口径好过无口径,我自己先提出一个口径,至于别人是否同意,我说了不算。

以下内容由 GPT-5.6-sol-max 生成:


我先做一个重要的限定:本研究没有直接测量「作品质量」,而是把「高质量」暂时操作化为:

在 Bangumi 的用户评分中,进入同一媒介、同一年代组的高分区。

所以本文更准确的说法是「高评分作品」,而不是「质量更高的作品」。评分是一个可观察的代理指标,但它会受到评分用户、作品曝光度、平台收录和样本数量等因素影响。

1. 哪些作品进入样本?

我固定使用 Bangumi 的 dump-2026-08-18.210343Z.zip 快照,研究截止日为 2026 年 8 月 19 日,不使用会继续变化的实时页面。

一个 Bangumi 条目视为一个观察单位。主样本包括:

游戏、音乐、人物、书籍以外的其他媒介不进入主样本。

另外,作品必须满足:

评分人数不是直接读取某个总数,而是把 Bangumi score_details 中 1 分到 10 分的票数相加。缺失日期、没有评分、评分人数不足的条目会被排除。评分人数门槛改成 100 或 300 的结果作为敏感性分析。

最终主样本是 18,825 部作品。

2. 哪些作品算「百合作品」?

本次主口径是:

meta_tags 精确包含「百合」,或者用户「百合」标签人数至少 10 人。

这样做是为了同时覆盖两类情况:

  1. Bangumi 的结构化标签已经明确标为「百合」;
  2. 结构化标签没有写「百合」,但有一些用户实际使用了这个标签。

例如条目 《我买下了与她的每周密会》meta_tags 为空,但用户「百合」标签人数很多。如果只看 meta_tags,它会被漏掉;按主口径,它会被识别为百合作品。

按照这个定义,18,825 部作品中识别出 1,619 部百合。

这里有一个必须强调的边界:

没有命中这个规则的作品,只称为「未识别组」,不能直接称为「非百合作品」。

因为标签可能缺失,用户也可能没有给作品打标签。因此「未识别组」里面可能混有没有被标出来的百合作品。

严格只使用 meta_tags、把用户标签门槛改成 5 或 20 人,都做了敏感性分析。

3. 怎么定义「高质量」或「高分」?

我没有使用统一的「评分 8.0 以上」作为高分标准,而是采用相对排名:

  1. 先按媒介分组:漫画、小说、动画;
  2. 再按发行年份划分五年年代组;
  3. 每个「媒介 × 年代组」内部计算 Bangumi 评分的第 90 百分位;
  4. 达到这个阈值的作品进入高分区。

为了避免早期年代作品太少,每个年代组从最早年代开始,遇到不足 30 部的相邻组就合并;最后一个不足 30 部的组并入前一组。

采用的是 higher 分位数规则,并保留所有与阈值同分的作品。因此高分区实际可能略高于名义上的 10%。

这样做的含义是:

一个 7.6 分的作品,在评分普遍较低的年代组里可能属于高分;另一个 8.0 分的作品,在评分普遍较高的年代组里未必进入高分区。

这比直接拿不同年代、不同媒介的原始分数硬比较更公平。

前 5%、前 20%、固定评分至少 8.0,也作为敏感性分析。

4. 「其他类型」是怎么处理的?

这里不能简单地把所有作品硬塞进一个完整、互斥的「类型分类表」,因为 Bangumi 标签本身允许重叠,而且它不是一套严格的文学分类学。

所以本次分析分成两层。

第一层:主分析

主分析比较的是:

因此「其他类型」在主分析中并不是一个真正的类型,而是「未识别组」。它包含各种作品,也可能包含标签漏掉的百合作品。

这样做的好处是定义简单、可复现;代价是它不是一个完美的「所有非百合作品」对照组。

第二层:大众题材比较

我预先固定了 20 个题材标签:

搞笑/喜剧、奇幻、恋爱/爱情、战斗、百合、校园、科幻、日常、后宫、治愈、热血、异世界、纯爱、推理、悬疑、冒险、运动、音乐、恐怖、职场。

每个题材都使用和百合相同的识别规则:结构化标签精确命中,或者用户标签人数至少 10 人。

这些题材允许重叠。因此:

一部作品如果同时是百合和音乐题材,就同时计入「百合」和「音乐」两行。

这不是重复计算错误,而是因为这两个问题本来就不同:

不过当前分析使用的是「音乐」标签,不是单独的「乐队」标签。不能把「音乐」结果直接说成「乐队题材结果」。如果要研究「乐队」本身,需要另设一个明确的「乐队」标签口径并重新分析。

题材表里的「该题材 vs 其余作品」,意思只是「不命中这个题材标签的作品」,并不意味着「其余作品」是一个互斥的统一类型。

5. 纯爱和恋爱这种可能有包含关系的标签,怎么处理?

本次没有根据概念推理去自动补标签,而是只认数据库中实际出现的标签。

因此:

换句话说,本研究不假定「纯爱一定是恋爱」的标签子集,也不假定「恋爱一定是纯爱」的反面。这里分析的是 Bangumi 的实际标注,而不是建立一套哲学上完美的类型本体。

为了做更干净的关系题材对比,另外构造了互斥分组:

其中:

「纯爱」不属于这三个核心关系标签,因此在互斥关系分析中没有被单独排除。也就是说,纯爱作品如果同时命中「恋爱/爱情」,且没有百合、BL 或后宫标签,仍可能进入「普通恋爱」。

因此报告中有时会看到百合数量是 1,619,有时是 1,590。这不是数据矛盾:

6. 「少」到底指什么?

「少」至少有四种不同含义,本次分别报告。

问法本次结果
高分百合作品的绝对数量253 部
高分池中百合所占比例11.6%
百合作品自身进入高分区的比例15.6%
未识别组进入高分区的比例11.2%

主样本中:

因此,如果问题是:

「高分百合作品的张数是不是比其他作品少?」

答案是:是的,253 部显然少于 1,920 部。

但如果问题是:

「一部百合作品是不是比其他作品更难成为高分作品?」

原始比例反而是百合略高:

控制媒介、年代、评分人数和动画平台后,标准化概率约为:

这个区间包含 0,所以目前不能说百合稳定地更容易,也不能说百合稳定地更难获得高评分。

这两个结论可以同时成立:

高分百合作品的绝对数量较少;但单部百合作品进入高分区的比例并没有显示出明显劣势。

原因主要是基数不同。百合作品只占主样本的 8.6%,而未识别组占 91.4%。一个小品类即使单部作品的高分率不低,高分作品的总张数仍然可能较少。

7. 「控制」具体控制了什么?

调整模型控制了:

模型只保留同时有至少 5 部百合、至少 20 部未识别作品的共同支持层。这样做是为了避免拿「某个年代完全没有百合」的层,硬推导出百合和非百合的差异。

这叫统计调整,不是因果实验。它只能回答:

在这些可比的媒介、年代和评分人数条件下,两组的高分率有多大差异?

不能回答:

百合题材本身是否导致了更高或更低的作品质量?

8. 所以,按这套口径,原问题应该怎么回答?

比较严谨的答案是:

如果「少」指高分作品的绝对数量,那么百合高分作品确实较少;但这主要与百合作品本身的样本基数较小有关。

如果「少」指百合作品进入高分区的概率更低,那么在控制媒介、年代、评分人数和动画平台后,现有数据没有提供稳定的百合高分劣势证据。

因此,不能从「高分百合作品数量少」直接推出「百合作品质量较低」,更不能进一步推出「百合必须依靠某一位作者才能被拯救」。

所有这些结论都只适用于 Bangumi 用户评价和平台标签,不能直接等同于整个市场的客观质量、受众规模或因果关系。

9. 哪些品类最容易出现高分作品?

这里的「容易」指一部作品进入自己所属媒介和年代的高分区的比例,不是说这个品类一定更好。标签可以重叠,一部作品可能同时属于多个品类。

品类样本数原始进入高分率配平后预计高分率与其余作品差异
治愈88630.2%20.3%9.4%
运动28622.4%20.4%9.0%
音乐27427.0%18.2%6.7%
热血80323.7%15.7%4.4%
科幻1,42719.7%15.0%3.9%
日常1,16322.7%14.3%3.0%
百合1,61915.6%12.4%1.0%

从这份样本看,治愈类的原始高分率最高(约 30.2%);控制其他条件后,治愈(约 20.3%)和运动(约 20.4%)都处在前列。音乐、热血、科幻和日常也高于或接近总体水平。这个排名是 Bangumi 社区数据里的关联,不是「题材配方」。

作品例子(帮助建立直觉)

下面只是样本中已经进入高分区的例子,不是官方榜单,也不代表每部同类作品都能达到这个水平。

治愈类

运动类

音乐类

相关内容

近年来百合作品受众群体是否在不断扩大,为什么?如何评价 bangumi 这个评分网站的水平?从女女关系到百合类型:四个平台画出不同的百合地图‘浓’在哪里,‘纯’又排除了什么:对‘百合浓度’的一次语义审计


← 返回目录