WriterMate 如何分析趋势

我们公开全部采集范围与计算方式,以便区分哪些是各平台的原始数据,哪些是 WriterMate 自行计算与解读的结果。

1. 数据采集

直接采集各国公开的网络连载榜单页面。不使用需要登录或付费的数据。

采集到的原始数据原样保存。页面上的排名、作品名与封面来自各平台原始数据,占比与变化幅度是 WriterMate 据此计算的结果。

市场平台榜单特点
韩国Munpia周榜国内男性向奇幻与武侠占比较高的榜单。
日本小説家になろう综合评价排行常被视为网络连载原作市场的先行指标。
中国起点中文网月票榜基于付费读者投票,强烈反映付费读者口味。
北美Royal RoadActive Popular英语网络连载社区中连载中作品的人气榜。

2. 采集周期

每周一次,以韩国时间(KST)周一划分周次。页面上的“统计周期”指该周的周一至周日。

若同一周对同一平台采集了两次以上,只采用该周最后一次的结果。

周次 = KST 周一 00:00 ~ 次周周一 00:00(不含)

3. 分析范围

每份快照取排名前 20 部作品作为统计对象。固定上限是为了让每周采集量不同也不影响占比。

长期走势最多累计 12 周。

  • 作品名(原文与韩语)
  • 作者
  • 平台标注的类型
  • 作品简介
  • 标签与关键词
  • 排名及较上周的排名变动

4. 类型分类标准

各平台的类型名称不同。原样统计会导致跨市场比较失去意义,因此采集后统一按 WriterMate 分类标准归一。例如中国平台的“仙侠”与韩国的“武侠”归为同一脉络,仅写法不同的“都市异能 / 都市异能”合并为一。

未匹配归一规则的类型保留原名,不会被强行归入其他类型。

一部作品若有多个类型则各计一次,因此所有类型占比之和可能超过 100%。

类型占比(%) =(带该类型的作品数 ÷ 该周统计作品数)× 100

5. 题材提取标准

题材、主题与背景仅从作品名、简介、标签中直接出现的表述提取。不阅读正文,也不推测未提及的设定。

翻译环节有时会让同一概念在不同周出现不同名称(某周“重生”,下周“重生者”)。原样统计会把改名误判为“新进入”或“骤降”,因此统计前先统一名称。

超过 20 字的句式表述视为说明而非标签,予以排除;同一作品内重复出现的题材只计一次。出现作品少于 2 部的题材视为噪声,从统计中剔除。

  • 主题:复仇、成长、生存、政治、经营等故事主轴
  • 题材:重生、穿越、系统、猎人、觉醒等装置
  • 背景:武林、现代韩国、末世、异世界、地下城等舞台
  • 仅空格或符号不同的写法视为同一标签
  • 含义相同的不同词语,只合并预先列入表中的项
  • 页面显示的代表名称取实际数据中出现最多的写法

6. 上升与回落的判定

所有判定仅来自以下计算式。相同数据始终得出相同结果。

判定单位是作品数而非百分比。 每周样本为 10~20 部,一部作品即相当于 5~10 个百分点。仅以百分比为门槛,会把一部作品的替换也判为“有意义的变化”,实际上等于没有噪声下限。

占比(%) =(带该项目的作品数 ÷ 该周统计作品数)× 100

变化幅度(%p) = 本周占比 − 上一观测周占比

  • 上升与回落:仅当较上一观测周增加或减少 2 部以上作品时才判定。相差一部显示为“维持”,不主张方向。
  • 连续上升周数:每次仅增加一部也计入。单周为噪声,但同方向持续本身即是信号。为避免采集量不同造成的错觉,仅当占比与作品数同向时才计入。
  • 新进入:最近 4 周未曾观测到,本周首次出现,且带该项目的作品达 2 部以上。
  • 共现题材:在带有目标题材的作品中,出现比例达 40% 以上的其他题材。

7. 市场比较方式

以同一周为准,将四个市场的变化幅度并列,只看方向是否一致。

基准市场依所阅读的语言确定。中文页面以中国为首列,日文页面以日本为首列。统计本身与基准市场无关,只是排列顺序不同。

由于各平台排名标准不同,可比较的只有方向。不会将绝对数值并列解读为“哪个市场更大”。

  • 同步上升:2 个以上市场在同一周共同上升(各市场作品增加 2 部以上)
  • 分化:一方上升而另一方回落
  • 基准市场缺席:基准市场榜单为 0 部,仅在其他市场上升

8. AI 的使用与不使用范围

AI 负责什么、不负责什么,已明确区分。

占比、变化幅度等数值不由 AI 生成。 数值仅由第 6 节的计算式得出,交给 AI 的是已算好的、不可更改的输入。

标注为“从作品简介中读出的叙事结构”的区块是 AI 阅读简介后的整理结果,并施加三项机器校验。

因此页面会同时显示依据作品名与依据数量,让读者可自行确认该句基于什么写成。

  • 若引用了输入中不存在的作品,则删除该引用;若无剩余依据,则整项不予展示。
  • 若句中自行生成数值(百分比、百分点、倍数等),则删除该句。允许的数量表述仅限于计数我们提供的作品,如“8 部中的 5 部”。
  • 若校验后无任何表述留存,该项不会出现在页面上。
环节负责内容
翻译与字段整理AI将日文、中文、英文的标题与简介译为韩语,并提取简介中出现的类型与题材表述。
数值计算规则(计算式)占比、变化幅度、连续上升周数、新进入、共现题材、跨市场比较。不经过 AI。
WriterMate 解读规则(句子生成)按既定规则将计算结果转为文字。相同数据始终得出相同句子。
叙事结构判读AI + 校验阅读实际带有上升题材的作品简介,寻找反复出现的故事结构。
题材名称翻译AI + 校验生成各显示语言的题材名称。未通过校验时沿用韩语原文。
依据作品一句话摘要AI + 校验阅读平台简介后用我们自己的话改写的一句话。若照搬 18 字以上原文或出现数字,该句将被丢弃。
题材词典条目AI + 校验(自动发布)仅用我们计算出的素材撰写五个部分。出现素材中没有的数字或标题、泛泛之谈、时间段错误或文体问题时不予发布。条目不逐一经人工阅读。

9. 本分析的局限

以下是本数据无法说明的内容,一并公开以免误读。

  • 各平台排名标准不同(阅读量、评分、付费票等)。因此不能用于比较国家间的市场规模或收入。可比较的只有“同一周内朝哪个方向变动”。
  • 只观测各榜单的上位区间。榜单之外发生的变化无法捕捉。
  • 题材与类型仅从标题、简介、标签中出现的表述提取。不阅读正文,因此简介未提及的设定不会被统计。平台不提供简介时,不会产出叙事结构判读。
  • 为每周一次的快照,同一周内的排名起伏不会体现。
  • 样本规模约为每周 10~20 部(各国榜单公开范围不同)。一部作品相当于 5~10 个百分点,因此不应对细微的百分比差异赋予意义。
  • 采集失败或平台结构变更可能导致某周缺失。此时跳过空缺周,与“上一观测周”比较,并在页面上标注比较基准周。

查看实际分析

按上述标准计算的本周结果可在每周趋势页查看。关于服务整体,请参阅关于页。

每周趋势关于