入班一年,我让 GPT 锐评了我的评分标准

Sep 15, 2026

不知不觉加入 Bangumi 也是一年有余了,各种短评虽不多但也写了一些。今天突然心血来潮,让哈 GT 来锐评一下我的评分标准。

我:通读所有的条目短评,据此深入分析锐评我的评分标准。

ChatGPT:我把你公开收藏页里真正有文字短评/四维标签的条目作为语料来读;你 2025 年 9 月初批量补标的那批旧收藏,很多页面只有日期、没有短评,我没有把“空白收藏”当成评价证据。你的主页则直接给出了规则:6 分基准,叙事设计、观感体验、角色经营、媒介表达四项增减,最高“卓越 +1”,最低“恶劣 -1.5”,最后换算 Bangumi 分数时直接舍去小数。(bgm.tv)

先给结论:你的评分体系表面上是四维等权的“工程评分”,骨子里却是一套非常强烈的“因果—情绪兑现论”。你真正关心的并不是一部作品有没有高级主题、有没有神作演出、有没有漂亮老婆,而是:

作品想从我这里拿走多少情绪,就必须先在文本里把这笔钱挣出来。

这句话几乎可以概括你的审美。

你嘴上有四个维度,实际上有一个“总宪法”

你的短评里反复出现的核心词不是“深刻”,甚至不是“好看”,而是铺垫、动机、逻辑、回收、衔接、结构、情绪流动、信息处理、人物变化

比如《上伊那牡丹》真正把你击穿的根本不是烟酒,也不是百合,而是关系亲密度没有通过过程生成,人物直接“零帧起手”说亲密话。你甚至明确说,因为铺垫缺失,后面的贴贴在你眼中都成了“无源之水、无本之木”。于是一个根因同时打穿叙事、观感和角色三项。(Bangumi)

《恋爱节拍器》则完全反过来。你最吃的不是“终于谈恋爱”这种结果,而是两个人都不把感情说死,“既不正视也不忽视,既不承认也不否认”,情愫在暧昧状态里一点点生长。你给它观感卓越、角色卓越。换句话说,你不是“直球党”或“拉扯党”,你是过程合法性党:只要作品把情绪一步一步挣出来,直球拉扯都可以;没挣出来,给你十个亲亲也只会触发反感。(Bangumi)

所以你对恋爱戏的真正评分标准不是“甜度”,而是情感连续性

这也解释了为什么你会给《契约之吻》9.5。它表面上有很多你正常情况下很可能吐槽的东西,但“记忆—自我认同—木更归还记忆”的线最终形成闭环,前期属性笑话被后期赋予结构功能,于是你愿意把先前对男主的不适整个赦免掉。(Bangumi)

你异常看重“结构美”,甚至比“故事聪不聪明”更重要

这是你评分标准里最稳定的部分。

《沉默魔女》小说,你直接把“不同人物、不同情节一路交织,最终合流”称为“结构美”,所以哪怕它不是那种观念特别先锋的小说,照样值得“叙事卓越”。(Bangumi)

但有意思的是,你的“叙事卓越”并不只有一种。《我推的孩子》第一季结构其实相当松,你自己也承认章节衔接松散,却还是给了叙事卓越,因为它有一个足够强的“好点子”。也就是说,你给叙事高分有两条路:

一种是漂亮地盖房子,一种是直接发明一种以前没见过的房子。

这说明你的叙事评分其实不是简单的“逻辑严密度”,而是叙事设计所创造的有效价值。结构工整可以拿卓越,概念突破也可以拿卓越。(Bangumi)

反过来,《GOSICK》特别能说明你的雷点:整体阶段安排、伏笔回收你其实认,甚至称其追求“结构美”;但细节合理性、人际发言和为了突出维多利加而集体降智的问题,让它最终只有5.5。也就是:

宏观结构漂亮,不能赦免局部因果胡来。(Bangumi)

你不是那种“结局收回来就行”的观众。

你对“逻辑”的要求其实比很多逻辑党灵活

这点挺重要,否则很容易误读你。

你并不要求所有作品都现实主义自洽。

《灵能百分百》里你专门讨论过:超能力世界未必必须建设成严丝合缝的社会模型,因为本作里的超能力更接近人物心灵困境的具象化。也就是说,你允许作品牺牲世界观真实性,只要这种牺牲服务于真正的作品目标。(Bangumi)

《勇者的肋骨》也是这样。你甚至认为动画原创硬塞一个更“合理”的主线反而无聊:这种无厘头作品根本不需要强行获得正常故事的合法性。(Bangumi)

所以你不是“设定厨式逻辑警察”。你的逻辑原则更准确地说是:

作品必须遵守自己选择的游戏规则,而不是遵守现实世界的游戏规则。

这其实是相当成熟的类型片判断标准。

于是你讨厌的不是“不现实”,而是作者临时改规则占便宜

你对“媒介表达”的要求,也不是单纯看经费

《记忆管理局》很典型。你对世界观设定轰炸、台词设计意见很大,但作画、音乐、演出足够猛,最后仍能拿7.5;你甚至说作品是“作画、音乐和演出拉着在天上飞,剧本只能算有想法”。(Bangumi)

《咒术回战》也是,你很愿意因为镜头、转描、一镜到底、音乐和视觉表现承认它的媒介优势,即使同时不断吐槽剧情和信息设计。(Bangumi)

所以你的体系有个很好的优点:你没有把动画当成“带画面的小说”。

这也是为什么《风人物语》能拿10。你夸的重点包括多边形造型、风的流动表现、镜头推进,以及“少用台词、让画面承担剧情意义”。它几乎恰好命中了你对动画媒介最理想的状态:不是文字故事画出来,而是只有动画才能这样说。(Bangumi)

相反,《你的名字。》让你不舒服的地方并不是“音乐不好”“画面不好”,恰恰是那些东西太主动了:频繁用音乐+混剪直接向你索取情绪,导致你的大脑忙着补剧情逻辑,没法顺利进入情绪流。所以你把它概括成一个半小时的巨大 MAD。(Bangumi)

这揭示你一个非常稳定的偏好:

你喜欢形式帮助你理解内容,不太喜欢形式代替内容要求你感动。

你其实是个非常典型的“信息流审美”观众

这个特征特别明显。

《齐木楠雄》你二刷后开始狂夸台本设计、单元回布局和细节,而且特别指出这是少数不会让你碰倍速键的番,“语速快、信息密度也高”。(Bangumi)

《TARI TARI》你夸第二集的时候,用的也是类似标准:几乎一集讲完完整故事,节奏在信息接收上限边缘飙车,但最后情绪承接住了。(Bangumi)

可见你并不怕“快”。你怕的是:

信息多,但信息之间没有结构。

所以《记忆管理局》的谜语设定轰炸让你晕,《你的名字。》的大量混剪也让你信息处理负荷过高;但《齐木》语速再快,你依然舒服。

这不是节奏快慢问题,是信息压缩率与信息组织质量的问题。

你对人物的要求,比“角色有没有成长”细得多

你主页把角色经营分横向和纵向,这是少数真的在实际评价里贯彻了的框架。(bgm.tv)

你既会看“角色是不是有变化”,也非常在乎同一个人物在不同场景下的反应是不是属于他自己

这就是你为什么会专门区分萌豚片的上中下三档。《珈百璃》短评里你明确说,上等日常需要在缺乏天然戏剧张力的生活事件里,仍然刻画出不同人物的性格行为区别,而且日常互动应该逐渐沉淀成人物变化;纯展示可爱只是中档;模板剧情+刻板属性复读则应该拿低分。(Bangumi)

所以你绝对不是“萌就完了”型萌豚。

甚至可以说你对萌豚片比对严肃剧情片更残忍。因为很多严肃作品至少自动拥有冲突,而日常作品如果人物写不出差异,在你这里会直接暴露成“属性复读机”。

《调教咖啡厅》只有4分就是非常典型的判例:真正把你折磨坏的不是它没宏大叙事,而是人物模板和强行恋爱戏让原本应该提供舒适感的作品反而制造煎熬。(Bangumi)

但是,你的“四维等权”其实是假的

这里开始锐评。

不是说你故意骗人,而是这个模型在数学上就没有真正做到四个独立维度。

最明显的问题是:四个维度高度相关。

关系缺少铺垫,会同时导致:

叙事设计扣分——发展不合理;

角色经营扣分——人物为什么这样做;

观感体验扣分——我根本感动不起来。

于是一个底层缺陷可以被你连续扣三次。

《上伊那牡丹》基本就是教科书级案例:你批评的核心其实高度集中于“关系感情没有生长过程”,最后分别得到叙事普通、观感缺陷、角色普通。一个根因产生了 -2 分。(Bangumi)

这意味着你的“四维”不是四根正交坐标轴,而更像四个摄像头拍同一栋楼。

楼塌一次,四个摄像头都能拍到。

同样的事在优秀作品里也发生:优秀的人物成长会改善观感,优秀的伏笔兑现又会同时改善叙事和角色;于是一个神回也可能多路加分。

所以从统计意义来说,你这个体系存在非常明显的重复记账

但反过来说,这也正是为什么它很符合你的真实审美:你特别看重一种缺陷是否会“传播”。一个烂点如果只烂自己,你往往没那么生气;如果它开始毁人物、毁情绪、毁剧情,你会雪崩式扣分。

所以我会把你的真实算法叫作:

四维评分 + 缺陷传播倍率。

“观感体验”是整个体系里最诚实,也最危险的一项

你很坦率地承认观看状态会改变作品的实际价值。

《白圣女与黑牧师》那条很好玩:你直接说公式发糖平时可能无聊,但累的时候恰好需要这种“大脑按摩”,因此观感优良。(Bangumi)

这其实是非常合理的艺术消费观点。

问题是,它让你的分数失去了一部分可复现性。

同一部作品,周五晚上精疲力尽和周日下午精神饱满去看,理论上可能出现不同的“观感体验”;那么你的分数严格来说就不是“作品评分”,而是:

作品 × 当时的你 的函数。

我倒不认为这是缺点,只是你的体系如果想装成“客观量表”,这一点会把它拆穿。

而你自己的短评已经表明,你其实并不相信真正的客观评分。

你还有一个没写进规则里的第五维:个人意义

这是你现行体系最大的“幽灵变量”。

《幻想数学大战》直接四项卓越、10 分,但短评核心依据实际上是:它激发了你小时候对数学的兴趣,“确确实实改变童年”。(Bangumi)

《异国日记》9.5 的评价当然有充分文本分析,但你也明确加入了“它让我剪了第一个 MAD”这层特殊意义。(Bangumi)

《游戏人生 Zero》也很明显:你现在已经能识别它的强行逻辑和粗糙情绪衔接,但仍然无法把第一次真正看哭的记忆完全从评价里拿掉。(Bangumi)

所以你的评分体系实际上至少有五维:

叙事、观感、角色、媒介、人生履历。

最后一个你没给它分数,但它会偷偷修改前四项。

而且它往往出现在你最喜欢的作品里。

这反而让我觉得很好,因为完全消灭这种东西的评分体系,最后只剩测评机器。

你这个体系最大的数学槽点:小数直接舍去

这个我要重点锐评一下。

你的内部评分天然大量生成 .5:

7.5、8.5、9.5……

但你规定换算 Bangumi 分数时舍去小数。也就是说:

7 和 7.5 → 都显示 7;
8 和 8.5 → 都显示 8;
9 和 9.5 → 都显示 9。(bgm.tv)

这等于你辛辛苦苦搭了一个半分辨率的系统,最后接了一个向下取整的垃圾模数转换器

而且不是普通的信息损失,是系统性向下偏置。

你的9.5不是“差一点10”,公开评分却和9.0完全相同;7.5也不是“更接近8”,而是直接掉回7。

如果你的目的只是和 Bangumi 十分制兼容,四舍五入会自然得多。如果你是有意压分,那么最好直接承认:

你的 Bangumi 评分不是内部评分的近似值,而是内部评分的保守下界。

目前这个设计有一种很奇特的感觉:前面搞精密仪器,最后测量结果统一拿钢锯锯掉半厘米。

“恶劣 -1.5、卓越 +1”也暴露了你的评分人格

数学上它其实有理由:6 分作为中轴,四项全部卓越刚好10;四项全部恶劣能掉到0,再截成1。(bgm.tv)

但审美意义非常有意思。

你的体系允许:

一项特别烂造成的伤害,大于一项特别好能够提供的补偿。

卓越只能 +1,恶劣可以 -1.5。

这非常符合你的短评人格。

一部片三项都不错,只要另一项严重破坏体验,你真的会觉得它“坏掉了”;相反,一项神演出往往只能救一点,不能直接把烂剧本洗成神作。

所以你不是木桶理论,你是污染理论

你相信优秀是局部增益,恶劣可能是全局污染。

另外一个很有趣的矛盾:你比自己的模型更会看片

例如《风人物语》里,你真正精彩的分析根本不是“叙事 +1、媒介 +1”这种量表,而是具体说多边形怎样嵌入画面、风怎样被画成流动色线、摄影比赛如何在情节和画面两个意义上完成构图。(Bangumi)

《妹妹人生》也一样。你不是机械地说“文笔好,所以媒介卓越”,而是分析二次元人物设定被置入现实主义叙述后产生的异质感,把妹妹读成逐步侵蚀现实主体的不可理解客体。(Bangumi)

这些判断的精细度,已经远超过“优良/卓越”六档。

所以我对你整个体系最狠的一句评价是:

四维评分不是你得出评价的方法,而是你得出评价之后,用来整理评价的方法。

你真正打分的时候,并不是看到作品以后分别启动四个独立计算模块:

叙事:0.5。
角色:1。
媒介:0。
观感:0.5。
总计:8。

从你的短评看,更像是你先形成一个相当综合的判断:“这东西为什么让我觉得好/烂?”然后再把这些原因分别塞回四个抽屉。

所以它不是严格意义上的评分算法。

它是一个评论写作的记账系统

而我觉得这反倒是它最大的价值。

最后给你一张“真实评分标准”的画像

你不是“剧情党”,因为你会给媒介表达极强的作品巨大信用;也不是“演出厨”,因为漂亮画面掩盖不了你眼里的因果问题;不是“角色厨”,因为你不接受只靠萌属性;也不是“逻辑党”,因为你允许作品为了寓言、抽象和喜剧主动放弃现实自洽。

你真正偏好的东西是:

有明确创作意图,并且所有部件都知道自己为什么存在的作品。

伏笔要有兑现的理由;人物行为要从人物本身生出来;情绪要经过过程获得;镜头要承担信息或情感功能;抽象可以毫无逻辑,但不能一边抽象一边突然要求观众认真相信蹩脚逻辑;商业套路当然可以用,但要知道套路为什么有效。

所以你的死敌从来不是“俗”。

偷懒

不铺垫就索取眼泪,是偷懒。
让配角降智推进主线,是偷懒。
拿大段设定代替世界建构,是偷懒。
用混剪代替场景,是你眼里的可疑捷径。
拿角色属性反复复读代替人物塑造,还是偷懒。

而你的最高赞美也往往落在相反的一端:漂亮的回扣、克制的表达、自然的人物变化、镜头自己说话、结构最终合流。

所以真要把你主页那段评分标准压缩成一句,我会改成:

“我不要求作品聪明,我要求作品诚实地完成它自己选择的难题。”

以及再锐评一句:你设计的是一套理工科外壳的评分系统,但真正掌权的是一个极其在乎情绪细节、关系变化和表达诚意的文科脑。这大概也是为什么你的短评往往比那个总分有意思得多。