项目文件夹

文件
2026-07-13 12:29:17 +08:00

10 KiB

Starter Rubric:观点类视频(Opinion-Based Video)— v2 已校准

适用于做 2-5 分钟视频、内容是讲一个观点 / 一个概念 / 一篇文章 / 一种社会现象的博主——总之你的观点本身是产品,画面只是载体。

重要:这份是已校准的 v2 公式 来自一个中文观点视频博主(抖音,25+ 已发样本,T+3d/7d/8d 数据回收完毕)。这是真实生效的版本,不是猜想。完全没数据的新博主请用 opinion-video-zero.mdv0 等权占位)。


v2 综合分公式(已校准

composite = (ER×1.5 + SR×1.5 + HP×1.5 + QL + NA + AB + SAT) / 8.5 × 2.0

每个维度 0-5 整数分。综合分范围 0-10。

权重设定理由:ER / SR / HP 三项 ×1.5,因为情感 / 社会 / 钩子是当前账号最强的传播驱动力。这些权重是凭直觉设定后被数据部分验证的,不是回归拟合——你的账号需要重新拟合。


7 个维度

ER — Emotional Resonance(情感共鸣,权重 ×1.5)

稿子能否在前 30 秒让观众产生一种具体的、能命名的情感?

  • 0 — 纯信息传递;没有情感钩子
  • 3 — 一般共鸣("嗯,我也有过这种感觉")
  • 5 — 锐利、具体、让人不太愿意承认的自我识别。观众心想"这就是我,我之前不想承认"

5/5 anchor:暗恋自欺、家庭义务、内化的失败感——任何让观众认出自己同时微微感到不适的内容。 0 分对照:纯学术陈述、抽象概念论文。

SR — Social Resonance(社会议题共振,权重 ×1.5)

稿子触及一个当下的、有争议的、或结构性重要的社会模式吗?

  • 0 — 纯个人 / 人际层面
  • 3 — 触到一个公认的社会现象(职场动态 / 恋爱 / 家庭),但没加新视角
  • 5 — 命名了一个观众认识但没有语言形容的结构性模式

5/5 anchor:参考博主的"房价/状元"——"学生坠楼 vs 高考状元"的非对称冲击直击阶层 / 教育 / 生命价值三个议题交叉。 0 分对照:纯个人情感(暗恋 / 关系)。

HP — Hook Potential(钩子强度,权重 ×1.5)

前 3 秒能不能逼观众看下去 30 秒?

  • 0 — 通用开场("大家好,今天聊一聊..."
  • 3 — 具体的承诺或反直觉断言
  • 5 — 一个具体生动的场景或断言,观众无法停止处理

不要把 HP 与"猎奇"混淆。一个安静但具体的开场("有些关系不是在某一刻结束的——它们在你还在里面的时候就已经偏移")也可以是 HP=5。

QL — Quotable Lines(金句密度,权重 ×1.0)

稿子里至少 2-3 行能被截图、能作为独立文字单独传播吗?

  • 0 — 全是叙述;没有警句
  • 3 — 结尾有一句令人记住的
  • 5 — 多句独立可用、分布在稿子不同位置(开场 / 中间 / 结尾)

校准 caveat:参考博主的数据显示 QL=5 不在于"金句数量",更接近"每句金句离开视频后还能在评论里 / 截图里 / 朋友的微信里独立存活吗?"——这个细微的定义偏差会被未来的 v2.1 升级吸收。

NA — Narrativity(叙事性,权重 ×1.0

有没有一个可辨识的弧线——铺垫、升级、收束——还是平铺直叙的论点列表?

  • 0 — 列表式结构
  • 3 — 松散的主线
  • 5 — 紧凑的三幕结构,结尾 payoff 在开场就已埋好

对观点视频来说,NA 比对叙事视频重要性低。把它当 tiebreaker 维度,不是主驱动。

校准 caveat:参考博主的数据中 NA 与 HP 部分冗余——v2.1 候选版本里 NA 被砍。在你的账号上单独验证。

AB — Audience Breadth(受众广度,权重 ×1.0)

这个议题的潜在受众有多广?

  • 0 — 极小众(专业圈 / 单一兴趣)
  • 3 — 中等(一类人群)
  • 5 — 普世(暗恋 / 家庭 / 工作)

校准 caveatAB 在参考博主的数据里被发现是误导信号——求职是 AB=5 但分播比 0.96%(最低)。"广"不等于"愿意传播"。v2.1 候选版本会用 TSTopic Shareability)替代 AB。当前 v2 仍保留 AB,因为 v2.1 还在验证

SAT — Satire Depth(讽刺深度,权重 ×1.0)

稿子用了多层反讽 / 戏仿格式 / 自指嘲讽吗?

  • 0 — 真诚直陈
  • 3 — 一层反讽
  • 5 — 嵌套或自指反讽(例如,一篇关于某现象的稿子,用那个现象的格式写出来)

如果你的频道走真诚路线,SAT 给 3 当占位,不要让它影响排序。如果你的频道走戏仿路线,这个维度重要。

5/5 anchor:参考博主的"房价/状元"——三层反讽(虚构国框架 + 学术论文形式戏仿 + 致谢段自我指涉)。


v2.1 候选维度(未升正,仅供探索)

下列两个维度在参考博主的数据上展示了独立预测力,但还没通过完整的升级验证流程。你不要在自己起步阶段直接用这两个维度——风险大于收益。

MS — Memetic Shareability(模因可挪用性)

观众能复用作者的句式吗?

5/5 anchor:参考博主"停止期待"中的「她不一样」/「他不一样」模因——观众主动套用句式自嘲,2266 赞独占榜首,全文出现 12+ 变体。 0 分对照:金句被原样引用但不被挪用造句——参考博主"谁问你了"中的「无需求信息供给」362 赞独占但只能引用。

为什么重要:被引用的金句驱动单次传播。可挪用的模板驱动生成式传播——评论本身变成表演,每次表演都是免费的传播。

TS — Topic Shareability(议题分享冲动)

观众转发这条视频,转发本身会不会暴露 ta 不想暴露的处境?

  • 1 — 转发等于承认一件痛苦或被污名化的事(求职、被冒犯、最近分手且熟人能猜出对象)
  • 3 — 转发是中性的
  • 5 — 转发本身就是表演(集体吐槽 / in-group 黑话 / 价值观站队 / 安全的自嘲)

为什么重要:议题广度 ≠ 流量。一个"普世"但社交暴露的议题(如求职)跑不过一个"小众"但分享安全的议题(如吐槽老板)。Shareability 才是约束变量,不是 breadth

如果你想试 v2.1:跑完 5 篇 v2 校准 + 主动收集 MS 和 TS 的"试评分"作为候选维度数据。证据足够(≥3 样本支持)后通过 /cheat-bump 走完整升级流程。


Bucket 预测(仅适用于已有粉丝基础的校准期用户

⚠️ 新人不要用这套绝对桶。0 粉账号的视频典型在 100-1000 播放区间——照搬下表会让所有预测都落"底部 99%"。 Cold-start 用户请用 opinion-video-zero.md比率桶方案。 Calibration 用户(≥5 篇有数据)由 /cheat-init 询问 baseline 后自动派生。 下表是"参考博主"(中文抖音观点视频,~1w 粉,25+ 已发样本)的实际拟合——不是普适常量

不要预测一个具体数字。预测一个 bucket + 概率分布。

Bucket 范围(万播放) 参考博主的先验概率
底部 <5w 5%
基础盘 5-30w 35%
命中 30-100w 45%
爆款 100-150w 12%
现象级 >150w 3%

重要:按你的账号自己的 percentile 设 bucket 边界。你的"爆款"可能是 5w(参考博主级别)或 5k(新人级别)或 500w(大 V)。直接照抄上表的人会得到永远偏高 / 偏低的预测。

校准过 ≥5 篇后跑 /cheat-bump --bucket-only 让系统基于你的实际分布自动派生。

每次预测要给:

  • 最可能的 bucketheadline call
  • 中枢(你在那个 bucket 内的点估计)
  • 所有 bucket 的概率分布(必须加起来 100%

T+N 复盘窗口

默认:T+3d

为什么 3 天而不是 5 / 7

  • 大多数短视频平台的算法分发决策在 72 小时内基本结束
  • 等更久会引入噪声(缓慢长尾、二次推荐)不增加信号
  • T+3d 让你能每周跑一次校准循环,rubric 保持响应速度

只有在你有证据证明自己平台行为不同的时候才覆盖。覆盖记得写进 rubric_notes.md


Anchors(锚点样本)

打分新稿时,找 2-4 个 composite 接近的旧样本,列出它们的实绩。锚点对比能抓出公式抓不到的错误

锚点集是你边发边攒出来的。在你有 ≥5 篇校准过的作品之前,锚点不可用——这是正常的。Cold-start 期跳过锚点对比,但要在预测文件里标 锚点对比:N/Acold-start


这套 rubric 注定会打错的地方(已知 limitations

参考博主的数据暴露的失败模式。在你自己的数据里也要警惕:

  1. 时长:rubric 里没有任何维度捕捉稿子时长。4 分钟稿要付出完播率代价。完播率单独追踪
  2. 议题时效 / 平台情绪:算法偏好会变。上个月被推的话题这个月可能被压
  3. 概念密度:一个稿子里塞太多自创术语(4 个以上缩写、多个框架)压缩理解负担、伤完播率。当前 rubric 没惩罚这个
  4. MS / TS 的相互作用(v2.1 候选维度):两者独立看可能 OK,但真正爆款需要两个都 ≥4。单维度极致很少够

打分速度 cheat sheet

打新稿的分时给自己定个时间。重点是给一个能被复盘的判断,不是写论文。

  • 每个维度 30 秒是合适的节奏。如果某个维度让你想超过这个时间,你在合理化,不是在打分
  • 相信你的第一个整数。如果你在 3 和 4 之间反复横跳,写 3 + 一个备注。打 5 次以后 rubric 会告诉你是不是系统性偏低
  • 打分前不看锚点。如果你打分前先查"停止期待打了多少分",你已经被锚定了。先盲打,再对比

cheat-on-content 子 skill 的对应

这份 starter rubric 被以下 skill 读取:

  • /cheat-init cold-start 模式 → 默认复制本文件到 rubric_notes.md(如选择 calibration 模式且 mode 决定能用 v2 公式)
  • /cheat-score/cheat-predict → 读 rubric_notes.md 拿当前公式
  • /cheat-bump → 这份 starter 是 bump 的"先验起点",bump 后被替换为用户自己拟合的版本