〇、先说一个让人不太舒服的观察#
这几天读了一批围绕”博士该不该读""学历还值不值”的高传播文章。看完之后最刺眼的不是观点对错,而是它们的证据形态。
有一类是这样的:标题写”资深博导视角”,正文以”凌晨一点多,一位博士生给我发来一条消息”开头,接着是四类压力、五步方法、七天计划。通篇没有具名的人、没有样本、没有一处可核的出处——“资深博导”这个标签后面是空的。
另一类是你在社交平台上随手就能刷到的真东西。比如一个人把 Origin 自动化做成了一个 Skill,README 里写着:
“遇到把握不足的数据,EditaPlot 会把不确定的列单独列出来请你确认,不会擅自补列、拟合或推断结论。” “我不希望它只是一套’替换数字’的静态模板,也不会让 Python 预览图冒充 Origin 成图。” “只要源文件、列映射或理解结果发生变化,这次确认就会失效,需要重新核对。”
这两段话放在一起,答案就出来了。
前一种在借身份说话——博导、博士、过来人;后一种在交底说话——我能做什么、不能做什么、什么情况下我的结论作废。
学历之所以曾经有用,是因为它是一种被别人替你签发过的交底。 而现在签发方(学校)和接收方(雇主)对同一张文凭的理解已经脱钩了——本博 9-25 那篇算过这笔账:企业要的不是更高学历,是更早被验证过的能力;而”验证”很贵,所以它先买了最便宜的那个代理指标。
于是问题变成:在没人替你签发的情况下,你自己怎么交底?
一、这里有个前提错误,必须先纠正#
大多数人一想到”证明自己”,第一反应是把简历写厚:多一段实习、多一个奖、多一个头衔。这在 AI 时代恰好是最无效的方向——因为这些东西现在都能被生成。
真正的分界不在”多少”,而在”可不可复核”。
| 不可复核 | 可复核 | |
|---|---|---|
| 典型形态 | “资深博导视角""有多年经验""参与过某项目” | 仓库、许可证、提交历史、评审记录、边界声明 |
| 谁能验证 | 只能信你 | 任何人都能自己去看 |
| AI 能否伪造 | 能,且成本近零 | 伪造要付出持续维护的代价 |
| 时间久了会怎样 | 越来越不值钱 | 越来越值钱(因为要有人真的维护它) |
所以第一个要改的观念是:你不是在”证明自己很行”,你是在留下别人可以独立复核的东西。
而这里必须分成两件事——它们不能用同一种材料证明。这是本文的主要主张。
二、单兵作战与团队作战:为什么必须分开证明#
这两件事经常被混在一份简历里讲,结果两件都没讲清:
| 单兵作战 | 团队作战 | |
|---|---|---|
| 要回答的问题 | 你一个人能不能把事推到底? | 别人愿不愿意跟你一起干、能不能接你的东西? |
| 证据类型 | 一个完整闭环的作品 | 别人在你作品上留下的痕迹 |
| 最怕的质疑 | “这是团队做的吧?” | “这是你一个人自嗨吧?” |
| 常见误区 | 用”参与过”证明独立 | 用”我很配合”证明协作 |
| 失效方式 | 作品是抄的/AI 生成的一次性产物 | 项目没人用、没人接手 |
关键区别在这里:
- 单兵看”闭环”——从问题到交付,中间那几段最难的部分(定义问题、设计验证、面对失败、承担后果)有没有你一个人的痕迹;
- 团队看”被接手”——你的东西有没有被别人基于它继续做。这一条无法自我宣称,因为接手动作者不是你。
三、单兵作战:一个可核的作品长什么样#
我拿一个真实项目当范本——EditaPlot(hang-jin/editaplot ↗,Apache-2.0,823 stars,2026-07-21 建、2026-10-02 仍在更新)。
它做的是:你把实验数据交给它,它逐列理解用途、推荐图形、请你确认图形元素、调用 Origin 并验证结果,最后生成可编辑的 OPJU 并导出 PNG/PDF/TIF。
注意它的执行成本与技术含量都不是重点。重点是它的作者把”我做不到什么”写成了条款:
| 作者写了什么 | 这证明了什么 |
|---|---|
| “不会擅自补列、拟合或推断结论” | 知道自己的能力边界在哪,并且用代码约束自己不越界 |
| “不会让 Python 预览图冒充 Origin 成图” | 拒绝用看起来对的东西冒充真东西——这是科研诚信的核心动作 |
| “只完成了 Windows 10/11 x64 实体电脑验证,V1 暂未提供 macOS/Linux/WSL/虚拟机版本” | 主动声明未覆盖的范围,而不是等别人踩坑 |
| “只要源文件、列映射或理解结果发生变化,这次确认就会失效,需要重新核对” | 知道自己的结论有前提,前提变了结论作废 |
| “我不会替你安装或修改 Origin” | 划清责任边界——不越权替使用者做决定 |
这五条合起来,恰好就是本博反复在写的”完整闭环”:定义问题(数据列到底该不该画)、设计验证(调用 Origin 后验证结果)、面对失败(把握不足就停下来问)、承担后果(确认失效要重新核对)。
而它同时满足三个可核条件:
- 有人名与主体——仓库作者可追溯;
- 有许可证——Apache-2.0,别人可以合法使用、修改、分发;
- 有维护痕迹——创建到最近更新跨了两个多月且仍在动。
反过来说,一个”作品”如果没有人名、没有许可证、没有更新记录,它就不是作品,只是一张图。
一个更硬的范本:figures4papers#
另一个例子更极端——Chen Liu(刘晨)的 figures4papers ↗:7,961 stars / 551 forks,2025-04-29 建、2026-09-26 还在更新,README 第一行就自报身份(耶鲁 CS PhD Candidate),并写明这些图用在 Nature Machine Intelligence、ICML、NeurIPS、ECCV。
它证明的不是”我会画图”,而是”我把画图这件事沉淀成了一套别人能用的方法”。 这一点差别很大:
- 前者是一次性劳动,做完就没了;
- 后者是可复用的资产——而资产才有资格当证据。
四、团队作战:证据不在你的陈述里,在别人的动作里#
这是最难自证的一项,也最容易造假。核心困难是:协作能力天然无法由一个人自己证明。
所以判断标准要换成一个你无法单方面制造的东西:有没有人基于你的东西继续做。
回到 EditaPlot,它的仓库生态里出现了这些(都能自己查到):
| 衍生项目 | 做了什么 |
|---|---|
doubaoplot | 基于 hang-jin/editaplot 二次创作,增加 45 图可点选择器 |
editaplot-dsh | 为它做平台适配(注明是 Apache-2.0 衍生) |
editaplot2026 | 为它做 Origin 2026(10.30)兼容性修复 |
这三件事没有一件是作者自己做的。 有人愿意读你的代码、改它、修它、在别人的项目上再建一层——这是协作能力唯一无法伪造的证据形态。
同理,团队协作的留痕还有这些形式(都是可公开核查的):
| 留痕 | 它证明什么 | 为什么难伪造 |
|---|---|---|
| 你的 PR 被合并 | 你的改动通过了别人的审查 | 审查者不是你 |
| 你评审了别人的 PR | 你有判断力,且愿意为别人的代码负责 | 评审记录带时间与身份 |
| issue 里的讨论 | 你能把问题说清、能被说服、能修正 | 对话是双向的,截图截不出全貌 |
| 别人在你的项目里提 issue 并被你处理 | 你在维护一个别人依赖的东西 | 需要持续投入 |
| 你的项目被引用/被用作依赖 | 你的产出有下游 | 下游不由你控制 |
注意这一列的共性:每一项都有另一方参与,而那一方不是你。 这就是为什么”团队作战”没法靠自述——自述里永远只有一个人。
一条硬边界:贡献量是坏指标#
必须说清一件事,否则上面这套会被用歪:commit 数、代码行数、stars 数都不是能力指标。
- commit 数可以被拆碎刷出来(把一次改动拆成二十次);
- 代码行数可以是 AI 生成的(本博 10-02 那篇核到过一组数据:低经验者用 AI 写码,提交量是 2.15 倍,但收到的评审意见是 4.52 倍、PR 接受率低 31%、滞留时间5.16 倍);
- stars 会受曝光与时机影响,含光环成分。
能作为证据的不是量,而是”别人对你的产出的反应”——评审意见、是否合并、是否被接手、是否被依赖。量是你自己造的,反应是别人给的。
五、一份可自检的证据表#
把上面两条合起来,你可以直接拿这张表检查自己手上的东西:
单兵作战自检(要求每条都能被第三方独立查到)#
- 有一个完整闭环的作品:从”我要解决什么问题”到”交付了什么”,中间包含一次失败与修正
- 作品有人名或可追溯主体,不是匿名产出
- 有许可证,别人可以合法使用
- 有边界声明:明确写出”我没验证什么""什么情况下我的结论不成立”
- 有维护痕迹:不是一次性发布,后续有更新
- 能回答:这个作品里,哪一个关键决定是我做的?证据在哪?
最后一条是分水岭。 如果每个环节你都能说”是 AI 做的/是跟着教程做的/是师兄给的”,那这个作品不能证明单兵能力——它只证明了你能用工具。
团队作战自检(要求每条都指向一个”非你”的参与者)#
- 有被合并的 PR(审查者不是你)
- 有你写的评审意见(你为别人的代码负过责)
- 有别人基于你的项目做的事:衍生、适配、修复、依赖
- 有别人提的 issue 且被你处理
- 有公开的双向讨论记录(你能被说服、能改结论)
- 能回答:谁因为我的东西少走了一段弯路?
这两张表刻意设计成不能互相替代:单兵表里没有一条需要别人同意,团队表里没有一条能由你单独完成。
六、为什么”边界声明”比”成果展示”更能证明能力#
这一节是本文最想留下的东西。
回到 EditaPlot 那段话——“不会擅自补列、拟合或推断结论”。这句话的价值不在技术,在于它同时证明了四件事:
- 他知道这类工具最容易在哪翻车(数据列用途不明时自动猜);
- 他承认自己会翻车(所以把不确定的列挑出来问);
- 他愿意为此增加摩擦(多一步确认,牺牲流畅度换正确性);
- 他把这个约束写进了产品(不是写在博客里,是写进代码)。
而一个只会说”我的工具很强大”的人,这四件事一件都没证明。
这个逻辑可以推广成一条通用判据:
看一个人怎么处理”我不确定”这件事,比看他怎么展示”我做到了”更能判断能力。
因为”做到了”可以被生成、被包装、被借用;而”我知道自己哪里不确定、并且愿意为此停下来”,只能来自真实的动手经验——你得先撞过墙,才知道墙在哪。
同一批材料里,这个对比非常清楚:
| 借身份型 | 交底型 | |
|---|---|---|
| 怎么建立可信度 | “资深博导视角""博士过来人” | 写清验证范围、兼容版本、失效条件 |
| 遇到不确定 | 给一个更肯定的结论 | 停下来问,并说明为什么停下来 |
| 时间久了 | 越来越像套路 | 越来越被信任(因为反复被验证) |
七、但开源本身也在被污染:一个必须自己拆掉的反驳#
写到这里必须停一下,因为上面这套推论有一个明显的漏洞:
你说”作品能证明能力”——可作品也能被买、被 AI 生成。有钱的人用 AI 写一个项目并不难,写得对不对也未必看得出来。那它凭什么叫证据?
这个反驳成立,而且它指向的正是本文的核心逻辑:如果”作品”也变成了一个便宜的代理指标,那它就会重走学历和论文的老路——先被滥用,然后贬值,最后被招聘端打折处理。
所以不能只说”去做作品”,必须说清楚作品里哪一部分不能被买。
可以买到的,和买不到的#
| 能被买到/生成 | 买不到 |
|---|---|
| 代码本身 | 它在真实输入下的运行结果 |
| README 的漂亮程度 | 作者主动写下的”我没验证什么” |
| star 数(可以刷/可以运营) | 别人基于它做的衍生工作 |
| 一次性发布 | 持续维护的历史与对 issue 的回应 |
| 功能清单 | 边界条件与失败记录 |
这条分界线可以概括成一句话:
能被一次性生产出来的,都不构成证据;需要持续投入才能维持的,才构成证据。
代码是一次性产物,所以它可以被买。但”这个项目在别人手里跑了半年、被三个人提过 issue、被一个人改写适配到另一个平台”——这个状态需要时间,而时间买不到。
还有一层必须坦白说清:就目前能查到的范围,开源作为招聘信号,主要适用于偏应用型的岗位(工程、数据、算法这类能把作品直接跑起来看的岗位);在多数其他场景里,它的权重有限,也没有可靠数据能说明它到底占多少。本文不打算把它说成比它实际更强的通行证——那会是本文开头批评的同一件事,只是换了个标的。
EditaPlot 里那段话,恰好就是这个机制#
回到那个项目中作者写的一句(前面引过,这里要再读一次它的另一层意思):
“只要源文件、列映射或理解结果发生变化,这次确认就会失效,需要重新核对。”
这句话的潜台词是:作者不信任”确认”这件事本身。 他知道使用者会换数据、会改列映射、会沿用上一次的结论——所以他把复核写成了一道会失效的关卡,而不是一个可以点一次就永久生效的按钮。
这是一种极其罕见的工程习惯:默认”我的输出会被误用”,所以用程序去防它。
而这恰恰是买不来的。 一个为了通过面试而生成的项目,不会去处理”半年后使用者换了输入却沿用旧结论”这种问题——因为这个问题只有真正被人用过、或者作者自己踩过坑,才会被想到。
所以判断门槛要往上抬一层#
如果你是一个在看别人作品的人,顺序应该是这样:
- 先看它有没有被用过——issue、PR、衍生项目、被依赖;
- 再看作者写了什么边界——他承认自己哪里不确定;
- 最后才看代码质量。
第 3 步排最后,不是因为它不重要,而是因为它最容易被伪造。
八、招聘端的二次判断:论文不再被看,然后是”看你的论文发在哪”#
上面说的贬值,已经不只是理论。它已经变成了制度。 而这一节的证据链很完整,值得完整写一遍。
第一步:论文作为信号被污染#
2026 年发表于 Scientometrics 的一项研究(基于 Retraction Watch 数据库)给出了目前最大规模的描述:2016—2024 年共有 10,409 篇论文工厂文章被撤稿,其中中国作者占 87.8%(9,137 篇);2023 年一年就有 6,780 篇(前一年 956 篇,近七倍)。学科分布也在迁移——从生物医学转向计算机科学(计算机科学占比约 39.3%),主题词从 cells、cancer、microRNA 变成 model、data、algorithm、learning。期刊类型上,开放获取占 80.8%,订阅制仅 0.4%。
(该研究自己给的限定必须一起引用:绝对数量受各国科研体量、数据库覆盖与调查报告实践差异影响,不能直接解读为”某国论文工厂发生率最高”。)
而监管侧的动作是明确的:2026 年 9 月 29 日,科技部副部长邱勇在国新办发布会上表示,科技部会同有关部门持续打击买卖论文等违规行为,同时处理购买论文的科研人员,以及售卖论文的经营主体和网站、网店,并公开通报典型案例(新华社 ↗)。
第二步:为什么同行评议自己清理不了它#
这是整条链上最容易被忽略的一环。同行评议审的是”说得通不通”,不是”跑不跑得起来”。
这个判断有一份直接实验支持——Management Science 2024 年发表的研究,动用 700 多位评审者,尝试复现该刊近 500 篇文章(DOI ↗):
| 口径 | 结果 |
|---|---|
| 2019 年数据与代码披露政策之前 | 仅 12% 的文章自愿提供复现材料;其中 55% 能(基本)复现 |
| 披露政策之后,且数据可得性不构成障碍时 | 超过 95% 可完全或大部分复现 |
| 但 29% 的文章有部分数据评审者拿不到 | — |
| 算上全部样本 | 复现比例降到 68% |
失败的原因是工程性的:代码缺失、代码报错无法解决、文档太弱或没有、软硬件要求与代码复杂度。
把这组数字读一遍就明白了:让复现率达到 95%,前提是有人真的去跑——而那 700 位评审者不是同行评议的常规配置,是一次专门研究的人力投入。
换句话说:论文的验证成本从来没有被评议环节承担,它被推给了下游——谁引用谁承担,谁复现谁自费。而下游通常的选择是:不复现。
第三步:于是招聘端改用”期刊 + 作者结构”做判断#
当论文不再能证明能力,而验证又需要自费去做时,筛选方就会启用更便宜的代理指标。这次它们用的是期刊黑名单。
制度链条是清楚的:
- 2018 年,国务院办公厅《关于进一步加强科研诚信建设的若干意见》明确:支持相关机构发布国内和国际学术期刊预警名单;“对在列入黑名单的学术期刊上发表的论文,在各类评审评价中不予认可”;
- 2020 年起,中国科学院文献情报中心发布《国际期刊预警名单(试行)》并持续更新,已成为高校制定校内预警制度的主要参考依据;
- 高校落地:珠海科技学院明确,预警清单内期刊论文”在项目评审、评奖、人才推荐、职称评审等各类评审评价中,一律不予认可”,并作为评奖评优的负面评价因素;沧州交通学院提示,黑名单期刊论文不予认可,且不得报销论文发表费用。
而各校”负面清单”的判定特征,几乎就是论文工厂的画像(据高校公开口径整理):同一期刊同一期刊登 50 篇及以上;一篇论文少于 5000 字;存在版本较多(学术版/普及版/大众版);刊期过密(除核心期刊外,周刊、旬刊一律列入);付费即可发表或对质量无要求。
这就是你观察到的那件事的制度版本:一旦某类期刊被证明是论文工厂的主要出口(回想上面那组数:开放获取占撤稿 80.8%、订阅制 0.4%),筛选方就会用”期刊 + 作者结构”这种粗糙但便宜的启发式来判断——而代价由那些在这类期刊上正常发表的人承担。
这和第一学历歧视是同一个机制:当准确信号太贵时,就用便宜的代理指标替代。 上一次被替代的是”能力”,这一次被替代的是”论文”。
而要小心的是方向:从”论文不算数”滑到”这个群体的人不算数”,就是从一个错误跳进另一个错误——本博 10-02 那篇里已经拆过一次:用群体属性替代个体事实,无论听起来是褒是贬,都是歧视的定义。
九、边界:这套方法在哪里不适用#
必须说清楚三件事,否则这篇文章会变成它自己批评的那种”万能方案”。
第一,开源作品只在”能力可被公开验证”的岗位上有效。
工程、数据、算法类岗位,作品可以直接被看、被跑、被评。但执照型职业不适用——医生、律师、教师、注册工程师的能力必须由制度认证,不存在”我开源一个手术记录”这种路径。把开源作品当成万能通行证,是另一方向的以偏概全。
第二,“没有作品”不等于”没有能力”。
很多人所在的岗位根本不允许公开产出:涉密项目、内部系统、客户数据、体制内工作。这类情况下可迁移的形态是脱敏的方法论、可复述的决策过程、经授权的案例说明,而不是硬凑一个开源项目。拿”你有没有 GitHub”当筛选标准,和拿”你本科是不是 985”当筛选标准,是同一种偷懒。
第三,这套方法有它自己的门槛,而且不低。
它要求你能持续维护、能接受公开被质疑、能承受”做了没人看”。这本身就是一种资源——时间、精力、稳定的网络与设备。承认这一点,比假装它人人可及更诚实。
十、收束:从”被签发”到”自交底”#
学历体系解决的是一个真实问题:在有限时间内大规模筛选人。它没有消失,也不该被简单否定——本博 9-21 那篇写过,分类改革要解决的恰恰是”用研究型的尺子量应用型的岗”这种错配。
但它确实不再替你完成”证明”这件事了。
而在它让出的这块位置上,能站住的不是”我更努力”或”我学历更高”,而是两种可被第三方独立复核的东西:
单兵作战,交给别人一个能跑的闭环,并且写清它的边界。 团队作战,让别人在你的东西上留下痕迹——因为你无法替他们留。
这两件事有一个共同点:它们都不能靠说。
留一个问题给你,也留给我们自己:
如果你明天要把手上的东西交给一个陌生人,让他判断你行不行——他能在不看你的简历、不听你解释的情况下,自己查到什么?
那个”他自己能查到的部分”,就是你现在真正拥有的能力证明。其余的,都还只是说法。