BoHuYeShan

Back

〇、先说一个让人不太舒服的观察#

这几天读了一批围绕”博士该不该读""学历还值不值”的高传播文章。看完之后最刺眼的不是观点对错,而是它们的证据形态。

有一类是这样的:标题写”资深博导视角”,正文以”凌晨一点多,一位博士生给我发来一条消息”开头,接着是四类压力、五步方法、七天计划。通篇没有具名的人、没有样本、没有一处可核的出处——“资深博导”这个标签后面是空的。

另一类是你在社交平台上随手就能刷到的真东西。比如一个人把 Origin 自动化做成了一个 Skill,README 里写着:

“遇到把握不足的数据,EditaPlot 会把不确定的列单独列出来请你确认,不会擅自补列、拟合或推断结论。” “我不希望它只是一套’替换数字’的静态模板,也不会让 Python 预览图冒充 Origin 成图。” “只要源文件、列映射或理解结果发生变化,这次确认就会失效,需要重新核对。”

这两段话放在一起,答案就出来了。

前一种在借身份说话——博导、博士、过来人;后一种在交底说话——我能做什么、不能做什么、什么情况下我的结论作废。

学历之所以曾经有用,是因为它是一种被别人替你签发过的交底。 而现在签发方(学校)和接收方(雇主)对同一张文凭的理解已经脱钩了——本博 9-25 那篇算过这笔账:企业要的不是更高学历,是更早被验证过的能力;而”验证”很贵,所以它先买了最便宜的那个代理指标。

于是问题变成:在没人替你签发的情况下,你自己怎么交底?

一、这里有个前提错误,必须先纠正#

大多数人一想到”证明自己”,第一反应是把简历写厚:多一段实习、多一个奖、多一个头衔。这在 AI 时代恰好是最无效的方向——因为这些东西现在都能被生成。

真正的分界不在”多少”,而在”可不可复核”。

不可复核可复核
典型形态“资深博导视角""有多年经验""参与过某项目”仓库、许可证、提交历史、评审记录、边界声明
谁能验证只能信你任何人都能自己去看
AI 能否伪造能,且成本近零伪造要付出持续维护的代价
时间久了会怎样越来越不值钱越来越值钱(因为要有人真的维护它)

所以第一个要改的观念是:你不是在”证明自己很行”,你是在留下别人可以独立复核的东西。

而这里必须分成两件事——它们不能用同一种材料证明。这是本文的主要主张。

二、单兵作战与团队作战:为什么必须分开证明#

这两件事经常被混在一份简历里讲,结果两件都没讲清:

单兵作战团队作战
要回答的问题你一个人能不能把事推到底?别人愿不愿意跟你一起干、能不能接你的东西?
证据类型一个完整闭环的作品别人在你作品上留下的痕迹
最怕的质疑“这是团队做的吧?”“这是你一个人自嗨吧?”
常见误区用”参与过”证明独立用”我很配合”证明协作
失效方式作品是抄的/AI 生成的一次性产物项目没人用、没人接手

关键区别在这里:

  • 单兵看”闭环”——从问题到交付,中间那几段最难的部分(定义问题、设计验证、面对失败、承担后果)有没有你一个人的痕迹;
  • 团队看”被接手”——你的东西有没有被别人基于它继续做。这一条无法自我宣称,因为接手动作者不是你。

三、单兵作战:一个可核的作品长什么样#

我拿一个真实项目当范本——EditaPlot(hang-jin/editaplot ↗,Apache-2.0,823 stars,2026-07-21 建、2026-10-02 仍在更新)。

它做的是:你把实验数据交给它,它逐列理解用途、推荐图形、请你确认图形元素、调用 Origin 并验证结果,最后生成可编辑的 OPJU 并导出 PNG/PDF/TIF。

注意它的执行成本与技术含量都不是重点。重点是它的作者把”我做不到什么”写成了条款:

作者写了什么这证明了什么
“不会擅自补列、拟合或推断结论”知道自己的能力边界在哪,并且用代码约束自己不越界
“不会让 Python 预览图冒充 Origin 成图”拒绝用看起来对的东西冒充真东西——这是科研诚信的核心动作
“只完成了 Windows 10/11 x64 实体电脑验证,V1 暂未提供 macOS/Linux/WSL/虚拟机版本”主动声明未覆盖的范围,而不是等别人踩坑
“只要源文件、列映射或理解结果发生变化,这次确认就会失效,需要重新核对”知道自己的结论有前提,前提变了结论作废
“我不会替你安装或修改 Origin”划清责任边界——不越权替使用者做决定

这五条合起来,恰好就是本博反复在写的”完整闭环”:定义问题(数据列到底该不该画)、设计验证(调用 Origin 后验证结果)、面对失败(把握不足就停下来问)、承担后果(确认失效要重新核对)。

而它同时满足三个可核条件:

  1. 有人名与主体——仓库作者可追溯;
  2. 有许可证——Apache-2.0,别人可以合法使用、修改、分发;
  3. 有维护痕迹——创建到最近更新跨了两个多月且仍在动。

反过来说,一个”作品”如果没有人名、没有许可证、没有更新记录,它就不是作品,只是一张图。

一个更硬的范本:figures4papers#

另一个例子更极端——Chen Liu(刘晨)的 figures4papers ↗:7,961 stars / 551 forks,2025-04-29 建、2026-09-26 还在更新,README 第一行就自报身份(耶鲁 CS PhD Candidate),并写明这些图用在 Nature Machine Intelligence、ICML、NeurIPS、ECCV。

它证明的不是”我会画图”,而是”我把画图这件事沉淀成了一套别人能用的方法”。 这一点差别很大:

  • 前者是一次性劳动,做完就没了;
  • 后者是可复用的资产——而资产才有资格当证据。

四、团队作战:证据不在你的陈述里,在别人的动作里#

这是最难自证的一项,也最容易造假。核心困难是:协作能力天然无法由一个人自己证明。

所以判断标准要换成一个你无法单方面制造的东西:有没有人基于你的东西继续做。

回到 EditaPlot,它的仓库生态里出现了这些(都能自己查到):

衍生项目做了什么
doubaoplot基于 hang-jin/editaplot 二次创作,增加 45 图可点选择器
editaplot-dsh为它做平台适配(注明是 Apache-2.0 衍生)
editaplot2026为它做 Origin 2026(10.30)兼容性修复

这三件事没有一件是作者自己做的。 有人愿意读你的代码、改它、修它、在别人的项目上再建一层——这是协作能力唯一无法伪造的证据形态。

同理,团队协作的留痕还有这些形式(都是可公开核查的):

留痕它证明什么为什么难伪造
你的 PR 被合并你的改动通过了别人的审查审查者不是你
你评审了别人的 PR你有判断力,且愿意为别人的代码负责评审记录带时间与身份
issue 里的讨论你能把问题说清、能被说服、能修正对话是双向的,截图截不出全貌
别人在你的项目里提 issue 并被你处理你在维护一个别人依赖的东西需要持续投入
你的项目被引用/被用作依赖你的产出有下游下游不由你控制

注意这一列的共性:每一项都有另一方参与,而那一方不是你。 这就是为什么”团队作战”没法靠自述——自述里永远只有一个人。

一条硬边界:贡献量是坏指标#

必须说清一件事,否则上面这套会被用歪:commit 数、代码行数、stars 数都不是能力指标。

  • commit 数可以被拆碎刷出来(把一次改动拆成二十次);
  • 代码行数可以是 AI 生成的(本博 10-02 那篇核到过一组数据:低经验者用 AI 写码,提交量是 2.15 倍,但收到的评审意见是 4.52 倍、PR 接受率低 31%、滞留时间5.16 倍);
  • stars 会受曝光与时机影响,含光环成分。

能作为证据的不是量,而是”别人对你的产出的反应”——评审意见、是否合并、是否被接手、是否被依赖。量是你自己造的,反应是别人给的。

五、一份可自检的证据表#

把上面两条合起来,你可以直接拿这张表检查自己手上的东西:

单兵作战自检(要求每条都能被第三方独立查到)#

  • 有一个完整闭环的作品:从”我要解决什么问题”到”交付了什么”,中间包含一次失败与修正
  • 作品有人名或可追溯主体,不是匿名产出
  • 有许可证,别人可以合法使用
  • 有边界声明:明确写出”我没验证什么""什么情况下我的结论不成立”
  • 有维护痕迹:不是一次性发布,后续有更新
  • 能回答:这个作品里,哪一个关键决定是我做的?证据在哪?

最后一条是分水岭。 如果每个环节你都能说”是 AI 做的/是跟着教程做的/是师兄给的”,那这个作品不能证明单兵能力——它只证明了你能用工具。

团队作战自检(要求每条都指向一个”非你”的参与者)#

  • 有被合并的 PR(审查者不是你)
  • 有你写的评审意见(你为别人的代码负过责)
  • 有别人基于你的项目做的事:衍生、适配、修复、依赖
  • 有别人提的 issue 且被你处理
  • 有公开的双向讨论记录(你能被说服、能改结论)
  • 能回答:谁因为我的东西少走了一段弯路?

这两张表刻意设计成不能互相替代:单兵表里没有一条需要别人同意,团队表里没有一条能由你单独完成。

六、为什么”边界声明”比”成果展示”更能证明能力#

这一节是本文最想留下的东西。

回到 EditaPlot 那段话——“不会擅自补列、拟合或推断结论”。这句话的价值不在技术,在于它同时证明了四件事:

  1. 他知道这类工具最容易在哪翻车(数据列用途不明时自动猜);
  2. 他承认自己会翻车(所以把不确定的列挑出来问);
  3. 他愿意为此增加摩擦(多一步确认,牺牲流畅度换正确性);
  4. 他把这个约束写进了产品(不是写在博客里,是写进代码)。

而一个只会说”我的工具很强大”的人,这四件事一件都没证明。

这个逻辑可以推广成一条通用判据:

看一个人怎么处理”我不确定”这件事,比看他怎么展示”我做到了”更能判断能力。

因为”做到了”可以被生成、被包装、被借用;而”我知道自己哪里不确定、并且愿意为此停下来”,只能来自真实的动手经验——你得先撞过墙,才知道墙在哪。

同一批材料里,这个对比非常清楚:

借身份型交底型
怎么建立可信度“资深博导视角""博士过来人”写清验证范围、兼容版本、失效条件
遇到不确定给一个更肯定的结论停下来问,并说明为什么停下来
时间久了越来越像套路越来越被信任(因为反复被验证)

七、但开源本身也在被污染:一个必须自己拆掉的反驳#

写到这里必须停一下,因为上面这套推论有一个明显的漏洞:

你说”作品能证明能力”——可作品也能被买、被 AI 生成。有钱的人用 AI 写一个项目并不难,写得对不对也未必看得出来。那它凭什么叫证据?

这个反驳成立,而且它指向的正是本文的核心逻辑:如果”作品”也变成了一个便宜的代理指标,那它就会重走学历和论文的老路——先被滥用,然后贬值,最后被招聘端打折处理。

所以不能只说”去做作品”,必须说清楚作品里哪一部分不能被买。

可以买到的,和买不到的#

能被买到/生成买不到
代码本身它在真实输入下的运行结果
README 的漂亮程度作者主动写下的”我没验证什么”
star 数(可以刷/可以运营)别人基于它做的衍生工作
一次性发布持续维护的历史与对 issue 的回应
功能清单边界条件与失败记录

这条分界线可以概括成一句话:

能被一次性生产出来的,都不构成证据;需要持续投入才能维持的,才构成证据。

代码是一次性产物,所以它可以被买。但”这个项目在别人手里跑了半年、被三个人提过 issue、被一个人改写适配到另一个平台”——这个状态需要时间,而时间买不到。

还有一层必须坦白说清:就目前能查到的范围,开源作为招聘信号,主要适用于偏应用型的岗位(工程、数据、算法这类能把作品直接跑起来看的岗位);在多数其他场景里,它的权重有限,也没有可靠数据能说明它到底占多少。本文不打算把它说成比它实际更强的通行证——那会是本文开头批评的同一件事,只是换了个标的。

EditaPlot 里那段话,恰好就是这个机制#

回到那个项目中作者写的一句(前面引过,这里要再读一次它的另一层意思):

“只要源文件、列映射或理解结果发生变化,这次确认就会失效,需要重新核对。”

这句话的潜台词是:作者不信任”确认”这件事本身。 他知道使用者会换数据、会改列映射、会沿用上一次的结论——所以他把复核写成了一道会失效的关卡,而不是一个可以点一次就永久生效的按钮。

这是一种极其罕见的工程习惯:默认”我的输出会被误用”,所以用程序去防它。

而这恰恰是买不来的。 一个为了通过面试而生成的项目,不会去处理”半年后使用者换了输入却沿用旧结论”这种问题——因为这个问题只有真正被人用过、或者作者自己踩过坑,才会被想到。

所以判断门槛要往上抬一层#

如果你是一个在看别人作品的人,顺序应该是这样:

  1. 先看它有没有被用过——issue、PR、衍生项目、被依赖;
  2. 再看作者写了什么边界——他承认自己哪里不确定;
  3. 最后才看代码质量。

第 3 步排最后,不是因为它不重要,而是因为它最容易被伪造。

八、招聘端的二次判断:论文不再被看,然后是”看你的论文发在哪”#

上面说的贬值,已经不只是理论。它已经变成了制度。 而这一节的证据链很完整,值得完整写一遍。

第一步:论文作为信号被污染#

2026 年发表于 Scientometrics 的一项研究(基于 Retraction Watch 数据库)给出了目前最大规模的描述:2016—2024 年共有 10,409 篇论文工厂文章被撤稿,其中中国作者占 87.8%(9,137 篇);2023 年一年就有 6,780 篇(前一年 956 篇,近七倍)。学科分布也在迁移——从生物医学转向计算机科学(计算机科学占比约 39.3%),主题词从 cells、cancer、microRNA 变成 model、data、algorithm、learning。期刊类型上,开放获取占 80.8%,订阅制仅 0.4%。

(该研究自己给的限定必须一起引用:绝对数量受各国科研体量、数据库覆盖与调查报告实践差异影响,不能直接解读为”某国论文工厂发生率最高”。)

而监管侧的动作是明确的:2026 年 9 月 29 日,科技部副部长邱勇在国新办发布会上表示,科技部会同有关部门持续打击买卖论文等违规行为,同时处理购买论文的科研人员,以及售卖论文的经营主体和网站、网店,并公开通报典型案例(新华社 ↗)。

第二步:为什么同行评议自己清理不了它#

这是整条链上最容易被忽略的一环。同行评议审的是”说得通不通”,不是”跑不跑得起来”。

这个判断有一份直接实验支持——Management Science 2024 年发表的研究,动用 700 多位评审者,尝试复现该刊近 500 篇文章(DOI ↗):

口径结果
2019 年数据与代码披露政策之前仅 12% 的文章自愿提供复现材料;其中 55% 能(基本)复现
披露政策之后,且数据可得性不构成障碍时超过 95% 可完全或大部分复现
但 29% 的文章有部分数据评审者拿不到—
算上全部样本复现比例降到 68%

失败的原因是工程性的:代码缺失、代码报错无法解决、文档太弱或没有、软硬件要求与代码复杂度。

把这组数字读一遍就明白了:让复现率达到 95%,前提是有人真的去跑——而那 700 位评审者不是同行评议的常规配置,是一次专门研究的人力投入。

换句话说:论文的验证成本从来没有被评议环节承担,它被推给了下游——谁引用谁承担,谁复现谁自费。而下游通常的选择是:不复现。

第三步:于是招聘端改用”期刊 + 作者结构”做判断#

当论文不再能证明能力,而验证又需要自费去做时,筛选方就会启用更便宜的代理指标。这次它们用的是期刊黑名单。

制度链条是清楚的:

  • 2018 年,国务院办公厅《关于进一步加强科研诚信建设的若干意见》明确:支持相关机构发布国内和国际学术期刊预警名单;“对在列入黑名单的学术期刊上发表的论文,在各类评审评价中不予认可”;
  • 2020 年起,中国科学院文献情报中心发布《国际期刊预警名单(试行)》并持续更新,已成为高校制定校内预警制度的主要参考依据;
  • 高校落地:珠海科技学院明确,预警清单内期刊论文”在项目评审、评奖、人才推荐、职称评审等各类评审评价中,一律不予认可”,并作为评奖评优的负面评价因素;沧州交通学院提示,黑名单期刊论文不予认可,且不得报销论文发表费用。

而各校”负面清单”的判定特征,几乎就是论文工厂的画像(据高校公开口径整理):同一期刊同一期刊登 50 篇及以上;一篇论文少于 5000 字;存在版本较多(学术版/普及版/大众版);刊期过密(除核心期刊外,周刊、旬刊一律列入);付费即可发表或对质量无要求。

这就是你观察到的那件事的制度版本:一旦某类期刊被证明是论文工厂的主要出口(回想上面那组数:开放获取占撤稿 80.8%、订阅制 0.4%),筛选方就会用”期刊 + 作者结构”这种粗糙但便宜的启发式来判断——而代价由那些在这类期刊上正常发表的人承担。

这和第一学历歧视是同一个机制:当准确信号太贵时,就用便宜的代理指标替代。 上一次被替代的是”能力”,这一次被替代的是”论文”。

而要小心的是方向:从”论文不算数”滑到”这个群体的人不算数”,就是从一个错误跳进另一个错误——本博 10-02 那篇里已经拆过一次:用群体属性替代个体事实,无论听起来是褒是贬,都是歧视的定义。

九、边界:这套方法在哪里不适用#

必须说清楚三件事,否则这篇文章会变成它自己批评的那种”万能方案”。

第一,开源作品只在”能力可被公开验证”的岗位上有效。

工程、数据、算法类岗位,作品可以直接被看、被跑、被评。但执照型职业不适用——医生、律师、教师、注册工程师的能力必须由制度认证,不存在”我开源一个手术记录”这种路径。把开源作品当成万能通行证,是另一方向的以偏概全。

第二,“没有作品”不等于”没有能力”。

很多人所在的岗位根本不允许公开产出:涉密项目、内部系统、客户数据、体制内工作。这类情况下可迁移的形态是脱敏的方法论、可复述的决策过程、经授权的案例说明,而不是硬凑一个开源项目。拿”你有没有 GitHub”当筛选标准,和拿”你本科是不是 985”当筛选标准,是同一种偷懒。

第三,这套方法有它自己的门槛,而且不低。

它要求你能持续维护、能接受公开被质疑、能承受”做了没人看”。这本身就是一种资源——时间、精力、稳定的网络与设备。承认这一点,比假装它人人可及更诚实。

十、收束:从”被签发”到”自交底”#

学历体系解决的是一个真实问题:在有限时间内大规模筛选人。它没有消失,也不该被简单否定——本博 9-21 那篇写过,分类改革要解决的恰恰是”用研究型的尺子量应用型的岗”这种错配。

但它确实不再替你完成”证明”这件事了。

而在它让出的这块位置上,能站住的不是”我更努力”或”我学历更高”,而是两种可被第三方独立复核的东西:

单兵作战,交给别人一个能跑的闭环,并且写清它的边界。 团队作战,让别人在你的东西上留下痕迹——因为你无法替他们留。

这两件事有一个共同点:它们都不能靠说。

留一个问题给你,也留给我们自己:

如果你明天要把手上的东西交给一个陌生人,让他判断你行不行——他能在不看你的简历、不听你解释的情况下,自己查到什么?

那个”他自己能查到的部分”,就是你现在真正拥有的能力证明。其余的,都还只是说法。

学历不再替你做证明之后:怎么用作品和留痕,分别证明单兵作战与团队作战
https://bohuyeshan.top/2026/10/03/2026-10-03-01-solo-and-team-capability-proof/
作者 BoHuYeShan
发布于 2026年10月3日