前言
这本书起初是一本更小的书——一本讲原则的书——后来长 成了它的读者真正在问的问题:这东西到底怎么造? 这 东西有很多名字。统计计算环境。临床报告流水线。平台产 品。这本书讲的是如何造出一个经得起与监管、与审计员、 与真相正面相撞的东西。
它写自三个来源,而这种混合就是方法。第一,文献: 监管框架、基于风险的验证运动、开源生态、流水线工具 ——在第二部分中以一篇综述应有的引证规格加以评述。 第二,实践:由一个坐得进一张桌子的团队在生产中运 行的两套系统——一个由二十一个服务组成的临床评审平 台,以及一个其引擎把蜕变测试、性质测试、模糊测试和变 异测试置于人的治理之下的验证网关——诚实地报告,包括 它们止步之处。第三,原则:九条,在第三部分陈述, 每条末尾都附一个你可以对任何系统(包括你自己的)运行 的检验。
论点压缩如下:临床报告中的计算如今免费且优秀,而使之 如此的生态坦承自己交付的是能力而非保证。业界最受信赖 的证据仪式——独立双人编程——仍然是手工作坊式的。在 经验证的单体与松散的组件之间,空着一个格子:一个能生 成自身问责的组合环境。填满那个格子是一门工程学科—— 契约、哈希、关口、锁定参照、随产品交付的验证——小团 队学得会,而从第三部分起,这正是本书的主题。
本书的配套卷是一篇研究预印本,《Human-Governed Validation of R Packages for Regulated Statistical Computing》;凡章节倚重其结果之处,均有说明。它的姊妹 卷——《Modern R in Practice》 与 《Clinical R in Practice》——分别承载工程技艺与生态地图。本书承载的 是"为什么"以及"各部分如何拼在一起"。
请带着怀疑来读它。每条原则章末尾的检验之所以存在,就 是为了让你能用系统而不是形容词来与这本书争论。信任, 如第一稿的书名所说,是一个层——而一个层只有当你能指 出它从哪里开始、在哪里停住时,才是真实的。
—— Jaime Yan,2026 年 10 月