跳转到主要内容

记录系统(System of Record):不在其中的成果,对企业而言并不存在

记录系统(System of Record):不在其中的成果,对企业而言并不存在

我们在打造报价单生成器时,最容易被低估的部分不是文档拼装本身,而是一个技术动作:生成好的文档会自动挂接到对应的成交记录卡片上。这并没有替销售人员节省时间,它决定的是这份文档对企业而言是否存在。

记录系统(system of record,企业中某项事实——成交、文档、客户——被真正认定为真实的地方)不是一个架构概念,而是一个管理概念。企业里的任何一个事实,都有一个被认定为"真"的落脚点。工作成果如果没有进入这个落脚点,无论质量多高,对组织而言它就等于没有发生过。

摘要

自动化只有在结果落入记录系统之后才算真正完成。留在聊天记录、表格或邮件里的结果,不会被下一个接手的人继承,不会出现在报表里,甚至撑不过它的作者休一次假。关于电子表格错误率和企业记录数据质量(data quality)的数据显示,把"真相"留在系统之外要付出多大代价:存在缺陷的记录比例以百分之几十计。

86%份被严格审计的表格中存在错误
47%份新建记录中至少含一个关键错误(critical error)
101个应用,一家企业平均使用的数量

一个事实找不到落脚点的四个信号

这个问题看不出在架构图上,而是显现在日常对话里。下面四个信号,本质上都是同一件事的症状:某个事实的真相,活在一个没有人为它负责的地方。

"我把文件发你。"文档唯一的最新版本存在某一个人手里,靠人工传递。一个月后没人知道哪个版本是最新的,半年后连作者本人也说不清楚。

"问她吧,这个客户一直是她在跟。"成交的真相存在某个员工的记忆里。这套办法能撑到她休假、调岗或离职之前,之后就再也不管用了。

"报表跟实际情况对不上。"系统里的数据只描述了工作的一部分,而决策依据的是系统里根本没有的另一部分。管理者看到的是一份结构正确、但数据不完整的报表,而他根本无从察觉这一点。

"我们有一张什么都对的表格。"这是最危险的情形,因为它看起来像是一个解决方案。这张表格变成了影子表格(shadow spreadsheet):人人信它、引用它,但它既没有权限管理,也没有修改历史,更没有校验规则。

真相活在哪里作者离开后会发生什么报表里能看出来吗
记录系统什么都不会发生,事实依旧可查
员工手里的文件最新版本随之丢失不能
员工的记忆事实彻底消失不能
影子表格事实还在,但不再更新不能,而且这是最危险的一种

第三列解释了这个问题为什么能潜伏多年。四种情形里有三种在报表上完全不可见,只有等到出了问题才会被发现。

影子表格到底要付出什么代价

把电子表格当作真相存放地这件事,被研究得比大多数人以为的更透彻——既有实地审计,也有对照实验。

研究

在对企业表格的实地审计中,367份被检查的文件里有24%存在错误;采用更严格的审计方法后,这一比例至少上升到86%。在对照实验中,51%的参与者在只有25到50个单元格的表格里都出了错。

Raymond R. Panko,夏威夷大学。《What We Know About Spreadsheet Errors》,提交给European Spreadsheet Risks Interest Group的报告,2000年;2008年发布于arXiv。综合了7项实地审计(367份表格,1987–2000年)与18项实验室实验(约1,000名受试者)· arxiv.org (PDF)

这是一篇综述性论文,汇总了一批性质各异、部分已经过时的研究,"存在错误的表格"这一比例本身高度依赖判定标准的严格程度和文件规模。这是一个实实在在的局限。但24%到86%这个跨度本身就很能说明问题:查得越仔细,发现的问题就越多——这恰恰是一套带输入校验的系统所不具备的属性。

只存在于一个人文件里的结果,不叫自动化,只是换了个地方存放而已。

录入端的数据质量

问题的另一半,是真正进入记录系统本身的内容。这方面有一项用不寻常、也正因此更有说服力的方法做出的测量。

研究

只有3%的企业在数据质量(data quality)上拿到了及格分,而47%的新建记录都至少含有一个关键错误。

Tadhg Nagle、Thomas C. Redman、David Sammon。《Only 3% of Companies' Data Meets Basic Quality Standards》,《哈佛商业评论》,2017年9月。75位高管各自收集了本部门新建的100条记录,并逐条人工核查明显错误 · hbr.org

样本不大——只有75家企业——数据由参与者自行采集,存在真实的偏差风险;这是一篇商业媒体的专栏文章,不是同行评审论文。真正有价值的是它的方法:人工核查一百条连续记录,任何一家公司都能在一天内复现,并得到一个可以马上拿来用的数字。我建议从这一步开始,而不是从架构讨论开始。

为什么企业最终会有不止一个记录系统

单一系统的设想,会撞上企业应用生态的现实,而这个现实是有实测数据的。

研究

一家企业平均使用的应用数量达到101个——首次突破了100这个整数关口。

Okta,《Businesses at Work 2025》报告,2025年3月。对数千家客户企业的匿名遥测数据及集成网络在2023年11月1日至2024年10月31日期间的分析,按地区、行业和企业规模分层 · okta.com

这是一家身份管理供应商客户群的遥测数据,不是对企业的随机抽样,而且这项指标是按组织层面而非员工层面统计的。但实践层面的结论依然直接:不会存在一个统一的记录系统。现实的目标不是"一个工具包打天下",而是明确规定每一类事实(class of facts)由哪个系统作为真相来源,并禁止在别处重复存放同一类事实。

碎片化带来的一个副作用,是应用之间的上下文切换(context switching)。这里值得说得精确一点:实验数据并不像通常认为的那样一边倒。

研究

在一项对照实验中,打断并没有拖慢任务完成速度:参与者反而完成得更快(20.3–20.6分钟,对照基线条件下的22.8分钟)。但这种速度是以显著更高的压力、挫败感和时间紧迫感为代价换来的。

Gloria Mark(加州大学欧文分校)、Daniela Gudith、Ulrich Klocke(柏林洪堡大学)。《The Cost of Interrupted Work: More Speed and Stress》,CHI 2008。实验室实验,48名参与者,每人以人力资源经理的身份回复12封邮件,每两分钟被打断一次 · ics.uci.edu (PDF)

这是一项以学生为样本、任务本身也是人为设计的实验室研究——不能直接套用到长达数小时的企业实际工作中。但它的价值恰恰在于结果反直觉:碎片化的代价不体现在报表里能看到的那几分钟损失上,而体现在报表里根本不会出现的负荷上。这和我在别处专门写过的那种"无人观测的缺陷"属于同一类问题。

如何为事实指定记录系统

决策要按事实类别(class of facts)来做,而不是按工具来做:每一类事实都有且只有一个被认定为真的地方。
01列出事实类别:成交、文档、付款、工单
02为每一类指定唯一的真相系统
03禁止同一类事实出现第二个存放地
04核实每个流程的结果确实落到了那里
任何一个新工具都要先过一道问题:它的结果会落到哪里,什么时候落进去

第二步通常会引发争论,而这种争论是有价值的:往往会发现有两个系统在争夺同一类事实,而此前从没有人裁定过哪个才是权威系统。这个决定只需要做一次,成本比任何一次系统集成都低。

第四步几乎可以直接套用到AI场景。一个在单独窗口里回答问题、却不把结果写进任何地方的助手,增加的是真相存放地的数量,而不是减少。"结果落在哪里"这个问题,应该排在"回答有多好"这个问题前面来问。

一天就能做完的四项检查

01

抽取最近一百条记录

人工检查明显错误:必填字段为空、前后矛盾、重复记录。缺陷比例就是你的起点。

02

找出影子表格

问一句"正确"版本的数据放在哪里。每被提到一次表格,就意味着有一类事实没有记录系统。

03

为每一类事实指定真相系统

成交、文档、付款、工单、合作方。一类事实对应一个地方,决定要落成书面文件。

04

检查每个流程是否真正到达

看结果最终落在哪里。如果答案是"在往来邮件里"或"在经办人那里",这个流程就还没有结束。

"真实版本在哪里能看到"这个问题,如果得到的答案是一个人的名字而不是一个系统的名字,那么这个流程的自动化其实还没有真正开始。

常见问题

用大白话说,什么是记录系统?

就是企业存放某个事实(成交、文档、付款、工单)权威版本的那套系统。判断标准很简单:两个来源出现分歧时,被指定为记录系统的那个是对的,另一个只算副本。没有这个指定,分歧就会变成部门之间的争执,而且这种争执没有解决办法。

电子表格可以当记录系统用吗?

在数据量小、只有一个使用者的情况下可以,前提是这是一个经过深思熟虑并被明确写下来的决定。真正的问题出在表格在无人明确指定的情况下悄悄变成了记录系统:它没有权限管理,没有修改历史,也没有输入校验,而实地审计显示存在错误的文件比例能达到百分之几十。危险的从来不是表格本身,而是它那个从未被明确的身份。

如果系统不止一个,而且都需要,该怎么办?

要区分的不是系统,而是事实类别。成交可以有一个真相系统,付款可以有另一个,文档还可以有第三个——这都正常。不正常的是同一类事实同时活在两个地方,而且都靠人工更新:这种情况下出现分歧是必然的,而且往往要等到对账那一刻才会被发现,也就是最晚的时候才会被发现。

AI助手的结果应该写进哪里?

写进对应那类事实原本就存放的那个系统里,而且要在结果产生的那一刻就写进去,而不是交给用户自行决定。一个结果需要人工复制粘贴的助手,只是又增加了一个真相存放地,又多了一个故障点。判断一个场景是否真正可用的实用标准是:没参与这次请求的同事,也能看到这个结果。

内部数据来源说明

把生成好的文档自动挂接到成交记录卡片、并从卡片内直接发送的机制,来自作者自有产品Alego.Digital(一款报价单生成器)的产品说明;该公司当时使用的记录系统是Megaplan。与多个CRM系统(Megaplan、Bitrix24、1C、amoCRM)对接的合作方核查模块集成,来自同一时期另一款自有产品的产品说明。以上均为作者所在公司的内部资料,未经独立第三方核实,在此仅作为机制说明使用。文中"四种真相存放地"的分类,是作者基于实践经验的归纳总结。

外部资料来源
  1. Panko R. R. What We Know About Spreadsheet Errors. EuSpRIG, 2000; arXiv:0802.3457, 2008. arxiv.org
  2. Nagle T., Redman T. C., Sammon D. Only 3% of Companies' Data Meets Basic Quality Standards. Harvard Business Review, 2017年9月. hbr.org
  3. Okta. Businesses at Work 2025, 2025年3月. okta.com
  4. Mark G., Gudith D., Klocke U. The Cost of Interrupted Work: More Speed and Stress. CHI 2008. ics.uci.edu