记录系统(System of Record):不在其中的成果,对企业而言并不存在
我们在打造报价单生成器时,最容易被低估的部分不是文档拼装本身,而是一个技术动作:生成好的文档会自动挂接到对应的成交记录卡片上。这并没有替销售人员节省时间,它决定的是这份文档对企业而言是否存在。
记录系统(system of record,企业中某项事实——成交、文档、客户——被真正认定为真实的地方)不是一个架构概念,而是一个管理概念。企业里的任何一个事实,都有一个被认定为"真"的落脚点。工作成果如果没有进入这个落脚点,无论质量多高,对组织而言它就等于没有发生过。
自动化只有在结果落入记录系统之后才算真正完成。留在聊天记录、表格或邮件里的结果,不会被下一个接手的人继承,不会出现在报表里,甚至撑不过它的作者休一次假。关于电子表格错误率和企业记录数据质量(data quality)的数据显示,把"真相"留在系统之外要付出多大代价:存在缺陷的记录比例以百分之几十计。
一个事实找不到落脚点的四个信号
这个问题看不出在架构图上,而是显现在日常对话里。下面四个信号,本质上都是同一件事的症状:某个事实的真相,活在一个没有人为它负责的地方。
"我把文件发你。"文档唯一的最新版本存在某一个人手里,靠人工传递。一个月后没人知道哪个版本是最新的,半年后连作者本人也说不清楚。
"问她吧,这个客户一直是她在跟。"成交的真相存在某个员工的记忆里。这套办法能撑到她休假、调岗或离职之前,之后就再也不管用了。
"报表跟实际情况对不上。"系统里的数据只描述了工作的一部分,而决策依据的是系统里根本没有的另一部分。管理者看到的是一份结构正确、但数据不完整的报表,而他根本无从察觉这一点。
"我们有一张什么都对的表格。"这是最危险的情形,因为它看起来像是一个解决方案。这张表格变成了影子表格(shadow spreadsheet):人人信它、引用它,但它既没有权限管理,也没有修改历史,更没有校验规则。
| 真相活在哪里 | 作者离开后会发生什么 | 报表里能看出来吗 |
|---|---|---|
| 记录系统 | 什么都不会发生,事实依旧可查 | 能 |
| 员工手里的文件 | 最新版本随之丢失 | 不能 |
| 员工的记忆 | 事实彻底消失 | 不能 |
| 影子表格 | 事实还在,但不再更新 | 不能,而且这是最危险的一种 |
第三列解释了这个问题为什么能潜伏多年。四种情形里有三种在报表上完全不可见,只有等到出了问题才会被发现。
影子表格到底要付出什么代价
把电子表格当作真相存放地这件事,被研究得比大多数人以为的更透彻——既有实地审计,也有对照实验。
在对企业表格的实地审计中,367份被检查的文件里有24%存在错误;采用更严格的审计方法后,这一比例至少上升到86%。在对照实验中,51%的参与者在只有25到50个单元格的表格里都出了错。
这是一篇综述性论文,汇总了一批性质各异、部分已经过时的研究,"存在错误的表格"这一比例本身高度依赖判定标准的严格程度和文件规模。这是一个实实在在的局限。但24%到86%这个跨度本身就很能说明问题:查得越仔细,发现的问题就越多——这恰恰是一套带输入校验的系统所不具备的属性。
录入端的数据质量
问题的另一半,是真正进入记录系统本身的内容。这方面有一项用不寻常、也正因此更有说服力的方法做出的测量。
只有3%的企业在数据质量(data quality)上拿到了及格分,而47%的新建记录都至少含有一个关键错误。
样本不大——只有75家企业——数据由参与者自行采集,存在真实的偏差风险;这是一篇商业媒体的专栏文章,不是同行评审论文。真正有价值的是它的方法:人工核查一百条连续记录,任何一家公司都能在一天内复现,并得到一个可以马上拿来用的数字。我建议从这一步开始,而不是从架构讨论开始。
为什么企业最终会有不止一个记录系统
单一系统的设想,会撞上企业应用生态的现实,而这个现实是有实测数据的。
一家企业平均使用的应用数量达到101个——首次突破了100这个整数关口。
这是一家身份管理供应商客户群的遥测数据,不是对企业的随机抽样,而且这项指标是按组织层面而非员工层面统计的。但实践层面的结论依然直接:不会存在一个统一的记录系统。现实的目标不是"一个工具包打天下",而是明确规定每一类事实(class of facts)由哪个系统作为真相来源,并禁止在别处重复存放同一类事实。
碎片化带来的一个副作用,是应用之间的上下文切换(context switching)。这里值得说得精确一点:实验数据并不像通常认为的那样一边倒。
在一项对照实验中,打断并没有拖慢任务完成速度:参与者反而完成得更快(20.3–20.6分钟,对照基线条件下的22.8分钟)。但这种速度是以显著更高的压力、挫败感和时间紧迫感为代价换来的。
这是一项以学生为样本、任务本身也是人为设计的实验室研究——不能直接套用到长达数小时的企业实际工作中。但它的价值恰恰在于结果反直觉:碎片化的代价不体现在报表里能看到的那几分钟损失上,而体现在报表里根本不会出现的负荷上。这和我在别处专门写过的那种"无人观测的缺陷"属于同一类问题。
如何为事实指定记录系统
第二步通常会引发争论,而这种争论是有价值的:往往会发现有两个系统在争夺同一类事实,而此前从没有人裁定过哪个才是权威系统。这个决定只需要做一次,成本比任何一次系统集成都低。
第四步几乎可以直接套用到AI场景。一个在单独窗口里回答问题、却不把结果写进任何地方的助手,增加的是真相存放地的数量,而不是减少。"结果落在哪里"这个问题,应该排在"回答有多好"这个问题前面来问。
一天就能做完的四项检查
抽取最近一百条记录
人工检查明显错误:必填字段为空、前后矛盾、重复记录。缺陷比例就是你的起点。
找出影子表格
问一句"正确"版本的数据放在哪里。每被提到一次表格,就意味着有一类事实没有记录系统。
为每一类事实指定真相系统
成交、文档、付款、工单、合作方。一类事实对应一个地方,决定要落成书面文件。
检查每个流程是否真正到达
看结果最终落在哪里。如果答案是"在往来邮件里"或"在经办人那里",这个流程就还没有结束。
"真实版本在哪里能看到"这个问题,如果得到的答案是一个人的名字而不是一个系统的名字,那么这个流程的自动化其实还没有真正开始。
常见问题
用大白话说,什么是记录系统?
就是企业存放某个事实(成交、文档、付款、工单)权威版本的那套系统。判断标准很简单:两个来源出现分歧时,被指定为记录系统的那个是对的,另一个只算副本。没有这个指定,分歧就会变成部门之间的争执,而且这种争执没有解决办法。
电子表格可以当记录系统用吗?
在数据量小、只有一个使用者的情况下可以,前提是这是一个经过深思熟虑并被明确写下来的决定。真正的问题出在表格在无人明确指定的情况下悄悄变成了记录系统:它没有权限管理,没有修改历史,也没有输入校验,而实地审计显示存在错误的文件比例能达到百分之几十。危险的从来不是表格本身,而是它那个从未被明确的身份。
如果系统不止一个,而且都需要,该怎么办?
要区分的不是系统,而是事实类别。成交可以有一个真相系统,付款可以有另一个,文档还可以有第三个——这都正常。不正常的是同一类事实同时活在两个地方,而且都靠人工更新:这种情况下出现分歧是必然的,而且往往要等到对账那一刻才会被发现,也就是最晚的时候才会被发现。
AI助手的结果应该写进哪里?
写进对应那类事实原本就存放的那个系统里,而且要在结果产生的那一刻就写进去,而不是交给用户自行决定。一个结果需要人工复制粘贴的助手,只是又增加了一个真相存放地,又多了一个故障点。判断一个场景是否真正可用的实用标准是:没参与这次请求的同事,也能看到这个结果。
把生成好的文档自动挂接到成交记录卡片、并从卡片内直接发送的机制,来自作者自有产品Alego.Digital(一款报价单生成器)的产品说明;该公司当时使用的记录系统是Megaplan。与多个CRM系统(Megaplan、Bitrix24、1C、amoCRM)对接的合作方核查模块集成,来自同一时期另一款自有产品的产品说明。以上均为作者所在公司的内部资料,未经独立第三方核实,在此仅作为机制说明使用。文中"四种真相存放地"的分类,是作者基于实践经验的归纳总结。
- Panko R. R. What We Know About Spreadsheet Errors. EuSpRIG, 2000; arXiv:0802.3457, 2008. arxiv.org
- Nagle T., Redman T. C., Sammon D. Only 3% of Companies' Data Meets Basic Quality Standards. Harvard Business Review, 2017年9月. hbr.org
- Okta. Businesses at Work 2025, 2025年3月. okta.com
- Mark G., Gudith D., Klocke U. The Cost of Interrupted Work: More Speed and Stress. CHI 2008. ics.uci.edu