数据基座与 Agent 基座

在任何 Ontology 建模开始之前,企业要先建成两层底座:数据基座让组织拥有不依赖任何个人的记忆,Agent 基座让这份记忆第一次能被「问」。两层底座是服务旅程的前两段,也是 Agent 从聊天窗口变成组织职能节点的起点。

// 一句话理解

数据基座=把散落在员工电脑、聊天记录和网盘里的文件,按统一目录收进云盘、标好敏感级,变成组织自己的记忆;Agent 基座=在这份记忆之上让十个管理域 Agent 上岗——问得到、答得准、有出处。先有记忆,再有问答,然后才谈建模。

// 核心命题

Agent 的出现点不是模型发布、账号开通或工具安装,而是组织框架被数字孪生化的那一刻。没有数字孪生,Agent 只是聊天工具;有了数字孪生,Agent 才是组织能力。两层底座,就是数字孪生的地基工程。

数据基座:组织的记忆

多数企业的知识现状是:制度在某位老员工的脑子里,SOP 在某个人的电脑里,关键决策的依据在一段聊天记录里。人一走,记忆就走。数据基座解决的就是这件事——把非敏感的大规模文件资产(SOP、制度、模板、产品资料、会议纪要)通过云盘按统一目录骨架录入,让组织第一次拥有机器可读、可检索、可授权、不随人员流动而流失的记忆。建设动作有五个:

目录骨架Skeleton

按企业的组织结构实例化公司目录体系——每个部门知道文件放哪、归谁管。目录边界天然就是权限边界:放进哪个目录,就决定了谁能看到。

云盘录入Ingestion

非敏感大规模文件先行:SOP、制度、模板、纪要批量进入云盘。敏感数据(财务实数、个人数据、核心合同)此阶段不录入,后续按权限边界与合同附件逐步纳入。

敏感分级Classification

每份文件标注四级敏感度——公开、内部、机密、受限。授权按级生效,跨级访问需要显式批准,这是后续一切权限控制的地面。

数据协作规范Data Contract

「用数据的人定标准」:数据使用方写下要求与验收标准——谁提供、什么格式、什么口径、什么时限——落成规范文件。规范分三层(大规范、小规范、细分场景规范),与「大流程套小流程」一一对应。

现状文件地图File Map

哪些域有资产、哪些是空白、哪些文件互相矛盾,一目了然。它既是数据基座的验收物,也是后续建模阶段「从哪里开始」的依据。

// 术语统一

部署框架文档所称「文件系统底座」、服务白皮书所称「企业记忆系统」,与这里的「数据基座」是同一层东西:Company Harness 的文件层。客户旅程中统一表述为数据基座。

为什么一切从这里开始?两个工程事实:第一,数据可得性是部署的头号死亡原因——文件拿不到,后面所有阶段都是空中楼阁;第二,目录天然承担权限边界——数据基座建成的同时,权限地基也随之成形,不需要事后补一套权限系统。

// 数据只嫌少、不嫌多

一个常见的误解是「模型够强,就不用给太多数据」。工程事实恰好相反:模型越强,越需要你的数据。数据衔接不足时,AI 不会留白——它会用外部相似企业的信息替代你的事实,这是幻觉的主要来源之一;任务越长、Agent 协作越深,对数据衔接的要求就越高。数据基座的厚度,直接决定答案里「你的事实」所占的比例。

Agent 基座:让记忆能被「问」

文件躺在云盘里还只是档案馆。Agent 基座在数据基座之上部署运行环境,做三件事:用 AIDC 的文件解析管线把文件变成 Agent 可用的知识;把 Harness 的四要素立起来;让首发十个管理域 Agent 上岗。

解析管线Parsing Pipeline

AIDC 自研的文件解析与知识化管线:把已录入的文件解析为知识节点与上下文索引,让 Agent 的每个回答都能追溯到「依据哪份文件、哪个版本」——问答能力建立在你自己的材料上,不是互联网常识。

Harness 四要素Operating Env

文件系统、权限矩阵、管理节奏、复核机制——四件齐备,运行环境才算初步建立。Agent 的输出从此进入真实的管理节奏:周会有简报,复盘有底稿。

首发十个 AgentLaunch Layer

第一批推送固定为十个 C-suite Agent,覆盖战略、信息、财务、产品、技术、运营、人事、法务、市场、销售十个管理域。每个 Agent 绑定且仅绑定一个根目录,配一页职责说明书:管什么、看什么、答什么、什么不归它管。

双系统:对内 Admin,对外 Execution

Agent 基座从第一天起就按双系统架构设计。对内是 Admin Agent:服务管理层与核心员工,模型能力优先、权限按职能域分级、强审计强复核;对外是 Execution Agent:面向客户与外部流程,最小权限、成本可控、输出可预测。两套系统由一条架构铁律隔开:

// 架构铁律

Admin Agent 设计 Execution Agent;Execution Agent 永远不能反向访问公司完整大脑。对外执行只拿到任务包——目标、所需材料、动作白名单、失败时怎么交还人工——而不是完整的企业记忆。底座阶段推送的是 Admin 层;Execution Agent 在业务闭环试点时按需派生。

上岗有硬门槛:每个 Agent 必须有唯一的人类负责人、最小必要权限、高风险动作的人工批准位、全程留痕、可回滚、数据不外流、上线前评估记录、随时可用的停机开关——治理基线八条,任何一条不满足就不上线。

底座之上:从「读过」到「认识」

两层底座建成后,Agent 能回答「制度里写了什么」,但还回答不准「客户 A 现在有几个在途订单」——因为文件会过时、重复、互相矛盾。这正是底座与建模的分界线,也是企业最常混淆的一层:

维度数据基座(文件层)Object 层(对象注册表)
回答什么「文件里写了什么」「这个东西现在什么状态、归谁、和谁有关」
形态非结构化文件:SOP、制度、纪要结构化对象:编号+属性+状态+关系
一致性文件会过时、重复、互相矛盾每个对象有唯一权威登记
答复质量秘书级:「制度里是这么写的」经理人级:「三个在途订单,一个卡在报价」

一句话:数据基座是组织的记忆,Object 层是组织的户口本。两层不是替代关系——每个对象绑回权威文件,对象管状态与关系,文件管依据与细节。底座建成之后,企业沿 Object → Link → Action 三阶段推进数字孪生:先认识实体(Object Types),再连通部门与系统(Link Types),最后把每个跑通的业务闭环固化为受控行动(Automation Loop)。

在旅程中的位置

两层底座对应服务旅程的前两个里程碑:数据基座建成即 M1「组织记忆上线」,Agent 基座建成即 M2「组织问答上线」。两个里程碑都验收通过,企业达到 ADL-2「问答助手」——Agent 开始承担秘书、助理级角色,这是部署等级阶梯的第一次跃迁。完整旅程见服务旅程与里程碑,等级标尺见Agentic 部署等级

相关阅读