Part IV 工程化落地
LLM demo 在自己电脑上跑通之后,下一步是搬到客户环境。这一搬,绝大多数项目的痛点开始集中爆发。
数据接不上——客户的核心数据散在 SAP / Oracle / 私有云 / 离线机房 / 跨境混合云里,每一处都有它自己的 DBA、白名单和审批流程。接上了又过不了合规——PII 不能出域、跨境要走数据出境备案、等保要做、审计要留。这些问题不是写几行代码能解决的,是整段时间会被它们吃掉。
Part IV 处理的就是从”我电脑上能跑”到”在客户环境里能跑”这段距离。Palantir 风格的 FDE 一半时间花在这个 Part 的话题上;LLM 风格的 FDE 走到生产前一定也会撞上。
第 9 章讲数据工程。客户那边数据的形状和你 demo 阶段假设的几乎一定不同:字段缺失、命名混乱、跨系统口径不一致、增量同步比全量难十倍。这一章讲怎么用 Ontology 这层抽象先把语义对齐,再决定 ETL / 实时管道怎么搭。
第 10 章讲 Scaffolding 阶段的开发循环。”在客户环境里跑”和”在自己机器上跑”差的不只是网络——是依赖链路长、出错信号弱、回滚成本高。这一章讲怎么把 Part III 的最小闭环搬进客户的 VPC、私有部署或离线机房,让代码在受限环境里仍然能保持可观测、可迭代。
第 11 章讲跨系统对接和合规——SSO / SCIM / 审计 / VPC 网络。FDE 在这块经常扮演”客户 IT 和方案侧的桥”,需要能听懂等保 2.0、SOC 2、GDPR 这些词在客户语境里到底意味着什么动作,而不是被名词吓退。
Part IV 的前置是 Part II 的 Discovery 必须把客户数据现状摸清楚(不然你到 Scaffolding 才发现关键数据根本接不出来)。Part IV 和 Part III 通常并行——技术栈选型和数据接入两条线一起推进。Part V 的生产化、Part VI 的 Agent 工具调用都依赖这一 Part 的基础。