如何把 Jitsu 接入自己的网站或应用?
Jitsu 的接入可以概括为“采集 + 存储”两步:先在网站或应用里加一段采集代码(官方称“像加一个 Google Analytics 标签一样简单”),再把事件数据实时送入你指定的数据仓库。它适合已经拥有数据仓库、希望把网站/应用/API/CRM 等来源的事件统一收集并自主掌控数据的团队;如果你还没有可用的数据仓库,需要先准备存储端,否则数据没有落点。
接入前需要准备什么
- 一个数据仓库:Jitsu 是 warehouse-first 设计,把数据仓库当作数据的单一事实来源,采集来的事件最终要写入你选择的数据仓库。
- 采集端的接入位置:网站页面、应用、API、CRM、聊天机器人等产生事件的地方。
- 事件来源的确认:先想清楚要采集哪些行为数据(例如页面浏览、注册、点击等),再决定埋点位置。
三步接入流程
官方把实施过程归纳为三个步骤,其中前两步是核心:
第一步:采集(Capture)
在网站或应用中加入采集代码。官方描述这一步“等于加一个 Tag”,与 Google Analytics、Segment 的使用方式类似,支持 HTML、React 等方式。预期结果是:网站、应用及其他客户触点产生的事件被 Jitsu 接收。
第二步:存储(Store)
把采集到的事件写入你选择的数据仓库。Jitsu 针对“尽可能快地把数据送达数据仓库”做了专门设计,官方称数据可在数分钟内准备好用于分析,而不是数小时。预期结果是:数据仓库成为你可自主控制、可共享给团队的数据源。
第三步:按需加工(可选)
如果需要在数据入库前修改、过滤或补充事件,可以使用 Jitsu Functions。它在 JavaScript 运行时中执行,因此可以调用 npm 包、库和键值存储等 JavaScript 生态资源。
例如,官方示例中的函数会在识别到 identify 事件时,先检查该邮箱是否已注册过:未注册则写入标记,并向 Slack 发送一条新用户通知。这说明 Functions 适合做去重、条件触发、外部通知这类入库前的处理。
采集端可以覆盖哪些来源
| 来源类型 | 说明 |
|---|---|
| 网站(HTML / React) | 加 Tag 即可采集 |
| 应用 | 采集用户行为事件 |
| API | 作为事件来源接入 |
| CRM | 客户数据来源之一 |
| 聊天机器人 | 客户互动数据来源之一 |
官方强调这些来源可以统一汇入数据仓库,避免被单一厂商锁定。
常见卡点与验证方法
- 没有数据仓库:这是最常见的阻塞点。Jitsu 的定位是把数据送进仓库,而不是替代仓库,所以先确认存储端可用。
- 采集代码是否生效:加完 Tag 后,触发一次页面浏览或目标事件,确认事件被 Jitsu 接收,再检查是否写入目标仓库。
- 入库前的加工逻辑:如果用了 Jitsu Functions,注意函数在 JavaScript 运行时执行,涉及外部调用(如 Slack 通知)时需要配置对应的 token 等参数。
- 实时性预期:官方称数据可在数分钟内用于分析,验证时以实际入库时间为准,而不是假设零延迟。
成本与开始方式
官网显示提供 Pricing 页面,并标注“Free for up to 200k events”(20 万事件以内免费)、无需信用卡即可开始。具体价格档位和超出免费额度后的计费方式,以官网 Pricing 页面为准。项目为 100% 开源,GitHub 上有 3.4k Star,也提供 Book a demo 的演示预约入口。