Jitsu 是什么网站?

Jitsu 是一个开源的客户数据平台(CDP),核心用途是把网站、应用、服务器等来源的事件数据采集起来,经过清洗后实时流入你自己的数据仓库和分析工具。它适合已经或计划使用数据仓库(如 MySQL 等)、希望数据自主可控、不想被单一厂商锁定的团队。官网标注 100% 开源,提供最多 20 万事件的免费额度,无需信用卡即可开始。

它解决什么问题

传统做法是各业务系统各自埋点、各自对接分析工具,数据散落在多个平台,口径难统一,迁移成本高。Jitsu 的思路是 warehouse-first:让数据仓库成为数据的单一可信来源,所有事件先汇聚到这里,再由仓库对外供数。

具体能力包括:

  • 多来源采集:网页、App、邮件、聊天机器人、CRM 等渠道的事件都能接入。
  • 实时流入仓库:用户行为数据从应用实时流到指定数据仓库,官网的说法是“几分钟而不是几小时”就能用于分析。
  • 无厂商锁定:数据落在自己的仓库里,换工具不影响底层数据。

怎么接入

官网把实施概括为三步,其中第一步的采集门槛被刻意压得很低。

  1. Capture(采集):在页面里加一个 Tag,难度对标添加 Google Analytics 代码。官网原话是“Implementation = add a Tag. That's it.”,即整个设置就是加一个标签。
  2. Store(存储):接入你自己的数据仓库,获得最大的自主权和控制力。
  3. 共享/使用:把仓库里的数据分发给需要的人或工具。

预期结果是:事件从各端进入 Jitsu,再落到你的仓库,之后的分析都基于这一份数据。

开发者能改什么

Jitsu Functions 允许在事件写入仓库之前对其进行修改、过滤或增强。函数运行在 JavaScript 运行时环境中,因此可以直接使用 npm 包、库和键值存储等生态。

官网给出的示例是一个 identify 事件处理逻辑:判断某个邮箱是否已经注册过,如果没注册过就写入标记,并调用 Slack API 发送一条“有新用户”的通知。这说明它不只是转发数据,还能在管道里做业务判断和外部触发。

export default async function(event, { log, props, store }) {
  if (event.type === "identify") {
    if (await store.set(`signup/${event.traits.email}`)) {
      log(`User ${event.traits.email} already signed up`);
    } else {
      await store.set(`signup/${event.traits.email}`, true);
      await fetch(`https://slack.com/api/chat.postMessage`, {
        method: "POST",
        body: JSON.stringify({
          token: props.SLACK_TOKEN,
          channel: props.CHANNEL_ID,
          text: `Hooray! We have new user ${event.traits.email}`
        })
      });
    }
  }
}

适合谁,先确认什么

适合:有数据仓库、重视数据主权、需要实时事件流、团队里有能写 JavaScript 的开发者。

开始前建议先确认两件事:你的数据仓库类型是否在支持范围内;免费额度(20 万事件)是否覆盖当前量级。超出后的价格与付费方案,官网有独立的 Pricing 页面,需要以该页面信息为准。

jitsu.com
Capture event data from websites, apps, and servers with Jitsu, then stream clean customer data into warehouses and tools in real time for analytics.