● 专家 · 数据研究

链上数据分析

从一串交易记录中提炼可验证的结论:先定义指标,再拆解资金变化,最后把证据、口径与局限写清楚。

◎ 无需编程基础↻ 更新于

链上数据适合回答“什么地址在什么时间调用了什么合约、资产如何转移”,却很少能单独回答“为什么这么做”或“地址背后是谁”。可靠分析的核心不是堆指标,而是把问题、口径、证据和推断边界放在同一张桌面上。

先记住一条:链上记录是事实,标签是线索,解释是推断。三者必须分开写,结论才经得起复核。

先确定分析层级

同一个“增长”在不同层级可能指完全不同的事情。开始查询前,先写清分析对象与时间范围,避免拿地址层面的波动解释整条链。

01 / 交易

还原单次执行

查看 From、To、Method、日志、资产转移与 Gas,判断一笔操作实际做了什么。

02 / 地址与合约

识别行为模式

观察对手方、频率、持仓与时间线,区分用户、机器人、路由、金库和交易所地址。

03 / 协议

衡量产品使用

组合 TVL、存取款、交易量、费用、收入和留存,判断资金与使用是否同步。

04 / 公链

观察整体活动

关注活跃地址、交易数、稳定币供给、跨链净流入、Gas 与应用分布。

05 / 市场事件

检验一个具体假设

围绕升级、激励、脱锚或安全事件设置事件窗口,并与此前基线比较。

常用指标:定义比数值更重要

指标通常表示解读时要补的条件
TVL协议合约中被计入的资产,以美元等单位估值代币价格、统计范围、是否重复计入、是否包含借入资产
美元净流入排除价格波动后,资产余额增加或减少的估计存取款、跨链迁移、内部调仓和价格源
活跃地址一段时间内直接与目标合约或链交互的唯一地址数地址不等于用户;机器人、多钱包和托管账户都会扭曲人数
交易数满足筛选条件的链上交易或调用次数批量交易、失败交易、自动化任务和统计对象
交易量交换、借贷、衍生品等业务在周期内处理的名义金额刷量、循环路径、价格口径和是否为双边记账
费用用户因使用协议支付的总费用不要与网络 Gas 或协议收入混为一谈
协议收入费用中归协议金库或代币持有者的部分分成规则、激励支出和收入确认时点
稳定币供给某条链上被统计的稳定币流通规模发行、赎回、跨链桥与价格偏离都会影响变化
TVL 上涨不一定代表新增资金:如果协议持有的 ETH 数量不变,而 ETH 价格上涨 30%,以美元计价的 TVL 也会接近上涨 30%。判断真实流入,要把价格效应与代币数量变化拆开。

为什么单一指标很容易误导?

01 / 地址数

地址不是自然人

同一用户可以使用多个钱包,一个托管地址也可能代表大量用户;激励活动还会吸引批量账户。

02 / 交易量

成交不等于需求

高频机器人、套利、路由拆单和刷量都会放大数字,需要结合独立交易者与费用观察。

03 / 费用

高费用有两种解释

它可能来自强劲使用,也可能只是网络拥堵或低效执行;还要看协议收入和用户留存。

⚠️ 不要把相关性写成因果

价格上涨、TVL 增加和活跃地址增长同时发生,只能说明它们在同一时期变化。若要解释因果,还需事件时间、对照组、机制证据和其他数据来源。

数据从哪里来:从原始表到可读指标

分析平台通常先保存节点输出,再用合约 ABI、标签和价格数据进行加工。越靠后的数据越好读,也越依赖平台的解码规则与维护质量。

原始数据Blocks、Transactions、Logs、Traces
解码数据用 ABI 还原函数、事件与参数
指标与标签价格、实体分类、聚合口径
  • 原始交易表适合核对交易状态、发送方、目标、数值和 Gas。
  • 事件日志需要对应 ABI 才能读成 Swap、Deposit、Transfer 等业务动作。
  • Trace 能补充合约内部调用,但不同平台的生成与展示方式可能不同。
  • 地址标签和实体聚类往往来自链外资料,必须保留来源与更新时间。
  • 价格、代币精度和代理合约升级会直接影响历史计算结果。

资金流向追踪:从锚点交易开始

  1. 固定锚点记录链、交易哈希、区块高度、时间戳和目标资产。不要只保存截图。
  2. 还原资产变化同时查看原生币、代币转移、事件日志和内部调用,列出每个地址的净增减。
  3. 分类对手方将地址标记为交易所、跨链桥、路由、协议金库、普通地址或未知,并记录标签来源。
  4. 统一口径跨链时统一链名、代币合约、精度、价格时间点与时区,避免把同名资产当成同一资产。
  5. 扩展时间线沿关键地址向前查资金来源、向后查资金去向;设置追踪层数和最小金额,防止无限扩散。
  6. 交叉验证用另一浏览器、数据平台或项目公开地址清单复核关键节点,并保留无法确认的部分。
鲸鱼追踪的边界:大额转入交易所不等于已经卖出,转入跨链桥不等于资金消失,多个地址行为相似也不等于属于同一实体。可以提出概率判断,但不要伪装成确定身份。

判断协议健康度:把指标放进同一框架

维度可观察指标要回答的问题
资本TVL、净流入、稳定币供给、资金集中度资金是新增、价格上涨,还是少数大户迁入?
使用活跃地址、交易数、交易量、功能分布用户在持续使用产品,还是只完成一次激励任务?
变现费用、协议收入、收入/TVL、补贴支出使用量能否形成可持续收入,成本由谁承担?
留存周/月留存、重复交互地址、资金停留时间活动结束后,用户和资金是否仍然留下?
风险管理员权限、资产集中、坏账、预言机与桥依赖增长是否以更高的合约、流动性或治理风险为代价?

案例:TVL 一周上涨 30%,是不是自然增长?

不要直接用“资金涌入”作结论。可以按下面顺序拆解:

  1. 先拆价格效应按代币数量重算期初与期末价值,观察在固定价格下 TVL 还增长多少。
  2. 再看真实净流入汇总存款、取款和跨链流动,排除协议内部金库之间的调拨。
  3. 检查资金集中度判断增长来自大量新地址,还是少数巨鲸或项目方地址。
  4. 对照使用与收入比较活跃地址、交易量、费用和留存是否同步改善。
  5. 核对激励和事件标注空投、积分、上币、集成和市场行情,说明它们可能带来的短期影响。
更稳妥的写法:“TVL 上涨 30%,其中约一半可由资产价格解释;固定价格口径下仍有净增长,但 62% 的新增余额集中在三个地址,暂不能判断为广泛的用户增长。”

把链上发现写成一份可复核的研报

01 / 结论

一句话回答问题

明确对象、时间和方向,不用“生态繁荣”“资金看好”这类无法检验的词。

02 / 证据

展示关键数字与交易

附上查询链接、合约地址、交易哈希、区块范围和图表数据,而不是只有截图。

03 / 口径

说明怎么算出来

写清筛选条件、时区、价格源、去重方式、协议范围和数据更新时间。

04 / 局限

区分已知与推断

列出标签误差、缺失数据、跨链盲区和无法确认的身份关系。

05 / 复现

让别人能重新计算

保存 SQL、查询编号、参数和版本;数据平台更新后,应能解释结果为何变化。

⚠️ 链上公开不等于可以随意定性

地址活动可以被观察,但身份归属、资金目的和违法判断通常需要链外证据。公开研究时应避免泄露无关个人信息,也不要根据单一标签或一次交互给地址贴上永久结论。

本节要点

  • 先确定分析层级、时间窗口和指标定义,再开始查询。
  • TVL、活跃地址、交易量和费用都不能单独代表真实增长。
  • 原始数据、ABI 解码、标签与价格属于不同数据层,可信边界也不同。
  • 资金追踪应从交易锚点出发,统一口径、分类对手方并保留可复现证据。
  • 结论要同时写证据、口径和局限,事实与推断分开表达。

如何核验真实数据:把"别人给的数字"变成"自己查的结论"

公开渠道常见的是汇总后的"持币地址数、LP 底池、流通市值、日交易笔数"等营销口径数字。做研究时要把它们还原成可核验的链上事实,而不是直接照抄。

常见口径
应如何核验
持币地址数
区分独立地址与内部流转,统计可能含 0 持仓或关联地址
LP 底池 / 流通市值
按合约地址查两侧储备与真实流通量,区分协议自持与外部
日交易笔数 / Gas
用区块浏览器统计真实交易与活跃度,排除刷量与同地址互转
历史对比
用固定区块高度保存快照,避免"今天余额解释过去"

原则:任何"暴增""第一"的结论都回到合约地址、区块高度与多源交叉核验,区分营销口径与链上事实。

📝 本节自测

链上分析第一步通常是?

分析资金流向应关注?

验证历史交易可用?

判断:链上数据绝对准确无需交叉核验。

得分:0 / 4
返回课程列表继续浏览学习学院