
e2e用量追踪详解tokens、model calls与成本报表怎么看【免费下载链接】e2eNext generation e2e testing framework for web and mobile apps.项目地址: https://gitcode.com/GitHub_Trending/e2e6/e2e让 AI Agent 替你跑 E2E 测试就绕不开两件事烧了多少tokens、花了多少钱。e2e是面向 Web 与移动端的下一代 E2E 测试框架它的用量追踪体系会把每次模型调用的 tokens、model calls模型调用次数与估算成本结构化地写进运行报告帮你看清每一分钱花在哪。本文带你从零看懂这些数字。为什么 e2e 测试要追踪 tokens 和模型调用 传统 E2E 框架只关心通过/失败而 e2e 的 Agent 模式如agent.act由大模型驱动每一步都要观察屏幕 → 调用模型决策 → 执行动作。模型调用意味着延迟一次调用几百毫秒到几秒成本按 input/output tokens 计费波动缓存命中率直接影响账单所以 e2e 从事件层到报告层都内建了用量核算相关逻辑集中在 packages/e2e/src/agent/usage.ts报告聚合在 packages/e2e/src/report/build.ts。用量数据的三层结构事件 → 步骤 → 运行 理解 e2e 的用量报表先记住它是一个三层漏斗层级记什么在哪里看① 模型事件单次调用的 inputTokens / outputTokens / reasoning 摘录步骤的events列表② 步骤Step该步骤的 modelCalls、峰值 tokens、缓存拆分、估算成本步骤的model字段③ 运行Run整个运行的总调用数、总 tokens、缓存比例、总成本report.json的usage第①层模型事件。每次模型调用都会产生一条model类型事件记录inputTokens和outputTokens供应商上报时才有字段定义见 packages/e2e/src/run/steps.ts。列表式报告器会为每个这样的事件追加显示⬆1.2k ⬇340这样的 tokens 拆分实现在 packages/e2e/src/report/list-steps.ts。第②层步骤汇总。每个 Agent 步骤结束时会聚合出完整的模型信息核心字段包括calls调用次数、peakTokensPerCall单次峰值、inputTokens/outputTokens合计、cacheReadTokens/cacheWriteTokens提示缓存读写以及estimatedCostUsd估算成本结构定义见 packages/e2e/src/run/steps.ts。第③层运行汇总。整个 run 结束后报告把每个步骤的用量累加成一份总账usage中包含calls、tokens、inputTokens、cachedTokens与costUsd聚合逻辑见 packages/e2e/src/report/format.ts。成本报表怎么看三个最常用的视图 1. 终端列表视图一眼看到缓存命中率运行结束的控制台摘要会输出形如· 87% cached的缓存比例——它等于缓存读取 tokens ÷ 总 input tokens。命中率高意味着供应商按低价缓存价计费账单会显著下降。计算逻辑就在 packages/e2e/src/report/format.ts。2. Markdown 报告带上总成本的正式报告使用 markdown 报告器时报告头部会直接附上整次运行的估算成本美元例如≈ $0.42见 packages/e2e/src/report/markdown.ts。3. 调试视图逐步骤核对 tokens 与花费需要排查哪一步最烧钱时调试视图会按步骤打印input/output tokens和每步成本并汇总总成本实现在 packages/e2e/src/report/debug-steps.ts。关键名词速查表 名词含义modelCalls/calls该步骤实际发出的模型请求次数缓存回放命中时可为 0inputTokens/outputTokens输入 / 输出 tokens 合计缓存读取部分已含在 input 内不是额外叠加peakTokensPerCall单次调用的最大 tokens用于评估上下文是否逼近模型窗口cacheReadTokens供应商从提示缓存直接返回的输入 tokens低价计费tokenAccounting数值来源provider供应商上报权威或adapter-upper-bound适配器估算上界estimatedCostUsd供应商给出的估算成本供应商不报价时该字段整体缺省而不是 0cost_source遥测字段provider表示有供应商计价none表示有调用但无人计价省钱三招把账单看明白 盯缓存命中率连续步骤间大量重复的提示内容会被提示缓存命中cacheReadTokens越高越好。看 tokenAccounting 是否可信只要有一次调用没上报完整 token 数整个步骤会被标为adapter-upper-bound此时总量只是上界估计见 packages/e2e/src/agent/usage.ts。选会报价的供应商只有供应商回报了成本报表里才会出现estimatedCostUsd否则你只能看到 tokens 而看不到美元数。完整的遥测字段说明包括model_calls、model_tokens、model_cached_tokens、estimated_cost_usd如何随运行事件上报见官方文档 docs/telemetry.mdx。新手常见疑问 FAQ Q为什么我的报表里没有成本字段Ae2e 不会自己编价格——成本由模型供应商回报供应商不报价时字段直接缺省属于正常现象。Q缓存 tokens 会重复计费吗A不会。cacheReadTokens是inputTokens的子集报表明确注释了Cached reads are part of inputTokens, not in addition to it见 packages/e2e/src/run/steps.ts。QmodelCalls 是 0 的步骤算失败吗A不算。当缓存回放完整命中时步骤以零模型调用直接通过这正是 e2e 回放缓存省钱的机制。小结 ✅e2e 的用量追踪按事件 → 步骤 → 运行三层逐级聚合事件层给你每次调用的 tokens 拆分步骤层给你 modelCalls、峰值与缓存明细运行层给你总账和估算成本。看懂tokenAccounting和cost_source这两个可信度标记你就能准确判断报表数字是供应商权威值还是适配器估算——从此 AI E2E 测试的账单不再有糊涂账。【免费下载链接】e2eNext generation e2e testing framework for web and mobile apps.项目地址: https://gitcode.com/GitHub_Trending/e2e6/e2e创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考