ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

三步部署Telegraf:从系统指标采集到第一条监控数据

三步部署Telegraf:从系统指标采集到第一条监控数据 三步部署Telegraf从系统指标采集到第一条监控数据【免费下载链接】telegrafAgent for collecting, processing, aggregating, and writing metrics, logs, and other arbitrary data.项目地址: https://gitcode.com/GitHub_Trending/te/telegraf你需要盯住服务器的 CPU、内存和磁盘又不想被繁琐的部署流程拖累。Telegraf 是一个轻量的插件式指标采集代理单文件即可运行三步之内就能把第一份系统监控数据打印到终端。下面带你完整走一遍。为什么选它Telegraf 是一款插件驱动的 Agent代理程序它通过输入插件从各类数据源采集指标再交给输出目标如文件、InfluxDB、Kafka写入中途还可以做清洗和聚合。它属于 InfluxData 时序数据平台的一部分支持超过 200 种插件覆盖面从操作系统到各类中间件。核心优势单一静态二进制文件没有运行时依赖拷过去就能跑资源占用低通常低于 5% CPU、约 10MB 内存插件生态丰富输入、输出、处理器、聚合器四类插件 200 多个安装与准备 这一步给你两种最通用的安装方式按手头的系统任选其一。Docker 部署适合开发和测试环境最省事。docker pull telegraf docker run --rm --volume $PWD/telegraf.conf:/etc/telegraf/telegraf.conf telegraf二进制安装适合生产环境的 Linux 服务器。先从官方发布页下载对应系统的压缩包再执行tar -zxvf telegraf-1.26.0_linux_amd64.tar.gz cd telegraf-1.26.0_linux_amd64 sudo cp telegraf /usr/local/bin/Debian/Ubuntu 或 CentOS/RHEL 也可以直接用 apt-get、yum 从软件源安装各系统的前置条件见安装指南。三步看到数据 本节的目标从零开始5 分钟内让第一条监控数据出现在终端里。第 1 步准备最小配置。可以先跑telegraf config telegraf.conf生成全量默认配置感受格式然后另存一个精简版minimal.conf只留 CPU、内存和终端输出[agent] interval 10s # 采集间隔 10 秒 round_interval true # 对齐到整点时间采集 [[inputs.cpu]] percpu true totalcpu true [[inputs.mem]] [[outputs.file]] files [stdout] # 输出到终端其中[[inputs.*]]是输入插件负责采数据[[outputs.*]]是输出目标决定数据发往哪里。第 2 步启动 Agent。telegraf --config minimal.conf第 3 步验证输出。启动约 10 秒后终端会滚动出这样的行cpu,hostserver01,cpucpu0 usage_user3.4,usage_system1.2,usage_idle95.4 1654321098765 mem,hostserver01 available3423456768i,available_percent45.6,used_percent54.4 1654321098765前半段是指标名、标签和字段值末尾的数字是时间戳说明采集链路已经通了。扩展采集范围这一节挑三个最高频的场景按场景 配置 点评给你往配置里按需加块即可。系统监控磁盘与网卡。[[inputs.diskio]] devices [sda, sdb] # 只监控指定磁盘 skip_serial_number true [[inputs.net]] interfaces [eth0, eth1] # 只监控指定网卡磁盘 IO 和分网卡流量是排查资源瓶颈时最先要看的数据。数据库监控MySQL 与 Redis。[[inputs.mysql]] servers [user:passwordtcp(mysql:3306)/] [[inputs.redis]] servers [tcp://redis:6379] password ${REDIS_PASSWORD} keys [user_count, session_count]密码这类敏感值建议一律用${环境变量}占位不要硬编码进配置文件。输出目标同一份数据发多处。[[outputs.file]] files [stdout, /var/log/telegraf/metrics.out] data_format json [[outputs.kafka]] brokers [kafka:9092] topic telegraf_metrics data_format influx多个输出块可以同时生效data_format一行就能切换写入格式。全部可用插件在插件目录里按类别组织。清洗与聚合数据处理器Processor在采集和输出之间转换指标聚合器Aggregator在一段时间窗口上计算统计值两者都通过配置块启用。用 rename 处理器改字段名[[processors.rename]] [[processors.rename.replace]] field usage_idle dest idle用 basicstats 聚合器算周期统计[[aggregators.basicstats]] period 5m # 每 5 分钟聚合一次 drop_original false # 保留原始数据点 stats [mean, min, max]两者都不改采集逻辑只作用于流经的指标试错成本低。避坑清单1. 配置写错程序直接退出。症状启动后立刻报错退出。 验证telegraf --config telegraf.conf --test解决按报错提示的行号检查重点看 TOML 的引号配对和数组逗号。2. 指标采到了但输出里没有。症状终端看不到预期指标。 验证在[agent]里加debug true和logfile /var/log/telegraf/telegraf.log看日志里指标是否被过滤。 解决检查输出侧的 namepass、tagdrop 等过滤条件是否把数据全排掉了。3. 不确定某个插件名怎么写。症状插件拼写拿不准配置不生效。 验证telegraf plugins解决该命令列出当前构建可用的全部插件直接对照名称。4. 敏感信息明文写在配置里。症状token、密码以明文出现在配置文件中。 验证grep -n password telegraf.conf解决全部替换为${INFLUX_TOKEN}这类环境变量写法。深入资源安装指南各操作系统的安装方式与前置条件快速启动官方从启动到首次输出的完整教程配置参考Agent 与插件参数全解含环境变量用法处理器与聚合器数据清洗和聚合的进阶用法命令参考所有命令行选项说明安全实践涉及凭据与传输时的安全配置建议如果你要给少量服务器补齐基础监控Telegraf 是投入很低的起步方案装完即可出数据配置按块增删。对 DevOps、系统管理员和开发者来说它可以作为采集层直接对接时序数据库后续再按需要叠加处理器和聚合器。【免费下载链接】telegrafAgent for collecting, processing, aggregating, and writing metrics, logs, and other arbitrary data.项目地址: https://gitcode.com/GitHub_Trending/te/telegraf创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表