
5 分钟跑通 Telegraf最小配置的指标采集代理入门【免费下载链接】telegrafAgent for collecting, processing, aggregating, and writing metrics, logs, and other arbitrary data.项目地址: https://gitcode.com/GitHub_Trending/te/telegraf刚接手一批新机器要按 10 秒的粒度采集 CPU、内存指标最后落到 InfluxDB 或 Kafka。不想为此再装一套带 JVM 的重型 agentTelegraf 就是干这件事的一个 TOML 配置驱动的轻量指标采集代理编译成单个静态二进制没有外部依赖插件超过 300 个当前版本 1.40.0。先判断 Telegraf 适不适合你它是一个 agent从输入插件收集指标经处理器/聚合器加工再由输出插件写出去覆盖收集-加工-写入整条链路适合自托管 Linux 服务器、容器环境需要从系统、数据库、中间件等多源采集并写入 InfluxDB、Kafka 或文件不适合已经用云厂商托管监控且不想自建或者主要诉求是复杂日志流计算——它的 processors 擅长字段转换和重命名不是完整的流计算引擎三条 Telegraf 安装路线按环境挑一条路线做法适合场景Docker推荐先跑通拉镜像、挂载本地配置即可运行试验、开发机静态二进制下载对应平台二进制放进 PATH无外部依赖生产服务器、离线环境包管理器DEB/RPM 官方源或 Homebrewbrew install telegraf发行版标准环境Docker 路线只有两条命令拉取镜像并把本地配置挂进容器docker pull telegraf docker run --rm --volume $PWD/config.toml:/etc/telegraf/telegraf.conf telegraf完整方式含各发行版源配置见 docs/INSTALL_GUIDE.md。最小配置 3 行跑通第一次采集一份 Telegraf 配置最少只需要一个输入和一个输出。下面这个最小配置启用 CPU、内存采集把结果写到标准输出[[inputs.cpu]] [[inputs.mem]] [[outputs.file]]二进制装好后把配置传给它启动telegraf --config config.toml成功标志启动时先打印版本号、加载的插件列表随后每 10 秒刷出一批行协议格式的指标file 输出默认写到 stdout类似mem,hostweb01 used_percent54.4,available3.4Gi 1700000000000000000 cpu,hostweb01,cpucpu0 usage_user3.4,usage_idle95.4 1700000000000000000看到这行式指标滚动出来说明采集链路已经通了。配置骨架4 个高频参数看懂全局Telegraf 配置采用 TOML 格式核心就是四块全局标签、agent 设置、inputs、outputs。其中 4 个参数覆盖了 80% 的日常调整[agent] interval 10s # 所有输入插件的采集间隔 round_interval true # 采集时间点对齐到 interval 整数倍 flush_interval 10s # 所有输出插件的刷新间隔 metric_batch_size 1000 # 单次批量发送的指标数 [global_tags] cluster ${CLUSTER_NAME} # 附加到所有指标的标签支持环境变量interval管采集节奏round_interval让多台机器的采集点对齐方便聚合global_tags给所有指标打公共标签多环境部署时非常有用配置值支持${VAR}环境变量写法密码、地址这类敏感信息别硬编码在文件里其余选项很多直接查 docs/CONFIGURATION.md不用背。功能实战三个高频场景把现有 MySQL 和 Redis 加进监控需求库里跑着业务想把实例状态指标也采起来。inputs 和 outputs 一样是插件数组追加两个段落即可密码用环境变量注入[[inputs.mysql]] servers [user:passwordtcp(127.0.0.1:3306)/?tlsfalse] [[inputs.redis]] servers [tcp://localhost:6379] password ${REDIS_PASSWORD}效果按 interval 周期输出各实例的状态指标比如 Redis 的used_memory、used_memory_peak。每个插件的完整参数和示例输出都写在 plugins/ 下对应目录的 README 里照着改就行。输出目标换成 Kafka需求指标不落库先进消息队列由下游消费。把输出插件从 file 换成 kafka[[outputs.kafka]] brokers [localhost:9092] topic telegraf data_format influx效果指标按 InfluxDB 行协议序列化后写入指定 topicdata_format支持的其它格式JSON、Carbon 等见数据格式文档。先验证配置再上生产需求改完配置不敢直接重启生产进程。不用起完整服务--test只跑输入并把结果打到 stdouttelegraf --config telegraf.conf --test看到这轮指标正常打印说明配置没问题可以放心交给 systemd 或容器托管。进阶方向点到为止处理器在采集与输出之间重命名字段、转换单位、过滤指标见 docs/AGGREGATORS_AND_PROCESSORS.md聚合器按周期计算均值、分位数等派生指标与处理器文档放在一起讲版本与命令细节子命令、flag 全量说明在 docs/COMMANDS_AND_FLAGS.md排错速查表常见现象自查动作启动后没有指标也没报错检查配置里是否至少有一对[[inputs.*]]和[[outputs.*]]不确定配置能否采到数据跑telegraf --config xxx --test只执行输入、输出到 stdout怀疑连接失败或采集异常启动时加--debug看详细日志只想跑一轮验证后退出用--once完成一次采集和刷新即退出二进制来源不明、版本不符telegraf version确认版本telegraf help查看全部子命令资源地图docs/QUICK_START.md本文对应的官方快速上手流程docs/INSTALL_GUIDE.md二进制、Docker、DEB/RPM 全安装路线docs/CONFIGURATION.mdagent 参数、插件通用选项、环境变量docs/COMMANDS_AND_FLAGS.md--test、--debug、--once等命令行参考plugins/300 多个插件每个目录自带 README 和样例配置先在一台试验机上用最小配置把系统指标采起来是最快的入门路径。跑通后到 plugins/ 里按 inputs、outputs 目录挑选要加的数据源对照各插件 README 调参。等数据稳定流动再考虑用处理器和聚合器加工指标一步到位反而容易卡住。【免费下载链接】telegrafAgent for collecting, processing, aggregating, and writing metrics, logs, and other arbitrary data.项目地址: https://gitcode.com/GitHub_Trending/te/telegraf创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考