目录
强大的性能,无限的扩展能力
收集、组织和处理海量高速数据。当您将任何数据视为时间序列数据时,它都更有价值。借助 InfluxDB,这个排名第一的时间序列平台旨在与 Telegraf 一起扩展。
查看入门方法
输入和输出集成概览
此输入插件从 Mesos 收集指标。
此插件使用基于 HTTP 的 Prometheus 远程写入协议将 Telegraf 的指标发送到 Thanos,从而可以高效且可扩展地摄取到 Thanos Receive 组件中。
集成详情
Mesos
Telegraf 的 Mesos 插件旨在收集和报告来自 Apache Mesos 集群的指标,这对于容器编排和资源管理中的监控和可观测性至关重要。Mesos 以其可扩展性和管理各种工作负载的能力而闻名,它生成有关资源使用、任务、框架和整体系统性能的各种指标。通过使用此插件,用户可以跟踪其 Mesos 集群的健康状况和效率,收集有关资源分配的见解,并确保应用程序及时获得必要的资源。配置允许用户指定相关的 Mesos 主节点详细信息,以及要收集的所需指标组,使其能够适应不同的部署和监控需求。总的来说,该插件无缝集成到 Telegraf 收集管道中,为云原生环境提供详细的可观测性支持。
Thanos
Telegraf 的 HTTP 插件可以通过其 Remote Write 兼容的接收组件将指标直接发送到 Thanos。通过将数据格式设置为 prometheusremotewrite
,Telegraf 可以将指标序列化为原生 Prometheus 客户端使用的相同的基于 protobuf 的格式。此设置实现了到 Thanos 中的高吞吐量、低延迟指标摄取,从而促进了大规模的集中式可观测性。这在混合环境中尤其有用,在这些环境中,Telegraf 从 Prometheus 原生范围之外的系统(例如 SNMP 设备、Windows 主机或自定义应用程序)收集指标,并将它们直接流式传输到 Thanos 以进行长期存储和全局查询。
配置
Mesos
[[inputs.mesos]]
## Timeout, in ms.
timeout = 100
## A list of Mesos masters.
masters = ["http://localhost:5050"]
## Master metrics groups to be collected, by default, all enabled.
master_collections = [
"resources",
"master",
"system",
"agents",
"frameworks",
"framework_offers",
"tasks",
"messages",
"evqueue",
"registrar",
"allocator",
]
## A list of Mesos slaves, default is []
# slaves = []
## Slave metrics groups to be collected, by default, all enabled.
# slave_collections = [
# "resources",
# "agent",
# "system",
# "executors",
# "tasks",
# "messages",
# ]
## Optional TLS Config
# tls_ca = "/etc/telegraf/ca.pem"
# tls_cert = "/etc/telegraf/cert.pem"
# tls_key = "/etc/telegraf/key.pem"
## Use TLS but skip chain & host verification
# insecure_skip_verify = false
Thanos
[[outputs.http]]
## Thanos Receive endpoint for remote write
url = "http://thanos-receive.example.com/api/v1/receive"
## HTTP method
method = "POST"
## Data format set to Prometheus remote write
data_format = "prometheusremotewrite"
## Optional headers (authorization, etc.)
# [outputs.http.headers]
# Authorization = "Bearer YOUR_TOKEN"
## Optional TLS configuration
# tls_ca = "/path/to/ca.pem"
# tls_cert = "/path/to/cert.pem"
# tls_key = "/path/to/key.pem"
# insecure_skip_verify = false
## Request timeout
timeout = "10s"
输入和输出集成示例
Mesos
-
资源利用率监控:使用 Mesos 插件持续监控 Mesos 集群中的 CPU、内存和磁盘使用率。对于快速扩展的应用程序,跟踪这些指标有助于确保根据工作负载动态分配资源,从而防止瓶颈并优化性能。
-
框架性能分析:集成此插件以衡量在 Mesos 上运行的不同框架的性能。通过比较活动框架及其任务成功率,您可以确定哪些框架提供最佳资源效率或可能需要优化。
-
系统健康警报:根据 Mesos 插件收集的指标设置警报,以便在资源利用率超过关键阈值或特定任务失败时通知工程团队。这允许在发生严重故障之前进行主动干预和维护。
-
容量规划:利用收集的指标分析历史资源使用模式,以协助容量规划。通过了解峰值负载和资源利用率趋势,团队可以就扩展基础设施和根据需要部署额外资源做出明智的决策。
Thanos
-
无代理云监控:在云虚拟机上部署 Telegraf 代理以收集系统和应用程序指标,然后使用 Remote Write 将它们直接流式传输到 Thanos 中。这提供了集中式可观测性,而无需在每个位置都部署 Prometheus 节点。
-
可扩展的 Windows 主机监控:在 Windows 机器上使用 Telegraf 收集操作系统级别的指标,并通过 Remote Write 将它们发送到 Thanos Receive。这实现了跨异构环境的可观测性,而 Prometheus 原生仅在 Linux 上支持。
-
跨区域指标联合:多个地理区域中的 Telegraf 代理可以使用此插件将数据推送到区域本地 Thanos 接收器。从那里,Thanos 可以全局地去重和查询指标,从而减少延迟和网络出口成本。
-
将第三方数据集成到 Thanos 中:使用 Telegraf 输入从自定义遥测源(例如 REST API 或专有日志)收集指标,并通过 Remote Write 将它们转发到 Thanos。这会将非原生数据引入到 Prometheus 兼容的长期分析管道中。
反馈
感谢您成为我们社区的一份子!如果您有任何一般性反馈或在这些页面上发现任何错误,我们欢迎并鼓励您提出意见。请在 InfluxDB 社区 Slack 中提交您的反馈。
强大的性能,无限的扩展能力
收集、组织和处理海量高速数据。当您将任何数据视为时间序列数据时,它都更有价值。借助 InfluxDB,这个排名第一的时间序列平台旨在与 Telegraf 一起扩展。
查看入门方法