OpenObserve 快速部署指南:10 分钟让日志、指标与追踪全部可查
OpenObserve 快速部署指南10 分钟让日志、指标与追踪全部可查【免费下载链接】openobserveOpen source observability platform for logs, metrics, traces, frontend monitoring, pipelines and LLM observability. A sophisticated, simple and highly performant alternative to Datadog, Splunk, and Elasticsearch with 140x lower storage costs and single binary deployment.项目地址: https://gitcode.com/GitHub_Trending/op/openobserveOpenObserve 是一个开源、可自托管的可观测性平台日志、指标、追踪用同一个二进制存储用 SQL 和 PromQL 直接查。它解决的核心问题是——不想为日志平台付出高昂的存储成本和复杂的集群运维但又要全栈可观测。 它适合谁想替代 Datadog / Splunk / Elasticsearch 的自托管方案全功能开源版单二进制部署不绑供应商已在使用 OpenTelemetry原生支持 OTLP日志、指标、追踪三类信号同一协议接入不想维护集群参数没有分片、副本、堆大小这些需要调的东西装完即用先跑起来前提是有一台 Linux 机器4GB 内存起步并开放 5080 端口。最短路径是 Docker数据默认持久化在/data前两个环境变量是首次启动的初始管理员凭据仅第一次生效docker run -d --name openobserve \ -v $PWD/data:/data -p 5080:5080 \ -e ZO_ROOT_USER_EMAILrootexample.com \ -e ZO_ROOT_USER_PASSWORDComplexpass#123 \ public.ecr.aws/zinclabs/openobserve:latest浏览器打开http://localhost:5080用上面设置的邮箱和密码登录首次会提示你命名一个组织org命名后进入主界面。本地模式下数据落在ZO_DATA_DIR指向的目录默认./data/openobserve/。如果你的场景是 K8s仓库里有一份可直接参考的 StatefulSet 清单deploy/k8s/statefulset.yaml。从源码构建可选需要 Rust nightly 工具链版本由 rust-toolchain.toml 锁定和 protoc 3.15。先构建前端再编后端git clone https://gitcode.com/GitHub_Trending/op/openobserve cd openobserve/web npm install npm run build cd .. cargo build --release完整的环境搭建细节见 CONTRIBUTING.md。让数据进来OpenObserve 的摄入接口在 src/api/ingest/ 中定义常用的接入方式有四种OpenTelemetryOTLP把 OTel SDK 或 Collector 的 OTLP exporter 指向本实例的 5080 端口即可日志、指标、追踪三类信号都支持protobuf 与 JSON 两种编码都收HTTP JSON用任意语言的 HTTP 客户端直接向 JSON 摄入接口写日志适合已有自定义采集脚本的场景Prometheus remote write在 Prometheus 的remote_write配置中加上本实例地址指标即可流入Fluent Bit / Fluentd在采集代理中把输出指向 OpenObserve适合从现有主机日志体系中迁移一个实用约束数据默认允许补传 5 小时内ZO_INGEST_ALLOWED_UPTO的历史超出该窗口的旧数据会被拒绝。如果你的采集端有时钟漂移或重放需求先调这个参数再排查数据丢失。 让数据被看见数据进来之后查询语言只有两种日志和追踪用 SQL指标用 SQL 或 PromQL。没有私有查询语言要学。日志支持全文搜索、字段过滤和 SQL 混写界面上有字段浏览器先按字段收敛范围再聚合比无脑全文检索快得多指标左侧按名称浏览指标预览时间序列后直接拖进面板追踪按服务、耗时、错误状态筛 trace点开单条可以看瀑布图和火焰图仪表板19 种图表类型面板支持模板变量比如把 namespace 做成下拉框仪表板建议从少而准开始一个面板对应一个业务问题错误率、P99 延迟、QPS而不是一次性铺开几十个。进阶只挑最值得用的 2-3 个功能按投入产出排序最值得先上手的三个功能告警基于阈值、定时查询或实时规则也支持异常检测触发后走 Webhook、邮件等通知渠道。仓库内置的目的地模板见 config/prebuilt-destinations.json照着配能省不少事管道Pipelines可视化编辑器里用 VRL 函数做解析、过滤、脱敏还能把日志流转成指标。数据在入口被规整一次后面所有查询和存储都受益服务依赖图Service Graph从追踪数据自动聚合出服务间调用关系按健康状态着色定位哪个下游拖慢了我比翻 trace 快性能与成本OpenObserve 的存储层设计决定了它的成本曲线Parquet 列式压缩 对象存储S3原生布局官方口径的存储成本相比 Elasticsearch 最多可降 140 倍。优化点说明存储Parquet 列式 S3 原生冷数据直接躺在对象存储里无热/温/冷分层运维查询剪枝时间分区 索引 Bloom 过滤器大多数查询可减少 99% 的搜索空间索引策略只给高频过滤字段建索引full-text 与 index 分开配置避免全字段索引查询习惯先收窄时间范围和字段再做聚合避免对宽时间窗全文检索调优项基本没有——不存在分片、副本、堆内存这类参数压缩与文件合并由后台作业自动完成实现见 src/compaction/你不需要手动触发。 卡住了怎么办打不开 5080 端口确认容器在运行且端口没被占用docker ps 端口检查本地模式磁盘不足时服务会起不来先看容器日志登录不上管理员账号只在容器首次初始化时生效。之后想换账号需要清掉/data目录重新初始化老数据会丢操作前先备份数据写进去了查不到核对 org 名和 stream 名是否拼写一致确认采集端时间戳没有落在 5 小时补传窗口之外确认查询时间范围覆盖数据写入时刻查询特别慢缩小时间窗、把全文检索改成按字段过滤、检查是否对低基数字段建了 full-text 索引接下来做什么把现有的 OTel Collector 或 Fluent Bit 指向本实例先跑 24 小时真实数据建第一块仪表板错误率、P99 延迟、QPS 三个面板配一条阈值告警接到你团队的 IM 或 Webhook更多功能与架构细节可以直接翻 README.md。【免费下载链接】openobserveOpen source observability platform for logs, metrics, traces, frontend monitoring, pipelines and LLM observability. A sophisticated, simple and highly performant alternative to Datadog, Splunk, and Elasticsearch with 140x lower storage costs and single binary deployment.项目地址: https://gitcode.com/GitHub_Trending/op/openobserve创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考