当前位置:首页 >专题 >OpenTelemetry GenAI 与 Agent 可观测性工程专题
OpenTelemetry GenA
OpenTelemetry GenAI 与 Agent 可观测性工程专题
从模型调用、Agent Trace 到 OTLP 管道与上线治理
AI 应用上线后,真正难排查的往往不是模型能否返回结果,而是一次任务经过了哪些模型、工具、检索和人工确认,以及延迟、token、错误和隐私风险发生在哪一段。本专题以 OpenTelemetry GenAI 语义约定和 Go 生态为主线,帮助开发者把 Agent 执行链路变成可检索、可度量、可复盘的工程数据。
官方入口与观测规范
先统一 GenAI 字段、Trace 关系、Go SDK 和 OTLP 管道
官方
OpenTelemetry 官方网站
OpenTelemetry 官方入口,覆盖 traces、metrics、logs、Collector、SDK 和生态组件。
官方
OpenTelemetry GenAI 语义约定
官方 GenAI 语义约定,说明模型、供应商、操作、token 和内容事件等遥测字段。
官方
OpenTelemetry Trace 概念
官方 Trace、span、属性、事件和上下文传播概念说明。
官方
OpenTelemetry Go 文档
Go 官方文档,覆盖 SDK、手动埋点、资源、导出器和示例。
官方
OpenTelemetry Collector 文档
Collector 官方文档,介绍接收、处理、采样、脱敏和导出遥测数据。
官方
OpenTelemetry Go 官方仓库
OpenTelemetry Go SDK 官方源码、示例、发布和问题跟踪入口。
官方
OpenTelemetry 语义约定仓库
语义约定官方仓库,包含 GenAI、HTTP、数据库和通用属性的版本演进。
GenAI 可观测性常见问题
字段、隐私、采样与上线验收的实用答案
AI Agent 一次任务应该拆成哪些 span?
至少区分任务、模型调用、工具调用、检索、护栏和人工确认;跨服务时通过上下文传播连接父子关系,并为每段记录状态、耗时和错误。
要不要把完整 Prompt 和模型回复写进 Trace?
默认不应记录完整内容。优先保存模型、token、耗时、长度、哈希、模板版本和脱敏摘要;确需采样时要设置权限、保留期和开关。
OpenTelemetry GenAI 字段还在变化,生产怎么用?
区分 stable、development 和 experimental 字段,封装业务自己的映射层,记录 schema URL 与版本,并在 Collector 或后端升级前做回归。
Agent Trace 上线验收至少看哪些指标?
至少观察任务成功率、模型和工具错误率、端到端延迟、各 span 延迟、token 与成本、重试、人工接管、拒绝和上下文溢出。
相关专题
继续查看相近方向内容
查看更多
最新文章
-
- Go Benchmark报告allocs/op并定位临时对象来源的方法
- 2天前 409浏览
-
- Redis Sentinel故障转移期间客户端重连的配置方法
- 2天前 108浏览
-
- 商汤Seko能做AI短剧工具吗?功能范围和适用场景
- 2天前 493浏览
-
- MySQL 复合索引跳过最左列时的访问边界
- 2天前 244浏览
-
- Go fuzz测试把崩溃输入写入回归语料的流程
- 2天前 195浏览
-
- 商汤Seko批量产出怎么做抽样验收?首件全检、过程抽检与批尾复核
- 2天前 337浏览
-
- 紫灰玻璃花房手机壁纸用半透明层次适配深色模式
- 2天前 369浏览

