Skip to content

一句话总结:Agent 可观测性 = Logs + Metrics + Traces 三支柱 + 统一语义约定;OTel GenAI SemConv 定义 gen_ai.* 属性与 Agent Span(invoke_agent/plan/tool),让 Agent 不再黑盒——模型调用、工具执行、Token 用量实时可见。

三支柱(面试默写)

信号内容Agent 场景
Logs日志事件推理过程、工具结果
Metrics指标延迟、Token、错误率
Traces链路追踪一次请求完整链路
Events事件Agent 决策点(OTel 三信号+Events)

OTel GenAI 语义约定(SemConv)

  • 2024 年初推动,统一 AI 可观测数据采集规范;属性命名空间 gen_ai.*
  • Model Span 属性
    • gen_ai.request.modelgen_ai.provider.name(模型信息)
    • gen_ai.usage.input_tokens / output_tokens(Token 统计)
    • gen_ai.response.finish_reason("stop")
  • 8 种操作类型;OTLP 导出到任何 GenAI 感知后端直接可用

Agent Span(拉分点)

Span含义
invoke_agent调用 Agent(远程/同进程)
create_agent创建 Agent
plan规划/任务分解阶段
gen_ai.agent.name/idAgent 标识
gen_ai.tool.name / call.id工具调用
  • 基础:Google AI agent 白皮书;AgentTelemetry 是 OTel 超集(新增 5 种编排 span 类型,完全兼容)
  • 价值:可观测性是安全第一性原理——先看见,才能防

面试要点

  • 能默写三支柱(Logs/Metrics/Traces)
  • 能报 Model Span 关键属性(gen_ai.usage.*)
  • 能讲 Agent Span(invoke_agent/plan/tool)
  • 能说 OTel SemConv 价值(统一口径、任意后端可用)

相关概念

  • [AI-Agent-可观测性与评估工程](/学习笔记/AI技术/AI Agent/AI-Agent-可观测性与评估工程) — 概念总览
  • [AI-Agent-监控工具与平台](/学习笔记/AI技术/AI Agent/AI-Agent-监控工具与平台) — 工具落地
  • [AI-Agent-生产部署与告警](/学习笔记/AI技术/AI Agent/AI-Agent-生产部署与告警) — 上线运维
  • [AI-Agent-安全评估与红队](/学习笔记/AI技术/AI Agent/AI-Agent-安全评估与红队) — 可观测即安全