给 AI Agent 装上「黑匣子」:用 OpenTelemetry + OpenInference 手写可观测性(附 Python 实战)📖 摘要:只有约 5% 的企业级 Agent 能真正上生产,根因往往不是模型不行,而是「看不见」——它选了哪个工具、为什么跑偏、烧了多少 token,全靠猜。本文用 OpenTelemetry + OpenInference 语义约定,从零手写一个最小 Agent Tracer,覆盖 Span/Trace/Thread 层级模型、LLM 与工具调用埋点、OTLP 导出对接 Langfuse/Phoenix,并落地「轨迹/质量/安全/成本」四大监控支柱与三条生产避坑清单。读完你能给自己的 Agent 装上