AIGC BOT WEEKLY / 2026.08.09

Agent 可观测周报:先验收一条安全、可关联的 trace

OpenTelemetry Demo 3.0 把 Agent、模型与 MCP 工具调用放进同一条遥测路径。本期只把官方资料中可核对的实现当作来源事实;站内判断是:与其先追求一张漂亮仪表盘,不如先用 45 分钟验收一条脱敏、可关联、标明约定版本的 trace。

本期周期
2026-07-27 - 2026-08-02
发布时间
2026-08-09
榜单口径
站内编辑研究入口,不代表 GitHub 官方排名

SOURCE-LINKED SIGNALS

先分清来源事实,再写自己的判断。

OBSERVABILITY / 端到端链路

Demo 3.0:Agent 到工具的调用进入同一条 Collector 路径

可核对事实
OpenTelemetry 官方在 2026 年 7 月 28 日介绍 Demo 3.0:新增的 LangGraph ReAct Agent 可调用原生工具与 MCP 工具,Chatbot、Agent、MCP 和后端服务产生的遥测统一流经 OpenTelemetry Collector。
为什么值得写进验证卡
这张卡值得保留,因为它把“能看到一次模型调用”与“能沿父子关系复盘 Agent 选择、工具执行和结果返回”区分开;后者才是本期实验要验证的链路边界。
OpenTelemetry Demo 3.0 article

AI / 可复现样例

3.0.0 Agent 文档:固定请求可以替代真实客户提示词

可核对事实
OpenTelemetry Demo 3.0.0 的版本化 Agent 文档描述了 FastAPI 入口、原生与 MCP 工具、OTLP 导出配置,并提供无需实时 LLM 访问的预置请求和用于确定性测试的 VCR 回放。
为什么值得写进验证卡
这张卡值得保留,因为验收遥测不必从真实客户提示词或付费模型调用开始;可以先用固定、无敏感信息的样例验证服务边界和字段契约。
OpenTelemetry Demo 3.0 Agent docs

DATA / 字段契约

GenAI normalizer:标准字段与原始字段需要同时辨认

可核对事实
Demo 的已合并 PR #3604 把 OpenLLMetry/Traceloop 属性映射为 `gen_ai.*` 属性,同时保留原始属性;该 PR 明确记录所用 normalizer processor 在当时为 Alpha 稳定性。OpenTelemetry 也已把 GenAI 约定迁移到独立仓库。
为什么值得写进验证卡
这张卡值得保留,因为字段名相同不代表语义、版本和数据安全边界已经稳定;验证卡必须写明来源格式、目标约定和版本,避免查询在升级后悄悄失效。
OpenTelemetry Demo gen_ai_normalizer PR

本周行动实验

45 分钟,做出继续或停止的依据。

实验目标
判断现有遥测能否安全地连接一次 Agent、模型与工具调用,并留下可重复验收的字段契约。
时间边界
45 分钟 / 无需部署整套 Demo;只用脱敏样例、已有 trace JSON 或字段清单
  1. 01
    05 分钟:画出五段路径

    只写用户请求、Agent、模型、工具、结果五段,为每段标出预期 span 与父 span;不粘贴真实提示词。

  2. 02
    10 分钟:选最小关联字段

    为每段标记 trace/span 父子关系、服务名、操作名、请求/响应模型和工具名;缺失字段写“缺失”,不要猜值。

  3. 03
    10 分钟:做字段映射

    把当前原始字段与目标 `gen_ai.*` 字段并排列出,写明来源格式、约定仓库或版本,以及 normalizer 是否参与。

  4. 04
    10 分钟:执行脱敏检查

    逐项删除 API key、身份信息、完整提示词/回复和工具参数值;只保留完成关联与失败定位所需的枚举、标识和状态。

  5. 05
    05 分钟:写一条验收查询

    用你现有后端的查询语法,写出“从 Agent span 找到同 trace 的模型与工具 span,并显示失败状态”的查询草稿。

  6. 06
    05 分钟:作出继续或停止决定

    按下面条件签署卡片;若只能靠采集原文或猜测父子关系才能通过,记录阻塞并停止扩展仪表盘。

预期产物
一张版本化验收卡:五段链路图、原始到 `gen_ai.*` 的字段映射、脱敏清单、一条验收查询,以及继续或停止决定。
通过条件
同一条脱敏样例能用 trace/span 关系连接 Agent、模型与至少一次工具调用;服务、操作、模型、工具和失败状态均有明确字段;卡片写明约定来源/版本,且不含密钥、身份信息或完整对话。
停止条件
无法在不采集秘密、完整提示词/回复或高风险工具参数的情况下关联链路;或当前字段无法区分 Agent、模型与工具边界;停止增加看板,先修埋点、脱敏或版本契约。

DOMAIN BOARDS / RESEARCH ENTRY

站内三大领域研究入口

下面的领域备注是 AIGC Bot 的编辑判断,不是 GitHub 官方排名,也不是对所有 Agent 框架的通用性能结论。本期共同问题只有一个:你能否在不采集秘密或完整对话的前提下,复盘一次 Agent 到工具的调用。

01

模型、工作流与应用层

AI 开源

AI 方向先选一条固定任务和一个无副作用工具,记录模型与工具边界,不把完整提示词当成默认遥测。

  1. 01
    n8n把 AI、产品和运营系统连接成可复用的自动化流程。
    阅读判断
  2. 02
    Flowise先用可视化编排验证 LLM 应用,再决定哪些部分需要定制开发。
    查看源码
  3. 03
    ComfyUI以节点式流程构建可控的图像生成和创意生产链路。
    查看源码
查看完整榜单
02

事件、计算与分析层

大数据

数据方向把原始字段、标准字段、约定版本和脱敏规则写进同一张映射表,避免只有字段名没有治理责任。

  1. 01
    Apache Kafka连接服务与数据系统的可靠事件骨干。
    查看源码
  2. 02
    Apache Spark处理批量分析和湖仓工作负载的分布式计算引擎。
    查看源码
  3. 03
    Trino跨湖、仓与业务系统直接查询数据的分布式 SQL 引擎。
    查看源码
查看完整榜单
03

质量、成本与生产治理

可观测

可观测方向先验收父子关系、失败状态和最小查询,再决定是否增加内容采集、指标或仪表盘。

  1. 01
    OpenTelemetry Collector接收、处理并转发系统间的 Trace、Metric 与 Log。
    阅读判断
  2. 02
    Prometheus拥有广泛 Exporter 生态的时序监控基础。
    查看源码
  3. 03
    Grafana跨数据源展示并关联日常运营信号。
    查看源码
查看完整榜单

SOURCES & EDITORIAL SCOPE

来源与编辑说明

本期判断以公开的一手项目资料为依据,并明确区分站内编辑观点与项目事实;链接用于复核,不构成官方排名或收益承诺。

PUBLISHING CADENCE

固定每周日总结上周。

周报按自然周维护:周一到周日为一个周期,周日发布上一周期的站内复核摘要。邮件订阅开放前,周报页面先作为公开 SEO 内容和后续 Newsletter 的样稿库。

NEXT ACTION

读完周报,保留一张验证卡。

用验证清单把一个项目拆成部署、许可、数据、成本和首个用户,再决定是否继续写深度文章、接广告或打包成虚拟商品。