AIGC BOT WEEKLY / 2026.09.06

物理 Agent 周报:先让一次设备写操作可以被拒绝

Anthropic 在 8 月 27 日公布 Model Hardware Standard(MHS)研究预览,尝试用统一驱动让 Agent 发现和操作实验室或制造设备。这是一个仍在邀请合作伙伴、尚未开源的早期标准,不是设备已经可以无人值守接入的证明。下列卡片只陈述 Anthropic 与 MCP 官方材料中可复核的事实;AIGC Bot 的编辑判断是,先用 45 分钟让一个完全离线的合成设备证明写入校验、人工拒绝、故障联锁和审计链,再讨论连接真实硬件。

本期周期
2026-08-24 - 2026-08-30
发布时间
2026-09-06
榜单口径
站内编辑研究入口,不代表 GitHub 官方排名

SOURCE-LINKED SIGNALS

先分清来源事实,再写自己的判断。

AI + HARDWARE / 预览边界

8 月 27 日:MHS 以研究预览开放给首批合作方

可核对事实
Anthropic 将 MHS 描述为供 AI Agent 操作可编程物理设备的共享规范,并明确当前是面向科研实验室与先进制造商的研究预览,计划在积累安全评估和最佳实践后再开源。官方说明称它与模型无关,可通过 MCP、命令行或代码接口访问设备。
为什么值得写进验证卡
这张卡值得写进验证卡,因为“出现统一接口方向”与“团队拿到稳定、可审计、可生产使用的实现”是两个阶段。预览可以触发契约设计,但不能跳过设备供应商、现场安全和版本可用性的验证。
Anthropic Model Hardware Standard research preview

DATA / 设备状态契约

MHS 驱动把设备能力收敛为读写原语与可发现说明

可核对事实
MHS 官方材料说明,标准驱动用 `read` 与 `write` 等简单原语翻译设备接口,并以统一格式暴露设备;驱动中的自然语言标签可生成参考文件,描述设备能测量什么、能调整什么,以及会执行哪些安全限制。
为什么值得写进验证卡
这张卡值得写进验证卡,因为 Agent 看见一个 `write` 名称并不等于它理解当前状态、单位、范围和物理后果。可审查的输入 schema、状态前置条件与限制规则必须先于自然语言编排。
Anthropic Model Hardware Standard research preview

OBSERVABILITY / 工具拒绝证据

MCP 把工具 schema 与运行时安全责任分开

可核对事实
MCP 2026-07-28 工具规范要求工具定义提供有效的 JSON Schema 输入,并允许结构化输出 schema;规范把工具调用定义为模型控制,同时建议保留可拒绝调用的人在回路。服务器必须校验输入、实施访问控制、限流并清理输出;客户端应对敏感操作确认、设置超时并记录调用。MCP 总规范还提醒工具描述和 annotations 在未确认服务器可信时不能作为安全事实。
为什么值得写进验证卡
这张卡值得写进验证卡,因为协议字段只能承载约束,不能替代现场联锁或授权。验收必须同时证明 schema 拒错、执行前授权、设备状态未变化和可关联审计,而不是只证明模型调用了正确的工具名。
Model Context Protocol 2026-07-28 tools specification

本周行动实验

45 分钟,做出继续或停止的依据。

实验目标
为一个虚构温控设备定义最小读写契约,并证明越界、过期、重复、失联和急停状态下的写请求会在状态改变前失败。
时间边界
45 分钟 / 只用文本、JSON 与合成状态;不运行 MHS、不连接 MCP server、不访问网络或真实设备
  1. 01
    05 分钟:固定证据边界

    在卡片顶部记录 MHS 为研究预览、MCP 版本为 `2026-07-28`,并写明本实验不是 MHS 实现或兼容性测试。真实设备、网络端点和凭证全部排除。

  2. 02
    10 分钟:拆开读与写

    为读取温度/状态定义无副作用输出;为设置温度、启动和停止分别写输入与输出 schema,关闭额外字段,加入单位、范围、request ID、设备状态版本与幂等键。

  3. 03
    10 分钟:写出执行前门禁

    规定写操作依次通过 schema、actor 权限、显式人工确认、状态版本、物理联锁与 deadline;任一失败都返回结构化错误且 before 等于 after。`stop` 保留为独立的安全动作。

  4. 04
    10 分钟:回放七个 fixture

    逐行评审六个负例和一个合法写入。重复合法请求不得产生第二次变化;进入 `emergency_stop` 后,除读取与安全停止外的动作全部拒绝。只填写规则能确定的结果,不让模型自由解释。

  5. 05
    05 分钟:补齐拒绝与审计

    为每次调用记录 schema/规则版本、actor、确认、before/after、错误码、request ID 和 trace ID。确认超时或未知结果不会触发隐式重试,并能区分“未执行”与“执行结果未知”。

  6. 06
    05 分钟:签署继续或停止

    检查合法写入只生效一次、六个负例均未改变状态、急停优先级明确且审计可关联;签署“只进入隔离模拟器 POC”或按停止条件退回修契约。

预期产物
一份版本化离线验收包:合成设备状态机、读写工具 JSON Schema、七个 fixture、逐条门禁/状态转换表、结构化错误样例、审计字段清单,以及继续模拟器 POC 或停止的决定。
通过条件
读取不改变状态;一个经授权且状态新鲜的合法写入恰好生效一次;越界、过期、未确认、重复、超时、失联或急停中的危险写入均在状态改变前被拒绝;每次允许或拒绝都能由 request ID 与 trace ID 关联到规则版本、actor 和 before/after。
停止条件
无法确认状态新鲜度、单位/范围、人工授权、现场联锁、读回或急停;只能相信工具描述或模型自报;超时会自动重试非幂等写入;无法保证实验与真实设备断开。停止连接 Agent、MCP server 或设备,先补确定性控制和现场安全评审。

DOMAIN BOARDS / RESEARCH ENTRY

站内三大领域研究入口

下面是 AIGC Bot 的编辑判断,不是 Anthropic 或 MCP 对 MHS 兼容性、无人值守安全性、集成成本或生产性能的承诺,也不是 GitHub 官方排名。本期只验证一个离线问题:面对一个合成温控设备,一次不安全、重复或缺少授权的写请求能否在任何状态变化前被确定拒绝。

01

模型、工作流与应用层

AI 开源

AI 方向先把可读状态、可写动作与高风险动作分开;工具描述只帮助选择,最终授权、范围检查和联锁由确定性代码与人类控制。

  1. 01
    n8n把 AI、产品和运营系统连接成可复用的自动化流程。
    阅读判断
  2. 02
    Flowise先用可视化编排验证 LLM 应用,再决定哪些部分需要定制开发。
    查看源码
  3. 03
    ComfyUI以节点式流程构建可控的图像生成和创意生产链路。
    查看源码
查看完整榜单
02

事件、计算与分析层

大数据

数据方向为每次请求记录单位、范围、schema 版本、设备状态版本和幂等键;缺少其中一项的写操作不能靠模型补猜。

  1. 01
    Apache Kafka连接服务与数据系统的可靠事件骨干。
    查看源码
  2. 02
    Apache Spark处理批量分析和湖仓工作负载的分布式计算引擎。
    查看源码
  3. 03
    Trino跨湖、仓与业务系统直接查询数据的分布式 SQL 引擎。
    查看源码
查看完整榜单
03

质量、成本与生产治理

可观测

可观测方向把请求 ID、actor、确认人、规则版本、before/after 状态、拒绝原因和 trace ID 串成一条审计证据;拒绝也必须可查询。

  1. 01
    OpenTelemetry Collector接收、处理并转发系统间的 Trace、Metric 与 Log。
    阅读判断
  2. 02
    Prometheus拥有广泛 Exporter 生态的时序监控基础。
    查看源码
  3. 03
    Grafana跨数据源展示并关联日常运营信号。
    查看源码
查看完整榜单

SOURCES & EDITORIAL SCOPE

来源与编辑说明

本期判断以公开的一手项目资料为依据,并明确区分站内编辑观点与项目事实;链接用于复核,不构成官方排名或收益承诺。

PUBLISHING CADENCE

固定每周日总结上周。

周报按自然周维护:周一到周日为一个周期,周日发布上一周期的站内复核摘要。邮件订阅开放前,周报页面先作为公开 SEO 内容和后续 Newsletter 的样稿库。

NEXT ACTION

读完周报,保留一张验证卡。

用验证清单把一个项目拆成部署、许可、数据、成本和首个用户,再决定是否继续写深度文章、接广告或打包成虚拟商品。