AI Agent恢复语义进入协议
今天最有价值的变化,不是 Agent 又多会一种工具,而是框架开始正面处理一个更难的问题:连接中断、并行分支、模型版本和上游事件变化后,系统怎样继续而不重复动作、不配错状态,也不泄露证据。
RISC 机器说明
RISC = 生产级 Agent / 机器人身体的四个系统
一个真正能上生产的 Agent,不能只有大脑。它要能持续运行,要能判断和行动,要能抵御错误、攻击和投毒,也要能进入真实世界的协作网络。
ALUX 今日雷达
恢复语义成为运行时接口
行业开始显式区分连接失败、请求可能已送达、并行分支在途与事件字段丢失。
重放可能只是重新讲一遍
消息能重建,不代表工具效果、权限版本和环境输入仍与原运行一致。
Effect-Safe Recovery Contract v0
统一交付状态、效果游标、共享上下文、能力快照、版本信息、重试类别与补偿裁决。
重点信号
Qwen Code 夜版把 Goal v3 运行编排推进到核心层
发生了什么:Qwen Code 的 2026-07-25 nightly 新增 Goal v3 runtime orchestration,并抽出 review verification runner、统一 GenAI content telemetry 字段。
对 ALUX 的关系:目标不再只是提示词,而开始变成运行时编排对象;ALUX 应把目标版本、验收规则、工具调用和终态判定绑定到同一条长交易。
可行动建议与产出物:建议形成 Goal Execution Contract v0,明确 goal_version、acceptance_criteria、verification_runner、tool_epoch、terminal_verdict 与 evidence_refs。 可沉淀为:Goal Execution Contract v0。
这条消息主要动到机器人的智能 / 大脑:目标被提升为运行时编排对象;强韧 / 机体为次维度,因为独立验证与终态判定决定恢复后是否仍在执行同一个目标。
Pydantic AI 2.18 把跨模型工具与外部网络入口并入同一适配层
发生了什么:2.18 新增 Anthropic/OpenRouter AdvisorTool、OpenAI Responses 的 external_web_access、Bedrock Mantle provider,并统一 response-scoped tool-call IDs。
对 ALUX 的关系:同一种 Agent 工具能力正跨模型、云与网络边界流动;ALUX 需要把提供方、工具 ID 作用域、外部网络授权与调用证据统一。
可行动建议与产出物:建议形成 Provider-Neutral Tool Invocation Schema v0,绑定 provider、response_scope、tool_call_id、network_capability、approval_ref 与 result_digest。 可沉淀为:Provider-Neutral Tool Invocation Schema v0。
这条消息主要动到机器人的智能 / 大脑:工具与模型提供方编排面扩大;安全 / 免疫为次维度,因为外部网络访问和工具 ID 作用域必须被明确约束。
E2B Python SDK 停止在连接中断后盲目重放一元 RPC
发生了什么:Python SDK 2.35 切换到官方 Connect RPC 客户端;提前关闭流会发送 RST_STREAM,连接建立失败才重试,一元 RPC 在中途断连后不再自动重放,以免重复执行已送达动作。
对 ALUX 的关系:这是最直接的长交易效果安全信号:网络失败无法告诉客户端请求是否已经产生副作用。ALUX 必须区分连接失败、交付未知与效果已提交。
可行动建议与产出物:建议形成 Effect-Safe Retry Contract v0,记录 attempt_id、delivery_state、effect_cursor、retry_class、idempotency_key 与 compensation_verdict。 可沉淀为:Effect-Safe Retry Contract v0。
这条消息主要动到机器人的强韧 / 机体:连接断裂后能否安全继续决定运行是否重复做事;安全 / 免疫为次维度,因为未知交付状态必须留下责任证据。
Strands Harness 1.11 把并行恢复、共享上下文与工具中断放进执行阶段
发生了什么:1.11.0 新增 ToolExecutor 层级和可由中间件发起中断的 ExecuteToolStage;修复多 Agent 序列化后共享上下文与累计计费丢失,以及并行 sibling 仍在运行时 fan-in 节点误入恢复。
对 ALUX 的关系:并行图恢复不能只看单个节点状态;共享上下文、累计成本和 sibling 在途状态共同决定能否进入 fan-in。ALUX 的进程与 join 模型可直接承接。
可行动建议与产出物:建议形成 Parallel Join Recovery Invariant v0,明确 sibling_states、shared_context_digest、usage_accumulator、interrupt_reason 与 join_eligibility。 可沉淀为:Parallel Join Recovery Invariant v0。
这条消息主要动到机器人的强韧 / 机体:并行 sibling 未完成时不能错误恢复 fan-in;安全 / 免疫为次维度,因为工具中断必须与真实副作用和审批边界对齐。
Langfuse v4 RC2 同时收紧后台运行、秘密更新与公共请求日志
发生了什么:v4 RC2 为后台执行增加数据库字段与定向回填,修正消息/工具调用顺序;公共 API 不再记录请求 payload,基础 URL 变更要求新 secret,并增强大型 JSON 与 trace 的懒加载。
对 ALUX 的关系:观测平台正在承认两条生产边界:后台任务需要独立状态,遥测本身也可能泄露敏感能力和数据。ALUX 的审计证据链必须可验证且最小披露。
可行动建议与产出物:建议形成 Privacy-Preserving Replay Export v0,区分 trace_metadata、redacted_payload、secret_epoch、event_order 与 replay_proof_ref。 可沉淀为:Privacy-Preserving Replay Export v0。
这条消息主要动到机器人的安全 / 免疫:公共请求 payload 与秘密轮换决定观测层是否反向泄露;强韧 / 机体为次维度,因为后台执行状态与消息顺序影响恢复。
Deep Agents 让自动模式正式可用,同时暴露能力快照与会话转录
发生了什么:deepagents-code 0.1.46 将 Auto mode 推为 GA,允许配置目标验收标准;Hooks v2 增加 capability snapshots 和 session transcripts,并强化命令执行,同时将 Agent recursion limit 提至 2000。
对 ALUX 的关系:自动化深度扩大后,能力快照、验收标准与会话证据必须一起增长;否则更深循环只会扩大越权和不可追责半径。
可行动建议与产出物:建议形成 Capability Snapshot Receipt v0,绑定 goal_criteria、capability_digest、session_transcript_hash、hook_policy、recursion_budget 与 approval_ref。 可沉淀为:Capability Snapshot Receipt v0。
这条消息主要动到机器人的安全 / 免疫:自动模式 GA 后,能力快照、会话转录和命令 hook 决定可追责边界;智能 / 大脑为次维度,因为更深递归与目标验收扩大自主循环。
Microsoft Agent Framework 修复无状态重放中的推理与工具调用配对
发生了什么:Python 1.12.1 修复 OpenAI/Foundry 的无状态重放,使 reasoning 与 paired tool calls 保持对应;保留 Gemini thought signatures,并为自定义 MCP Streamable HTTP clients 增加安全指导。
对 ALUX 的关系:模型推理状态与工具调用如果在重放时错配,执行记录就会从“可回放”退化成错误剧情。ALUX 要记录模型输出、签名、工具调用和环境输入之间的可验证关联。
可行动建议与产出物:建议形成 Reasoning-Tool Pairing Receipt v0,绑定 model_output_digest、thought_signature、tool_call_id、tool_result_digest、replay_order 与 environment_input_ref。 可沉淀为:Reasoning-Tool Pairing Receipt v0。
这条消息主要动到机器人的强韧 / 机体:重放时推理与工具调用必须按原关系恢复;安全 / 免疫为次维度,因为签名与 MCP 客户端边界影响记录是否可信。
Cloudflare Agents 0.19 在 AI SDK 两个大版本之间归一化工具执行事件
发生了什么:agents 0.19 同时支持 AI SDK v6/v7,在适配边界归一化工具完成事件、流接口和文件输出形态,并明确 v7 缺失 stepNumber 等已知差异。
对 ALUX 的关系:运行时升级不能悄悄改变证据字段;当上游事件形态变化时,ALUX 应保留原始版本、归一化规则与丢失字段声明。
可行动建议与产出物:建议形成 Runtime Event Normalization Receipt v0,记录 source_schema_version、normalized_event、lossy_fields、adapter_version 与 compatibility_tests。 可沉淀为:Runtime Event Normalization Receipt v0。
这条消息主要动到机器人的强韧 / 机体:依赖大版本升级后工具事件仍要稳定可解释;智能 / 大脑为次维度,因为模型循环依赖这些工具完成事件。
融资 / 合作窗口
技术 / 产品启发
风险边界
ALUX 不能被说成已经完整交付智能体平台。当前底层 TVM 已具备并发、持久化执行、能力安全、运行记录和逐比特重放审计等关键基础;智能体产品层、可观测性、仪表盘、追踪与评估工具仍是待构建和融资重点。也不要说 TVM 让 LLM 本身确定性。准确说,TVM 记录模型输出和运行环境输入,使编排、权限、状态转移和审计可重放、可验证。连接重试、消息 replay、能力快照、trace、事件归一化和目标验收都不能自动证明外部副作用已去重、对象能力不可伪造、跨步骤原子回滚或中立跨公司协作。
来源
- Alibaba Qwen Code:Qwen Code 夜版把 Goal v3 运行编排推进到核心层 官方发布
- Pydantic AI:Pydantic AI 2.18 把跨模型工具与外部网络入口并入同一适配层 官方发布
- E2B:E2B Python SDK 停止在连接中断后盲目重放一元 RPC 官方发布
- Strands Agents Harness:Strands Harness 1.11 把并行恢复、共享上下文与工具中断放进执行阶段 官方发布
- Langfuse:Langfuse v4 RC2 同时收紧后台运行、秘密更新与公共请求日志 官方发布
- LangChain Deep Agents:Deep Agents 让自动模式正式可用,同时暴露能力快照与会话转录 官方发布
- Microsoft Agent Framework:Microsoft Agent Framework 修复无状态重放中的推理与工具调用配对 官方发布
- Cloudflare Agents:Cloudflare Agents 0.19 在 AI SDK 两个大版本之间归一化工具执行事件 官方发布