ALUX AI智能体情报日报AI Agent Intelligence Daily
ALUX AI Agent Daily2026-07-22Infrastructure Brief

AI Agent会话证据汇流

今天最值得看的变化,是线程、记忆、连接器、人工响应与恢复边界不再只是产品设置,而开始组成可迁移、可检查的工作状态。

7重点信号
26候选信号
7官方/一手来源
1最高优先级动作
今日总判断:今天最强的是 C · 连接/社会 与 R · 强韧/机体:行业正在把会话来源、工作状态、连接换代、恢复证据和权限传播写进同一生产责任面。

RISC 机器说明

RISC = 生产级 Agent / 机器人身体的四个系统

一个真正能上生产的 Agent,不能只有大脑。它要能持续运行,要能判断和行动,要能抵御错误、攻击和投毒,也要能进入真实世界的协作网络。

行业已经交付了一颗出色的大脑,但生产级 Agent 还需要机体、免疫和社会。ALUX 构建的,就是这台完整机器。
R|强韧 / 机体容错、持久执行、故障切换、水平扩展。没有强韧机体,一次崩溃就会带走全部工作。
I|智能 / 大脑推理循环、记忆、工具调用、任务编排。这是今天所有 Agent 框架最拥挤、也最成熟的竞争层。
S|安全 / 免疫对象能力、策略约束、回滚机制、审计链路。没有安全免疫,一条被投毒的指令就可能造成真实损害。
C|连接 / 社会跨公司授权、中立基底、会话类型、协作边界。没有连接网络,每家公司的 Agent 都只能困在自己的孤岛里。

ALUX 今日雷达

机会

工作状态正在跨入口携带

线程、记忆、MCP、A2A、人工响应和项目设置开始被同一套 Agent 产品迁移与恢复。

风险

可迁移仍不等于可追责

日志、token、线程和连接器能搬动,却未必证明权限边界、外部效果和恢复因果。

可行动资产

Agent Session Provenance Envelope v0

统一来源、所有者、工作状态、权限 epoch、连接器状态、恢复判定与效果游标。

重点信号

01Microsoft Agent Framework美国 / 全球开源2026-07-21 / 2026-07-22 观察官方发布

Microsoft Agent Framework 1.12 把跨会话来源、人工响应与 MCP 重连写进同一框架

发生了什么:Python 1.12.0 增加跨会话注入消息的来源归因、工作流内人工请求的 response URL、可逐次解析新连接的 MCP session provider,并提供 app-owned A2A、MCP、Responses 与 Telegram 托管辅助;同时在自动批准工具重名时发出警告。

ALUX 的关系:这组变化把会话来源、人工接管、连接重建和多协议入口放进同一个组织工作面。ALUX 最值得学习的是:消息从哪里来、谁能回应、连接换代后能力是否仍然有效,都应成为可验证的会话状态。

可行动建议与产出物:建议形成 Session Origin & Response Contract,统一 message_origin、session_owner、response_url、connector_epoch、approval_actor 与 handoff_state。 可沉淀为:Session Origin & Response Contract v0。

RISC:C 主 · 连接 / 社会S 辅 · 安全 / 免疫

这条消息主要动到机器人的连接 / 社会:跨会话来源、人工响应和多协议托管决定 Agent 如何进入组织并完成交接;安全 / 免疫为次维度,因为自动批准冲突和回应资格必须被约束。

会话类型官方发布明确加入跨会话来源归因与工作流内 HITL response URL。
生态连接版本同时提供 A2A、MCP、Responses 与 Telegram 托管辅助。
02OpenAI Codex美国 / 全球2026-07-21 / 2026-07-22 观察官方发布

OpenAI Codex 0.145 把线程迁移、多智能体与 Bedrock 入口扩成可携带工作状态

发生了什么:0.145.0 增加可分页、可搜索、可恢复且保留名称、子 Agent 与记忆的线程历史;/import 可迁移 Cursor 与 Claude Code 的设置、MCP server、插件、会话、命令和项目记忆;多智能体 V2 支持配置子 Agent 模型、推理级别与并发。版本还补入 Bedrock 登录、自定义端点与认证,并收紧 MCP 启动超时、OAuth 刷新、Windows 沙箱和强制删除审批。

ALUX 的关系:Agent 的竞争正在从单次推理转向可迁移的工作状态。ALUX 可把线程、插件、连接器、项目记忆、子 Agent 配置和审批历史统一封装成可重放但可衰减授权的迁移单元。

可行动建议与产出物:适合整理 Portable Agent Work-State Envelope,绑定 thread lineage、memory scope、plugin digest、MCP catalog、subagent profile、approval history 与 effect cursor。 可沉淀为:Portable Agent Work-State Envelope v0。

RISC:C 主 · 连接 / 社会R 辅 · 强韧 / 机体

这条消息主要动到机器人的连接 / 社会:工作状态开始跨工具、模型入口和子 Agent 携带;强韧 / 机体为次维度,因为分页历史、恢复与 bounded output 直接影响长会话能否持续。

生态连接/import 明确覆盖 MCP server、插件、命令以及 Cursor 与 Claude Code 状态。
会话类型线程历史保留名称、子 Agent 与记忆,多智能体 V2 支持角色和并发。
03Anthropic Claude Code美国 / 全球2026-07-21 / 2026-07-22 观察官方发布

Claude Code 2.1.217 同时暴露转录丢失、MCP 内存与工作区逃逸风险

发生了什么:2.1.217 在转录写入失败或会话保存被环境变量关闭时新增警告;修复截断后的 MCP 调用结果仍长期保留完整内容造成的内存泄漏、后台会话未规范化符号链接路径导致逃出工作区、损坏附件使 resume 失败,以及后台 shell 难以停止等问题。

ALUX 的关系:生产恢复不能只看 UI 是否回来了,还要证明证据是否真正落盘、调用结果是否按保留策略释放、恢复路径是否仍在原执行域。ALUX 可把这些条件写入恢复前后收据。

可行动建议与产出物:建议形成 Evidence-Aware Resume Receipt,覆盖 transcript_commit、retention_budget、workspace_canonical_path、attachment_integrity 与 resume_verdict。 可沉淀为:Evidence-Aware Resume Receipt v0。

RISC:R 主 · 强韧 / 机体S 辅 · 安全 / 免疫

这条消息主要动到机器人的强韧 / 机体:转录、内存、后台 shell 与 resume 决定长程工作能否活下来;安全 / 免疫为次维度,因为符号链接逃逸与遥测治理关系到边界是否守住。

持久执行部分版本会在转录写入失败或保存关闭时警告,并修复损坏附件导致的恢复错误。
容错能力官方修复内存泄漏、更新失败恢复、后台 shell 停止和多种 resume 故障。
04Alibaba Qwen Code中国 / 全球开源2026-07-21 / 2026-07-22 观察官方发布

Qwen Code 0.20.1 把并行工作区、会话分支与运行模型写入稳定执行面

发生了什么:0.20.1 稳定版加入 worktree 隔离的并行任务会话、持久会话分支检查、daemon 的 ACP 预热就绪信号,并在每份 Autofix 报告中显示实际运行模型;同时继续推进标签接管、重试配额提示与 Plan 模式命令安全路由。

ALUX 的关系:并行任务不能共用模糊工作区,会话分支也不能脱离实际模型和恢复环境解释。ALUX 可把执行域、分支谱系、模型版本与 daemon readiness 写进同一运行收据。

可行动建议与产出物:可沉淀 Parallel Session Execution Receipt,覆盖 worktree_root、branch_lineage、runtime_model、daemon_epoch、approval_mode 与 effect_commit。 可沉淀为:Parallel Session Execution Receipt v0。

RISC:R 主 · 强韧 / 机体S 辅 · 安全 / 免疫

这条消息主要动到机器人的强韧 / 机体:并行工作区、持久分支和 daemon readiness 决定任务能否持续且互不踩踏;安全 / 免疫为次维度,因为 Plan 命令路由和模型披露影响责任边界。

持久执行版本支持检查持久会话分支,并在 session load/resume 恢复 worktree 隔离。
水平扩展部分worktree 隔离支持并行任务,但未证明大规模跨节点调度。
05Pydantic AI全球开源2026-07-21 / 2026-07-22 观察官方发布

Pydantic AI 2.14 把 Temporal、DBOS 与 Prefect 持久化升级为一等能力

发生了什么:2.14.0 将 TemporalDurability、DBOSDurability 与 PrefectDurability 作为一等能力,替代旧 wrapper-agent 方向;相邻的 2.14.1 又把 MCP instructions 的获取放进 DBOS durable step,并暂缓旧包装层的弃用。

ALUX 的关系:主流框架开始把持久化从外围包装提升为正式接口,但仍依赖多个外部运行时。ALUX 的机会是提供统一的恢复、能力和重放语义,同时兼容这些 authoring 层。

可行动建议与产出物:建议形成 Durability Adapter Conformance Matrix,核对 checkpoint、retry、effect dedup、policy replay、connector state 与 recovery proof。 可沉淀为:Durability Adapter Conformance Matrix v0。

RISC:R 主 · 强韧 / 机体S 辅 · 安全 / 免疫

这条消息主要动到机器人的强韧 / 机体:框架正式承认 Agent 需要可替换的持久运行时;安全 / 免疫为次维度,因为耐久步骤必须重放同一策略与能力边界。

持久执行官方版本把 Temporal、DBOS 与 Prefect durability 作为一等能力。
故障恢复部分durable step 与多后端抽象支持恢复,但公开说明未证明统一故障切换语义。
06Moonshot AI Kimi Code中国 / 全球开源2026-07-20 / 2026-07-22 观察官方发布

Kimi Code 0.28 收回后台 Web 服务,并让权限切换传播到运行中的子 Agent

发生了什么:0.28.0 将 kimi server 改为前台运行的 kimi web,移除后台 daemon 与 OS service 生命周期,并支持同一 home 下多实例和 token 轮换;0.28.1 继续收紧为端到端前台服务,同时修复运行中子 Agent 未感知权限模式切换,并允许 ACP 会话使用已配置的非 OAuth 模型凭据启动。

ALUX 的关系:这不是简单 CLI 改名,而是收回隐藏后台生命周期,让操作者重新看见服务所有权和停止边界;权限模式也必须传播到已经运行的子 Agent。ALUX 可把运行身份、权限 epoch 和子 Agent 继承规则写入长交易。

可行动建议与产出物:适合整理 Runtime Authority Epoch Receipt,覆盖 process_owner、foreground_state、token_epoch、credential_source、child_agent_set 与 permission_propagation。 可沉淀为:Runtime Authority Epoch Receipt v0。

RISC:S 主 · 安全 / 免疫R 辅 · 强韧 / 机体

这条消息主要动到机器人的安全 / 免疫:权限模式切换必须约束已运行子 Agent,token 与凭据来源也要可追责;强韧 / 机体为次维度,因为服务生命周期从后台 daemon 改为前台进程。

策略审批0.28.1 修复运行中子 Agent 不响应权限模式切换的问题。
能力对象token 轮换和模型凭据仍是传统凭据机制,没有证明不可伪造对象能力。
07Browserbase Stagehand美国 / 全球开源2026-07-21 / 2026-07-22 观察官方发布

Stagehand 3.7.4 把浏览轨迹按运行归组,并开放 OpenAI 兼容模型入口

发生了什么:3.7.4 将评估轨迹按 run 归组,并可交叉链接 Braintrust experiments;同时让 core 与 server v3 通过 openaiEndpointFormat 接入 OpenAI Chat Completions 兼容端点。

ALUX 的关系:浏览 Agent 的一次任务会产生大量页面动作,按运行归组是形成证据边界的第一步;开放兼容端点则说明模型层继续可替换。ALUX 可以把浏览轨迹、模型端点和真实页面效果绑定成一次可审计运行。

可行动建议与产出物:可沉淀 Browser Run Evidence Schema,覆盖 run_id、trajectory_digest、model_endpoint、browser_state、policy_events、experiment_link 与 final_effect。 可沉淀为:Browser Run Evidence Schema v0。

RISC:I 主 · 智能 / 大脑S 辅 · 安全 / 免疫

这条消息主要动到机器人的智能 / 大脑:浏览工具编排和模型端点选择构成任务执行循环;安全 / 免疫为次维度,因为轨迹需要成为可核查证据而非普通日志。

工具编排Stagehand 以浏览器动作轨迹为核心,并新增按运行归组。
模型循环部分支持 OpenAI Chat Completions 兼容端点,但版本说明未展开完整自主循环。

融资 / 合作窗口

最直接窗口:Microsoft Agent Framework 适合做类型化会话与多协议入口;Codex 可验证跨产品工作状态迁移;Pydantic AI 提供 durability adapter 入口;Claude Code、Qwen Code、Kimi Code 与 Stagehand 分别提供恢复、并行执行域、权限传播和浏览效果样本。
融资叙事窗口:今天没有新的可靠融资金额进入正文。更值得强调的是,模型与框架公司正在分别为跨会话来源、线程迁移、持久化后端、转录完整性和权限传播付出工程成本;ALUX 的机会是把这些碎片收进统一生产运行时。

技术 / 产品启发

优先产品:Agent Session Provenance Envelope v0。字段建议包括 session_id、origin、owner、thread_lineage、memory_scope、connector_epoch、runtime_model、permission_epoch、transcript_commit、effect_cursor 与 recovery_verdict。
优先 Demo:从 Codex 导入一份带 MCP 与子 Agent 的工作状态,通过 Microsoft Agent Framework 接收人工 response URL,再用 Qwen worktree 和 Stagehand 完成外部动作;中途切换权限并重启执行器,展示 ALUX 如何恢复原状态、衰减能力并证明最终效果。

风险边界

ALUX 不能被说成已经完整交付智能体平台。当前底层 TVM 已具备并发、持久化执行、能力安全、运行记录和逐比特重放审计等关键基础;智能体产品层、可观测性、仪表盘、追踪与评估工具仍是待构建和融资重点。也不要说 TVM 让 LLM 本身确定性。准确说,TVM 记录模型输出和运行环境输入,使编排、权限、状态转移和审计可重放、可验证。跨会话来源、线程导入、durability adapter、转录警告、权限传播与浏览轨迹都不能自动证明跨步骤原子回滚、对象能力或中立跨公司协作。

来源

  1. Microsoft Agent Framework:Microsoft Agent Framework 1.12 把跨会话来源、人工响应与 MCP 重连写进同一框架 官方发布
  2. OpenAI Codex:OpenAI Codex 0.145 把线程迁移、多智能体与 Bedrock 入口扩成可携带工作状态 官方发布
  3. Anthropic Claude Code:Claude Code 2.1.217 同时暴露转录丢失、MCP 内存与工作区逃逸风险 官方发布
  4. Alibaba Qwen Code:Qwen Code 0.20.1 把并行工作区、会话分支与运行模型写入稳定执行面 官方发布
  5. Pydantic AI:Pydantic AI 2.14 把 Temporal、DBOS 与 Prefect 持久化升级为一等能力 官方发布
  6. Moonshot AI Kimi Code:Kimi Code 0.28 收回后台 Web 服务,并让权限切换传播到运行中的子 Agent 官方发布
  7. Browserbase Stagehand:Stagehand 3.7.4 把浏览轨迹按运行归组,并开放 OpenAI 兼容模型入口 官方发布