AI Agent会话证据汇流
今天最值得看的变化,是线程、记忆、连接器、人工响应与恢复边界不再只是产品设置,而开始组成可迁移、可检查的工作状态。
RISC 机器说明
RISC = 生产级 Agent / 机器人身体的四个系统
一个真正能上生产的 Agent,不能只有大脑。它要能持续运行,要能判断和行动,要能抵御错误、攻击和投毒,也要能进入真实世界的协作网络。
ALUX 今日雷达
工作状态正在跨入口携带
线程、记忆、MCP、A2A、人工响应和项目设置开始被同一套 Agent 产品迁移与恢复。
可迁移仍不等于可追责
日志、token、线程和连接器能搬动,却未必证明权限边界、外部效果和恢复因果。
Agent Session Provenance Envelope v0
统一来源、所有者、工作状态、权限 epoch、连接器状态、恢复判定与效果游标。
重点信号
Microsoft Agent Framework 1.12 把跨会话来源、人工响应与 MCP 重连写进同一框架
发生了什么:Python 1.12.0 增加跨会话注入消息的来源归因、工作流内人工请求的 response URL、可逐次解析新连接的 MCP session provider,并提供 app-owned A2A、MCP、Responses 与 Telegram 托管辅助;同时在自动批准工具重名时发出警告。
对 ALUX 的关系:这组变化把会话来源、人工接管、连接重建和多协议入口放进同一个组织工作面。ALUX 最值得学习的是:消息从哪里来、谁能回应、连接换代后能力是否仍然有效,都应成为可验证的会话状态。
可行动建议与产出物:建议形成 Session Origin & Response Contract,统一 message_origin、session_owner、response_url、connector_epoch、approval_actor 与 handoff_state。 可沉淀为:Session Origin & Response Contract v0。
这条消息主要动到机器人的连接 / 社会:跨会话来源、人工响应和多协议托管决定 Agent 如何进入组织并完成交接;安全 / 免疫为次维度,因为自动批准冲突和回应资格必须被约束。
OpenAI Codex 0.145 把线程迁移、多智能体与 Bedrock 入口扩成可携带工作状态
发生了什么:0.145.0 增加可分页、可搜索、可恢复且保留名称、子 Agent 与记忆的线程历史;/import 可迁移 Cursor 与 Claude Code 的设置、MCP server、插件、会话、命令和项目记忆;多智能体 V2 支持配置子 Agent 模型、推理级别与并发。版本还补入 Bedrock 登录、自定义端点与认证,并收紧 MCP 启动超时、OAuth 刷新、Windows 沙箱和强制删除审批。
对 ALUX 的关系:Agent 的竞争正在从单次推理转向可迁移的工作状态。ALUX 可把线程、插件、连接器、项目记忆、子 Agent 配置和审批历史统一封装成可重放但可衰减授权的迁移单元。
可行动建议与产出物:适合整理 Portable Agent Work-State Envelope,绑定 thread lineage、memory scope、plugin digest、MCP catalog、subagent profile、approval history 与 effect cursor。 可沉淀为:Portable Agent Work-State Envelope v0。
这条消息主要动到机器人的连接 / 社会:工作状态开始跨工具、模型入口和子 Agent 携带;强韧 / 机体为次维度,因为分页历史、恢复与 bounded output 直接影响长会话能否持续。
Claude Code 2.1.217 同时暴露转录丢失、MCP 内存与工作区逃逸风险
发生了什么:2.1.217 在转录写入失败或会话保存被环境变量关闭时新增警告;修复截断后的 MCP 调用结果仍长期保留完整内容造成的内存泄漏、后台会话未规范化符号链接路径导致逃出工作区、损坏附件使 resume 失败,以及后台 shell 难以停止等问题。
对 ALUX 的关系:生产恢复不能只看 UI 是否回来了,还要证明证据是否真正落盘、调用结果是否按保留策略释放、恢复路径是否仍在原执行域。ALUX 可把这些条件写入恢复前后收据。
可行动建议与产出物:建议形成 Evidence-Aware Resume Receipt,覆盖 transcript_commit、retention_budget、workspace_canonical_path、attachment_integrity 与 resume_verdict。 可沉淀为:Evidence-Aware Resume Receipt v0。
这条消息主要动到机器人的强韧 / 机体:转录、内存、后台 shell 与 resume 决定长程工作能否活下来;安全 / 免疫为次维度,因为符号链接逃逸与遥测治理关系到边界是否守住。
Qwen Code 0.20.1 把并行工作区、会话分支与运行模型写入稳定执行面
发生了什么:0.20.1 稳定版加入 worktree 隔离的并行任务会话、持久会话分支检查、daemon 的 ACP 预热就绪信号,并在每份 Autofix 报告中显示实际运行模型;同时继续推进标签接管、重试配额提示与 Plan 模式命令安全路由。
对 ALUX 的关系:并行任务不能共用模糊工作区,会话分支也不能脱离实际模型和恢复环境解释。ALUX 可把执行域、分支谱系、模型版本与 daemon readiness 写进同一运行收据。
可行动建议与产出物:可沉淀 Parallel Session Execution Receipt,覆盖 worktree_root、branch_lineage、runtime_model、daemon_epoch、approval_mode 与 effect_commit。 可沉淀为:Parallel Session Execution Receipt v0。
这条消息主要动到机器人的强韧 / 机体:并行工作区、持久分支和 daemon readiness 决定任务能否持续且互不踩踏;安全 / 免疫为次维度,因为 Plan 命令路由和模型披露影响责任边界。
Pydantic AI 2.14 把 Temporal、DBOS 与 Prefect 持久化升级为一等能力
发生了什么:2.14.0 将 TemporalDurability、DBOSDurability 与 PrefectDurability 作为一等能力,替代旧 wrapper-agent 方向;相邻的 2.14.1 又把 MCP instructions 的获取放进 DBOS durable step,并暂缓旧包装层的弃用。
对 ALUX 的关系:主流框架开始把持久化从外围包装提升为正式接口,但仍依赖多个外部运行时。ALUX 的机会是提供统一的恢复、能力和重放语义,同时兼容这些 authoring 层。
可行动建议与产出物:建议形成 Durability Adapter Conformance Matrix,核对 checkpoint、retry、effect dedup、policy replay、connector state 与 recovery proof。 可沉淀为:Durability Adapter Conformance Matrix v0。
这条消息主要动到机器人的强韧 / 机体:框架正式承认 Agent 需要可替换的持久运行时;安全 / 免疫为次维度,因为耐久步骤必须重放同一策略与能力边界。
Kimi Code 0.28 收回后台 Web 服务,并让权限切换传播到运行中的子 Agent
发生了什么:0.28.0 将 kimi server 改为前台运行的 kimi web,移除后台 daemon 与 OS service 生命周期,并支持同一 home 下多实例和 token 轮换;0.28.1 继续收紧为端到端前台服务,同时修复运行中子 Agent 未感知权限模式切换,并允许 ACP 会话使用已配置的非 OAuth 模型凭据启动。
对 ALUX 的关系:这不是简单 CLI 改名,而是收回隐藏后台生命周期,让操作者重新看见服务所有权和停止边界;权限模式也必须传播到已经运行的子 Agent。ALUX 可把运行身份、权限 epoch 和子 Agent 继承规则写入长交易。
可行动建议与产出物:适合整理 Runtime Authority Epoch Receipt,覆盖 process_owner、foreground_state、token_epoch、credential_source、child_agent_set 与 permission_propagation。 可沉淀为:Runtime Authority Epoch Receipt v0。
这条消息主要动到机器人的安全 / 免疫:权限模式切换必须约束已运行子 Agent,token 与凭据来源也要可追责;强韧 / 机体为次维度,因为服务生命周期从后台 daemon 改为前台进程。
Stagehand 3.7.4 把浏览轨迹按运行归组,并开放 OpenAI 兼容模型入口
发生了什么:3.7.4 将评估轨迹按 run 归组,并可交叉链接 Braintrust experiments;同时让 core 与 server v3 通过 openaiEndpointFormat 接入 OpenAI Chat Completions 兼容端点。
对 ALUX 的关系:浏览 Agent 的一次任务会产生大量页面动作,按运行归组是形成证据边界的第一步;开放兼容端点则说明模型层继续可替换。ALUX 可以把浏览轨迹、模型端点和真实页面效果绑定成一次可审计运行。
可行动建议与产出物:可沉淀 Browser Run Evidence Schema,覆盖 run_id、trajectory_digest、model_endpoint、browser_state、policy_events、experiment_link 与 final_effect。 可沉淀为:Browser Run Evidence Schema v0。
这条消息主要动到机器人的智能 / 大脑:浏览工具编排和模型端点选择构成任务执行循环;安全 / 免疫为次维度,因为轨迹需要成为可核查证据而非普通日志。
融资 / 合作窗口
技术 / 产品启发
风险边界
ALUX 不能被说成已经完整交付智能体平台。当前底层 TVM 已具备并发、持久化执行、能力安全、运行记录和逐比特重放审计等关键基础;智能体产品层、可观测性、仪表盘、追踪与评估工具仍是待构建和融资重点。也不要说 TVM 让 LLM 本身确定性。准确说,TVM 记录模型输出和运行环境输入,使编排、权限、状态转移和审计可重放、可验证。跨会话来源、线程导入、durability adapter、转录警告、权限传播与浏览轨迹都不能自动证明跨步骤原子回滚、对象能力或中立跨公司协作。
来源
- Microsoft Agent Framework:Microsoft Agent Framework 1.12 把跨会话来源、人工响应与 MCP 重连写进同一框架 官方发布
- OpenAI Codex:OpenAI Codex 0.145 把线程迁移、多智能体与 Bedrock 入口扩成可携带工作状态 官方发布
- Anthropic Claude Code:Claude Code 2.1.217 同时暴露转录丢失、MCP 内存与工作区逃逸风险 官方发布
- Alibaba Qwen Code:Qwen Code 0.20.1 把并行工作区、会话分支与运行模型写入稳定执行面 官方发布
- Pydantic AI:Pydantic AI 2.14 把 Temporal、DBOS 与 Prefect 持久化升级为一等能力 官方发布
- Moonshot AI Kimi Code:Kimi Code 0.28 收回后台 Web 服务,并让权限切换传播到运行中的子 Agent 官方发布
- Browserbase Stagehand:Stagehand 3.7.4 把浏览轨迹按运行归组,并开放 OpenAI 兼容模型入口 官方发布