2026-W22 本周工作总结

本周工作概览

本周工作主要围绕公司级 OpenClaw 升级验证、飞书长消息卡片问题处理、AI/Agent 方向资料调研三条主线展开。整体上,一条线解决公司级 OpenClaw 后续升级是否还要深度改源码的问题;一条线闭环飞书长耗时任务的消息展示问题;一条线补充自己做智能体能力建设时可借鉴的外部资料和样例。

公司级 OpenClaw 升级,并调研功能特性

0522 基础验证已完成;0527 速度体验接近 0323,待完成全量自动化功能测试,验证业务功能和整体性能表现。

完成 0522 升级版程序和验证脚本,定位 0522 相比 0323 的 5-6 秒级耗时差异来自版本链路中的 model-resolution、auth 等固定阶段;完成从源码深改到配置化升级的路线切换;完成 0527 版本初步升级体验。

处理超过 10 分钟后飞书卡片消息卡死问题

已通过改造规避该限制,问题已解决,不再作为后续跟进项。

基于 traceId、pod IP、ELK 日志确认 feishu-router 后端没有在 10 分钟左右超时或卡住,router 持续更新状态并最终完成;问题根因判断为飞书卡片/客户端侧展示限制。

AI/Agent 方向资料调研

仍处于资料调研和认知整理阶段,主要作为个人智能体能力补充、工具选型和样例验证的借鉴资料。

产出公司级智能体趋势调研报告、治理与落地方法补充调研和来源清单。

主要产出

OpenClaw 0522 升级版程序与验证脚本

完成可用性验证,明确额外耗时不是公司源码改造导致,而是 0522 版本链路固定阶段导致。

OpenClaw 配置化升级路线验证

验证升级可以不改 OpenClaw 源码,将 trace、模型亲和、用户信息、日志观测等能力优先放到 LiteLLM/router 链路处理。

OpenClaw 0527 版本升级与体验

初步体验显示速度可接近 0323,后续需要全量自动化功能测试验证业务功能和整体性能。

飞书卡片消息卡死问题处理

已确认是飞书卡片/客户端侧限制,并通过改造规避。

公司级智能体调研文档

投入时间不多,内容全面性和可参考性还不足,主要用于感知外界企业级智能体方向,初步观察别人怎么做系统集成、工具治理和场景切入。

重点调研总结

调研总结一

OpenClaw 有用的新能力,以及在业务场景上的可能应用

查看调研明细

0323-0527 版本升级方向总结:

  • OpenClaw 从 0323 到 0527 的变化重点,不只是模型或基础运行时升级,而是继续向插件生态、工具调用治理、多入口交互、任务流、记忆能力、子代理和可观测方向扩展。
  • 0527 版本初步速度体验接近 0323,可作为后续升级验证基线;下一步仍要通过全量自动化功能测试确认业务功能和整体性能。

后续调研方向:

  • 业务应用:优先判断哪些能力能服务零售业务场景,例如制图宣传、营销引流、门店运营、供应链协同和业务效率提升。
  • 技术支撑:工具调用、任务进度、权限控制和运行观测等能力,主要用于支撑这些业务场景可落地、可控制、可追踪。

基于这轮升级内容,后续可继续深入研究的业务应用与技术支撑点如下:

ClawHub 插件市场

调研重点:查看现有插件生态里是否已有可直接复用或可借鉴的组件,例如知识库、搜索、研发工具、媒体生成和协同类插件。

当前边界:需要评估插件质量、权限模型、部署依赖和公司内网环境适配成本,不能只看功能是否存在。

插件审批 hooks

调研重点:探索工具调用前后的审批、拦截、确认和审计机制,让 Agent 调用工具时有可控边界。

当前边界:高风险动作不能只依赖模型自觉,需要结合业务权限、工具分级和人工确认链路。

视频/音乐生成

调研重点:了解 OpenClaw 是否能接入视频、音乐等异步生成类能力,以及生成任务的发起、进度和结果回传方式。

当前边界:这类能力可能和现有飞书单机器人交互模式冲突,可能需要“一人一个机器人”或独立任务通道。

TaskFlows / Memory / 任务进度

调研重点:了解 session branch/restore、webhook TaskFlows、memory-wiki、结构化任务进度等能力的应用方式。

当前边界:需要验证这些能力对长任务、可恢复会话、知识沉淀和状态展示是否真正有帮助。

子代理应用

调研重点:探索子代理在复杂任务拆解、并行分析、专项工具调用和多角色协作中的使用方式。

当前边界:要重点看任务编排、上下文隔离、结果汇总和成本控制,避免子代理只是增加复杂度。

OpenTelemetry 与可观测

调研重点:看 OpenTelemetry 等观测能力如何串联飞书事件、OpenClaw run、工具调用、模型请求和最终回复。

当前边界:公司链路仍需要统一 trace 字段、日志口径和慢请求定位方式,不能只依赖 OpenClaw 内部观测。

群聊与个人机器人架构

调研重点:验证群聊场景下消息归属、权限、上下文隔离和任务进度展示方式。

当前边界:群聊和媒体生成类任务都可能需要“一人一个机器人”或个人任务实例,否则容易出现上下文混淆和权限边界问题。

待继续讨论

  • 是否尝试调整为“一人一个机器人,对接个人 OpenClaw”的架构。出发点是后续希望 OpenClaw 能部署在用户自己的电脑上,操作权限、文件访问、个人上下文和本地工具调用会更灵活,应用场景也会更多。
  • 是否把图像、视频、音乐等内容生成作为 OpenClaw 接入场景继续验证,方便用户在制图宣传、活动素材、门店内容和营销引流场景中直接使用。
调研总结二

外部 AI/Agent 发展方向,以及对我们的参考借鉴

查看调研明细

当前观察:

  • 外部公司级 Agent 已经从“问答助手”转向“流程执行与系统操作入口”。竞争重点不只是模型效果,而是企业知识、业务流程、数据权限、系统工具、员工入口和现场交付能力。
  • 大模型公司在争 Agent 运行时和工具调用底座;软件与云厂商在争企业流程入口和治理控制面;咨询/FDE 团队在争业务现场的流程拆解、系统集成和持续运营;零售供应链企业更关注供应链计划、履约异常、门店任务、采购协同和员工助手。
  • 补充调研后可以看到,外部落地不只是系统和技术匹配,也在改变组织协作方式:零售企业更常按客户、员工、供应商、开发者、门店、运营、广告、客服、采购等业务对象或角色组织 Agent 能力。
  • B 端服务商的落地方式正在从“卖工具”转向“嵌入式交付”:FDE、Bootcamp、AI Lab、Innovation Center 等模式都强调进入客户现场,围绕流程、系统、数据、权限和推广一起做生产化集成。
  • 对我们更有参考价值的不是照搬某个组织名称,而是形成轻量的“中央治理/平台 + 业务域 owner + 嵌入式工程与数据角色”协作方式,让业务价值、工具封装、权限治理、评估运营一起闭环。

公司级智能体趋势调研

已形成:初步梳理外部玩家格局、典型案例和企业系统接入智能体的常见方向。

当前价值:主要是方向感知,帮助观察外界怎么做系统集成、工具封装、权限控制和场景切入。

边界:投入时间不多,内容全面性和可参考性不足,还不能真正作为公司级建设依据。

治理与落地方法补充调研

已形成:拆出工具目录、权限边界、业务对象语义层、评估样例池和试点路线。

当前价值:把“做平台”拆成可讨论、可验证的问题清单。

边界:还没有进入真实业务 POC,收益和可行性需要样例验证。

组织变化与落地模式补充调研

已形成:补充梳理 Walmart、Tesco、Amazon、银泰、京东,以及 OpenAI FDE、Palantir Bootcamp、AWS Innovation Center、咨询公司方法论中的组织协作线索。

当前价值:把“智能体怎么落地”从系统技术问题扩展到业务角色、现场共创、治理责任和一线使用方式,便于后续判断组织变化是否也需要纳入建设参考。

边界:公开资料仍以官方披露、咨询方法论、厂商口径和媒体报道为主,只能作为参考方向,不能直接当成可复制组织方案。

后续讨论方向

  • 继续把资料调研收敛成“可讨论问题”和“候选样例”,不要直接上升为正式落地方案。
  • 候选样例优先围绕只读查询、建议生成、工单创建、报告生成和研发排障,避免一开始做高风险自动执行。
  • 将组织变化纳入后续讨论:重点看是否需要按业务角色组织 Agent 能力,以及是否采用轻量 FDE 式小队连接业务、产品、工程、数据、安全和一线代表。
  • 若要进入下一阶段,建议先产出一个最小样例验证清单:场景、用户角色、可调用工具、禁止动作、预期输出、评估口径。

下周计划

P0

完成 OpenClaw 0527 全量自动化功能测试

验证业务功能是否满足,并与 0323/0522 做整体性能情况对照。

P1

深入研究 OpenClaw 可应用能力

围绕 ClawHub 插件市场、插件审批 hooks、图像/影音生成、TaskFlows/Memory、子代理、OpenTelemetry、群聊与个人机器人架构,继续判断业务应用价值和技术支撑边界。

P1

继续讨论 AI/Agent 调研材料

先做讨论、拆解和样例验证,不直接上升为落地方案。