#OpenClaw #规划 #待办

记录 OpenClaw 当前运行状态,以及后续可以接入的功能、待解决问题和扩展方向。本文随进展持续更新。

待办维护约定(2026-07-23):当前待办统一维护在跨设备共享的家庭实验室 TODO 源;本文保留规划背景与面向阅读的快照。新事项必须有优先级、状态、依赖、下一步与验收标准,完成后从活动列表移出,避免从旧博客或聊天记录反推状态。

文章边界:本文只维护状态、优先级、依赖、验收结论和专题入口。完整命令、性能矩阵、失败证据与清理清单以对应专题为准,避免规划快照成为第二份实施记录。

分流/审核状态(2026-08-10):OC-06 已完成非生产分类评测;OC-07 的
deterministic PoC 已通过,但 Qwen3-4B 在冻结 3 秒门禁下不晋级。两者都只是建议层,不能替代确定性规则、显式审批或工具执行门禁。生产状态以共享 TODO 为准。

本系列部署实录 · 配置续集 ·
模型路由与 Guardian · Exec 审批治理 ·
公网访问 · Headroom 接入 ·
本地记忆与无审批能力边界 · 微信安全下载体系
· 高权限 NAS Skill 静态审计 · N100 只读 NAS Observer · NAS Observer 能力扩展 · 媒体成品链

N100 的独立 Rescue 载体通过第一轮静态结构验收后,又在写入前检查中发现包管理内容损坏,当前禁止启动、设置一次性启动项或执行系统镜像。即使将来重建通过,它也只为宿主离线恢复提供基础设施,不赋予 OpenClaw 重启或镜像权限。设计与证据门禁见 《N100 系统盘取证恢复与安全启动重构》


一、当前状态(截至 2026-06-29)

项目 状态 备注
OpenClaw 容器 运行中 N100, network_mode: host, :18789
公网 HTTPS 访问 已配置 https://your.domain.example
主力 LLM DeepSeek V4 Flash deepseek/deepseek-v4-flash
Fallback LLM Ollama qwen3:8b 本地 Win11, 192.168.2.10
163 邮箱插件 运行中 email 插件
QQ 邮箱插件 运行中 gmail 插件兼容 QQ SMTP
Hermes Agent 已部署 待填入 OpenRouter API Key
微信插件 已安装已启用 @tencent-weixin/openclaw-weixin v2.4.6
CRON 任务调度 全部迁移到 heartbeat agent 统一管理
SSH 到 Mac M1 已配置 通过 /root/.openclaw/.ssh/openclaw_id key

二、待配置渠道(Channels)

渠道扩展统一对应当前 TODO 的 OC-09;本节只记录各渠道的前置条件,不单独形成活动待办。

2.1 微信(openclaw-weixin) ✅ 已完整配置并验证

  • 现状:已安装(v2.4.6)、已登录、已验证文字消息及文件投递(.xlsx)

  • 多账号:双机器人账号已分别与联系人建立 session,插件通过 context-token 自动路由

  • 会话隔离:已设置 session.dmScope = per-account-channel-peer

  • 已知陷阱ilink/bot/getuploadurlto_user_id 严格区分大小写,全小写 openid 返回 ret:-1;应从 incoming 消息上下文取原始 openid,勿手动拼写

  • 文件上传流程:getUploadUrl → AES-128-ECB 加密 → PUT CDN → sendFileMessageWeixin

  • 调试日志/tmp/openclaw/openclaw-<date>.log(JSON 格式,容器重启后丢失)

  • 配置位置data/openclaw.jsonplugins.entries.openclaw-weixin

2.2 QQ Bot(qqbot)

  • 现状:已加入 plugins.allow 白名单,配置项为空

  • 需要:前往 q.qq.com 注册机器人,获取 AppIDAppToken

  • 注意qqbot 对接 QQ 开放平台 API,不是个人 QQ 账号登录

  • 配置位置data/openclaw.jsonplugins.entries.qqbot

2.3 飞书(feishu)

  • 现状:已加入 plugins.allow 白名单,配置项为空

  • 需要:在飞书开放平台创建机器人,获取 App ID / App Secret / Webhook URL

2.4 iMessage

  • 现状:已加入 plugins.allow 白名单

  • 限制:仅支持 macOS 宿主机

  • 优先级:低


三、任务调度体系(2026-06-29 重构)

调度方案原则

  • Heartbeat:低频系统健康检查(12h),有异常才输出

  • Cron:精确时间点的具体任务

  • 所有 cron 统一绑定到 heartbeat agent,工作区 workspace-heartbeat

Heartbeat(agent: heartbeat)

1
2
3
4
5
6
7
8
{
"every": "12h",
"workspace": "/root/.openclaw/workspace-heartbeat",
"lightContext": true,
"isolatedSession": true,
"target": "last",
"ackMaxChars": 0
}

检查内容:磁盘空间(宿主机+容器)、系统进程健康

Cron 任务

任务 时间(北京) Agent 说明
下载进度播报 08:00 heartbeat 追踪 qB 下载中/刚完成的种子
邮件摘要 09:00 heartbeat 检查 163+QQ 邮箱未读
邮件摘要 12:00 heartbeat 同上
邮件摘要 18:00 heartbeat 同上

HEARTBEAT.md 位于

1
/root/.openclaw/workspace-heartbeat/HEARTBEAT.md

方案记录

1
/root/.openclaw/workspace-heartbeat/SCHEDULE.md

四、下载管理(2026-06-29 新增)

qBittorrent 状态

  • Web UIhttp://192.168.2.14:9090

  • 管理脚本/root/.openclaw/workspace/tools/qbit_shell.sh

  • 支持操作:list / status / add / delete / pause / resume

跟踪中下载

资源 格式 大小 状态
棋士 Playing.Go S01 1080p H264 MiniTV 8.18 GB 刚添加
进击的巨人 Complete 1080p HEVC 双语 46 GB 224 做种者 ✅
Cyberpunk Edgerunners 1080p HEVC 5 GB 正常下载中

字幕管理

  • 进击的巨人中文字幕:已下载诸神字幕组 131 个 ASS 文件

  • 待办:下载完成后匹配文件名


五、模型与 API 配置(待续)

Ollama 新模型

Win11 推理机(192.168.2.10)已有模型:qwen2.5-coder:7bllava:7bnomic-embed-textqwen3:8bdeepseek-r1:8b

本地知识库规划(已纳入 OC-08)

当前执行顺序见 OC-08:先确认 MT Photos Search API 的筛选能力,再选择向量库、embedding 与 OpenClaw 的集成边界;不再将本节的旧清单作为独立 TODO。

2026-07-24 已完成第一轮脱敏、纯离线验证。MT Photos 的普通搜索、V2 筛选、CLIP 语义搜索和搜索提示可先通过只读适配器统一,不必立即部署向量库或重建 embedding 流水线。适配器已加入输入输出字段白名单、分页上限、超时与错误归一化、日志脱敏,并验证未知/敏感字段不会进入输出;未注入传输层时默认拒绝联网。

下一阶段只安排一次短时、可审计的真实查询,使用专用且可撤销的只读凭据,确认家庭实例的字段、分页语义和实际检索价值。该验证通过前,不接入 OpenClaw,也不建设完整 RAG。


六、待解决技术问题

6.1 ollama.auth 被 migration 重置(已知 bug)

现象:OpenClaw 执行 doctor --fix 或插件安装触发配置迁移后,ollama.auth 被重写为 "none"

临时修复

1
2
3
4
5
6
7
8
sudo python3 -c "
import json
path = '/home/<user>/dockerfile/openclaw/data/openclaw.json'
with open(path) as f: c = json.load(f)
c['models']['providers']['ollama']['auth'] = 'api-key'
with open(path, 'w') as f: json.dump(c, f, indent=2, ensure_ascii=False)
"
docker start openclaw

6.2 deepseek-chat 模型 ID 变更(已完成 2026-07-20)

DeepSeek 已将 deepseek-chat 重命名为 deepseek-v4-flash,openclaw.json 中所有引用已同步更新。

6.3 SSH 基础设施

  • SSH key 位于 /root/.openclaw/.ssh/openclaw_id(Docker volume 挂载,持久化)

  • 已配别名 mac(→ 192.168.2.13)、mihome(→ 192.168.2.14)

  • 日志、TODO 可直接通过 SSH 写入 Mac 笔记目录

6.4 微信 getuploadurl API 大小写敏感(2026-07-21)

现象:文字消息可正常发出,但文件发送持续失败,返回 getUploadUrl returned no upload URL,API 原始响应为 {"ret":-1}

根因ilink/bot/getuploadurlto_user_id 参数严格区分大小写。将 openid 转为全小写后请求失败;使用 getupdates API 返回的原始混合大小写格式则正常。sendmessage(文字消息)对大小写相对宽松,因此出现两者表现不一致的情况。

规则:永远从 incoming 消息上下文取原始 openid,禁止手动拼写或 .toLowerCase()。详见 调试踩坑文章


七、当前 TODO 快照(2026-07-27)

ID 优先级 状态 任务 依赖 / 验收
OC-01 P0 完成 本地模型重载与可靠切换 已完成 Q3_K_M → UD IQ3_S 实际重载、健康检查、配置备份与回滚;WebChat UI 核对转入 OC-03
OC-02 P0 完成 GPU Guardian 手动受控启停联调 已完成 PrepareStop → 手动停止 → PrepareStart → 手动启动 → RestoreLocal;最终复核 UD IQ3_S、单实例、路由恢复与配置校验,Guardian 仍保持 dry-run
OC-03 P1 完成 WebChat 与模型验证矩阵 NO_PROXY 最小修复后云端 V1 成功;本地 UD IQ3_S、49152、单实例与完整路由恢复通过,Guardian 仍 dry-run
OC-04 P1 阻塞 服务入口收口 MT Photos 旧公网入口已关闭;按用户要求暂停继续退役 qBittorrent/WebDAV
OC-05 P0 完成 exec-approvals 审批基线核验与历史治理 生产策略、真实询问/拒绝、历史脱敏与受限归档均已验证
OC-06 P1 阶段完成 请求语义分类与能力路由 Win11 Qwen3-4B 主集/holdout 为 97.5%/96.875%,冷/热 TTFT 87/26 ms,8 路最慢 929 ms;未接线适配器的异常与高风险路径均回退 ask。生产接线仍需另批
OC-07 P2 阶段完成/不晋级 工具调用安全审查模型 deterministic PoC 32/32、重复 100 次、fuzz 1000 且 fail-open=0;Qwen3-4B 冷/热 pilot 均触发冻结 3 秒超时并安全回退人工,未继续 192 次、未调参、未接生产。设计与结果见审批专题
OC-08 P2 下一步 本地知识库 / MT Photos 检索 离线只读适配器与安全测试已通过;待专用可撤销只读凭据和一次真实查询验证
OC-09 P3 候选 QQ Bot、飞书、iMessage、HA 等 有明确使用场景后再分别立项
OC-10 P1 完成 OpenClaw 常见场景模型验证 UD IQ3_S canonical-v2 单模型基线及 SHA-256 冻结清单已归档;第二模型选型与横向测试延期至 OC-15
OC-15 P1 阶段完成 本地备用模型与视觉能力池 已完成 coder、VLM、SDXL 生成/编辑、Real-ESRGAN、通用量化和隔离低对齐候选的实测与生产恢复;授权受限和生成式修复质量档延期
OC-20 P1 下一步 专业能力池补位与低对齐边界消融 三档场景横评已收口:Dolphin8B继续性能档;35B Abliterated v2内容/格式最强但预算内完成和稳定性不足,KEEP而不晋级均衡档。Code、图片编辑、超分和低对齐均衡档仍有缺口;详见模型选型专题
OC-21 P1 完成 基础工具、纯本地记忆与审批边界收口 搜索、代理、微信权限和三套本地索引已验收;仅追加精确插件 ID llama-cpp,无私人数据上云。无审批能力覆盖评估见专项笔记
OC-22 P1 完成 微信内文本式交互审批 精确 upstream、镜像与 Weixin artifact SHA 已冻结;官方 approval capability 与 Gateway resolve 已接入,SQLite WAL 跨 worker CAS、TTL、重放、并发、崩溃恢复和 unknown fail-closed 闭合。生产无投递、无执行合成拒绝链通过
OC-23 P0 进行中 微信下载真实全生命周期回归 实现阶段完成后出现 context overflow、grammar、session lock、可信 handoff 和确认路由回归,已重新打开;模型可用窗口再做真实微信全链路
OC-24 P1 下一步 下载最高综合画质与媒体验收 下载前质量排序,完成后核验分辨率、编码、HDR、默认音轨和中文字幕
OC-25 P0 进行中 日常可靠性收口 统一处理 compaction、会话 drain、错误分类和 fallback/隐私矩阵
OC-41 P2 完成 fnOS NAS Skill审计与N100安全适配 fnOS制品继续不晋级;独立NAS Observer已扩展为17项固定工具,包含全面脱敏诊断、受控探针、SMART short receipt/ETA和只读恢复preview,仍无Docker socket、通用root或任意路径。见静态审计基础只读架构能力扩展专题

最近完成:本地模型切换、GPU Guardian dry-run、运行配置挂载核对,以及一次完整的人工受控停机/恢复与路由 handoff 闭环。真实自动启停尚未启用。详细过程与流程图见 《OpenClaw 模型路由与 Guardian 交接》

当前优先顺序与手动 GPU 模式(2026-07-27)

近期先处理三项:

  1. OC-25:收口 compaction、维护操作前的 session drain、用户可见错误分类,以及按错误类型和隐私边界决定的 fallback 矩阵。

  2. OC-23:在 desktop 模型可用窗口重新完成真实微信下载全生命周期回归。

  3. OC-22:已生产收口;后续仅在 OpenClaw/Weixin 升级时重放隔离矩阵并复核官方接缝。

其余 OC-06/12、OC-20、OC-24、OC-11、OC-16 暂后移。近期 GPU 会被游戏占用,
llama-server 由用户手动关闭;Guardian 继续 dry-run,不自动拉起服务。健康检查应把这类停机标为计划状态。普通公开请求是否转云与私人内容不得上云,必须由 OC-25 的明确
fallback 矩阵分别处理。

OC-25 日常可靠性收口

真实使用已经确认四类问题需要统一处理:

  • 上下文预算紧张,main 和 download-discovery 都出现过 overflow 与自动压缩失败;

  • sessions.reset 与活动微信请求并发会触发 session takeover,维护操作必须先 drain;

  • session lock、格式错误、网页提取失败和管理 abort 目前都可能只显示通用错误;

  • 已配置 fallback 不代表所有错误都应重跑,副作用工具和私人内容尤其不能无条件回退。

验收目标不是“任何错误都切云”,而是每种失败都有确定分类、用户可理解的下一步和可审计的 provider 决策;不得重复下载、删除、发送等副作用,也不得上传私人数据。

OC-10 UD IQ3_S 单模型基线(2026-07-24)

canonical-v2 已完成 cold 3 条、hot 3 条和 repeat 12 条有效样本。全部请求都使用本地 UD IQ3_S,未出现 fallback、工具调用、模型身份漂移或运行错误。普通对话题长期稳定为 3/4,中文理解题稳定为 4/4;严格结构化输出题多数为 4/4,但 cold 阶段为 2/4,repeat 中另有一次因额外循环和无关文字降为 1/4,说明格式遵循存在可复现的概率性波动。所有原始扣分均保留,没有重测或调整评分标准。

离线批次校验也已补强:空批次不得存在结果;完成批次必须核对数量、质量失败计数、唯一运行标识、schema、版本、比较组、模型身份以及无 fallback/工具/运行异常。当前三个批次校验均通过。

2026-07-24 决定先冻结并归档这套 UD IQ3_S 单模型基线,当前不继续第二模型选型或横向测试。已有第二模型受控切换方案只作为延期参考,不触发模型切换、服务启停或新样本发送。OC-10 当前阶段以“单模型结果可复现、原始扣分不改写、质量波动有记录”为验收重点;以后重新启动备用模型能力池时,再决定是否恢复同版本横向测试。

最终归档复核确认 18 条结果对应 18 个唯一运行标识,严格 preflight、schema、版本、比较组、模型身份及无 fallback/工具/运行异常检查全部通过;冻结 SHA-256 清单仅包含题库、schema、rubric、离线校验器、manifest 和脱敏结果。按调整后的范围,OC-10 当前阶段完成。

备用模型与视觉能力池(OC-15,2026-07-26 阶段完成)

后续需求不再只定义为“替换主模型”,而是按任务建立独立能力池:

  • coder:均衡无 offload 与允许 CPU offload 的质量档;

  • 低拒答/审计与质量通用模型:仅用于敏感数据无法交给云端时的本地备选,并与有工具权限的主 Agent 隔离;

  • VLM:面向 OCR、截图、图表、UI 和一般视觉理解的均衡档与复杂视觉推理质量档;

  • 图像管线:文生图、参考图编辑/风格迁移、保真超分与生成式修复分别建立均衡档和质量档。

完整受控窗口已经完成,所有大文件都由 milin_desktop 直接下载,并为模型固定仓库 revision、许可证、大小和 SHA-256。结果不是“下载即入选”:

  • Qwen3-Coder 30B-A3B Q3_K_M 六题传输全部成功,但语义 0/6,拒绝接入 code 路由;

  • Qwen3-VL 8B 三个截图/图表/表格样例语义 3/3,但严格裸 JSON 0/3,必须加确定性清洗和 schema 校验;

  • SDXL 文生图可运行,但拓扑约束只部分满足;两档 img2img 都没有通过“只改背景”的受控编辑要求;

  • 旧 Real-ESRGAN NCNN 在 RTX 5080 上输出损坏,PyTorch/ComfyUI x4plus 正常且速度约 0.47 秒,应作为默认超分路径;

  • 同基础 Qwen3.6 35B-A3B Q3_K_M 的三项通用冻结题通过,但只是比较候选,不替换稳定 UD IQ3_S;

  • Meta-Llama 3.1 8B abliterated Q4_K_M 五项中通过四项,中文通用题失败,只能作为无工具、无网络、无凭据的隔离顾问。

需账号接受条款的 FLUX 等权重标记为 DEFERRED_AUTH_REQUIRED,没有绕过 gated 下载;SUPIR 和 Qwen Image/Edit 质量档继续等待许可证与运行时审计。最终已恢复 UD IQ3_S、49,152 context、parallel 1、单实例、本地路由、维护前 session 快照和 cron 状态。视觉与性能细节同步记录在 《milin_desktop(RTX 5080 16GB)本地 LLM 选型分析》

专业能力池第二轮(OC-20,2026-07-26)

第二轮统一使用冻结题目、严格 adapter、真实 wall time、显存采样与缺失指标原因,不因输出不理想而改题重测。最初发现 PowerShell 5.1 请求体没有显式 UTF-8,中文提示被破坏;相关结果全部标记为无效,完成固定中文 marker 回显后才重新计分。

当前结论:

  • 三个 code 候选在有效重跑中分别为 0/6、0/6、1/6,均不接入 code 路由;Qwen3.6-27B 虽唯一通过严格解析器题,但约 11 tok/s,并有两题输出截断。

  • 30B VLM 对 UI、图表和表格三张冻结图片均通过严格 adapter 与语义评分,P50 约 2.18 秒、平均约 55.7 tok/s,晋级下一轮视觉横评。

  • Qwen Image Q3_K_M 固定工作流成功生成中文“入口—路由—模型”流程图,服务端约 69 秒;当前 Image Edit 组合因视觉 encoder 投影维度不兼容而失败。

  • Dolphin 8B 的五项隔离基础能力全部通过,平均约 158 tok/s;它不获得 Agent、工具、网络、凭据、私人数据或生产路由权限。

所有维护窗都遵守“先云端、排空请求、再停本地;恢复时先健康检查、再 RestoreLocal”的顺序。最终主服务仍是 UD IQ3_S、49,152 context、parallel 1;21 个 session、六项 cron、Guardian maintenance 和 ownership 均恢复或清空。Guardian 仍为 dry-run,未启用真实自动动作。

后续补位评测已完成:Dolphin 24B、SwinIR-L、Devstral 24B 与 Unlimited-OCR 均因格式、质量或鲁棒性门禁未晋级;PaddleOCR-VL 和 Qwen3-4B 完成非生产验收,但未接入生产路由。模型、运行时与复算证据按 KEEP 清单保留,生产 OpenClaw、controller、Guardian 和 session 未改变。官方 Edit FP8 encoder 兼容性仍待安排;许可证不明确或限制通用使用的权重不进入能力池。完整指标、失败边界与生成样例统一维护在 《milin_desktop(RTX 5080 16GB)本地 LLM 选型分析》

2026-08-14补充的低对齐三档v3横评进一步确认:35B Abliterated v2具有明显低拒绝和较强结构能力,但在实用输出预算内的任务完成度不足,且非日常高风险诊断几乎不形成有效边界,因此仅KEEP为完全隔离候选,不接OpenClaw或真实工具。后续消融与Code分层复测继续归OC-20,稳定结论统一回写模型选型专题


八、归档的历史短期 TODO


九、分流与工具审核调研结论(2026-07-23)

  • 请求难度分流:当前不建议直接部署“所有请求先过小模型”的 router。固定 agent + fallback 已满足主要需求;优先采用确定性规则(本地敏感数据、本地服务健康、明确云端许可、不可逆操作人工确认)。只有积累到两周成本/延迟/误分流样本后,再以 N100 CPU 上的 0.6B 短上下文 JSON 分类器做 MVP。

  • N100 CPU:Intel N100(4 核、16 GiB RAM)可承载低频小模型分类,但不应承担主 Agent 推理、复杂工具决策或安全放行。llama-server 的 router mode 是按请求模型 ID 转发,不会替你判断质量、成本或隐私。

  • 工具审核:需要的是分层防护而不是“一个审核模型”。先收紧既有 exec-approvals 的宽松 agent 策略、处理敏感历史记录并保留人工审批;后续小模型仅做无凭据的只读风险建议,超时或不确定一律不放行。

  • 成本与隐私:云端分类虽便宜但会把请求先外发;本地分类没有 token 费但有运维和误判成本。DeepSeek V4 Flash 当前支持工具调用,且价格随官方页面变化,应按实时价格核算。


延伸阅读