OpenClaw 后续功能规划与待办任务
#OpenClaw #规划 #待办
记录 OpenClaw 当前运行状态,以及后续可以接入的功能、待解决问题和扩展方向。本文随进展持续更新。
待办维护约定(2026-07-23):当前待办统一维护在跨设备共享的家庭实验室 TODO 源;本文保留规划背景与面向阅读的快照。新事项必须有优先级、状态、依赖、下一步与验收标准,完成后从活动列表移出,避免从旧博客或聊天记录反推状态。
文章边界:本文只维护状态、优先级、依赖、验收结论和专题入口。完整命令、性能矩阵、失败证据与清理清单以对应专题为准,避免规划快照成为第二份实施记录。
分流/审核状态(2026-08-10):OC-06 已完成非生产分类评测;OC-07 的
deterministic PoC 已通过,但 Qwen3-4B 在冻结 3 秒门禁下不晋级。两者都只是建议层,不能替代确定性规则、显式审批或工具执行门禁。生产状态以共享 TODO 为准。
本系列:部署实录 · 配置续集 ·
模型路由与 Guardian · Exec 审批治理 ·
公网访问 · Headroom 接入 ·
本地记忆与无审批能力边界 · 微信安全下载体系
· 高权限 NAS Skill 静态审计 · N100 只读 NAS Observer · NAS Observer 能力扩展 · 媒体成品链
N100 的独立 Rescue 载体通过第一轮静态结构验收后,又在写入前检查中发现包管理内容损坏,当前禁止启动、设置一次性启动项或执行系统镜像。即使将来重建通过,它也只为宿主离线恢复提供基础设施,不赋予 OpenClaw 重启或镜像权限。设计与证据门禁见 《N100 系统盘取证恢复与安全启动重构》。
一、当前状态(截至 2026-06-29)
| 项目 | 状态 | 备注 |
|---|---|---|
| OpenClaw 容器 | 运行中 | N100, network_mode: host, :18789 |
| 公网 HTTPS 访问 | 已配置 | https://your.domain.example |
| 主力 LLM | DeepSeek V4 Flash | deepseek/deepseek-v4-flash |
| Fallback LLM | Ollama qwen3:8b | 本地 Win11, 192.168.2.10 |
| 163 邮箱插件 | 运行中 | email 插件 |
| QQ 邮箱插件 | 运行中 | gmail 插件兼容 QQ SMTP |
| Hermes Agent | 已部署 | 待填入 OpenRouter API Key |
| 微信插件 | 已安装已启用 | @tencent-weixin/openclaw-weixin v2.4.6 |
| CRON 任务调度 | 全部迁移到 heartbeat agent | 统一管理 |
| SSH 到 Mac M1 | 已配置 | 通过 /root/.openclaw/.ssh/openclaw_id key |
二、待配置渠道(Channels)
渠道扩展统一对应当前 TODO 的
OC-09;本节只记录各渠道的前置条件,不单独形成活动待办。
2.1 微信(openclaw-weixin) ✅ 已完整配置并验证
-
现状:已安装(v2.4.6)、已登录、已验证文字消息及文件投递(.xlsx)
-
多账号:双机器人账号已分别与联系人建立 session,插件通过 context-token 自动路由
-
会话隔离:已设置
session.dmScope = per-account-channel-peer -
已知陷阱:
ilink/bot/getuploadurl的to_user_id严格区分大小写,全小写 openid 返回ret:-1;应从 incoming 消息上下文取原始 openid,勿手动拼写 -
文件上传流程:getUploadUrl → AES-128-ECB 加密 → PUT CDN → sendFileMessageWeixin
-
调试日志:
/tmp/openclaw/openclaw-<date>.log(JSON 格式,容器重启后丢失) -
配置位置:
data/openclaw.json→plugins.entries.openclaw-weixin
2.2 QQ Bot(qqbot)
-
现状:已加入
plugins.allow白名单,配置项为空 -
需要:前往 q.qq.com 注册机器人,获取
AppID和AppToken -
注意:
qqbot对接 QQ 开放平台 API,不是个人 QQ 账号登录 -
配置位置:
data/openclaw.json→plugins.entries.qqbot
2.3 飞书(feishu)
-
现状:已加入
plugins.allow白名单,配置项为空 -
需要:在飞书开放平台创建机器人,获取 App ID / App Secret / Webhook URL
2.4 iMessage
-
现状:已加入
plugins.allow白名单 -
限制:仅支持 macOS 宿主机
-
优先级:低
三、任务调度体系(2026-06-29 重构)
调度方案原则
-
Heartbeat:低频系统健康检查(12h),有异常才输出
-
Cron:精确时间点的具体任务
-
所有 cron 统一绑定到
heartbeatagent,工作区workspace-heartbeat
Heartbeat(agent: heartbeat)
1 | { |
检查内容:磁盘空间(宿主机+容器)、系统进程健康
Cron 任务
| 任务 | 时间(北京) | Agent | 说明 |
|---|---|---|---|
| 下载进度播报 | 08:00 | heartbeat | 追踪 qB 下载中/刚完成的种子 |
| 邮件摘要 | 09:00 | heartbeat | 检查 163+QQ 邮箱未读 |
| 邮件摘要 | 12:00 | heartbeat | 同上 |
| 邮件摘要 | 18:00 | heartbeat | 同上 |
HEARTBEAT.md 位于
1 | /root/.openclaw/workspace-heartbeat/HEARTBEAT.md |
方案记录
1 | /root/.openclaw/workspace-heartbeat/SCHEDULE.md |
四、下载管理(2026-06-29 新增)
qBittorrent 状态
-
Web UI:http://192.168.2.14:9090
-
管理脚本:
/root/.openclaw/workspace/tools/qbit_shell.sh -
支持操作:list / status / add / delete / pause / resume
跟踪中下载
| 资源 | 格式 | 大小 | 状态 |
|---|---|---|---|
| 棋士 Playing.Go S01 | 1080p H264 MiniTV | 8.18 GB | 刚添加 |
| 进击的巨人 Complete | 1080p HEVC 双语 | 46 GB | 224 做种者 ✅ |
| Cyberpunk Edgerunners | 1080p HEVC | 5 GB | 正常下载中 |
字幕管理
-
进击的巨人中文字幕:已下载诸神字幕组 131 个 ASS 文件
-
待办:下载完成后匹配文件名
五、模型与 API 配置(待续)
Ollama 新模型
Win11 推理机(192.168.2.10)已有模型:qwen2.5-coder:7b、llava:7b、nomic-embed-text、qwen3:8b、deepseek-r1:8b
本地知识库规划(已纳入 OC-08)
当前执行顺序见 OC-08:先确认 MT Photos Search API 的筛选能力,再选择向量库、embedding 与 OpenClaw 的集成边界;不再将本节的旧清单作为独立 TODO。
2026-07-24 已完成第一轮脱敏、纯离线验证。MT Photos 的普通搜索、V2 筛选、CLIP 语义搜索和搜索提示可先通过只读适配器统一,不必立即部署向量库或重建 embedding 流水线。适配器已加入输入输出字段白名单、分页上限、超时与错误归一化、日志脱敏,并验证未知/敏感字段不会进入输出;未注入传输层时默认拒绝联网。
下一阶段只安排一次短时、可审计的真实查询,使用专用且可撤销的只读凭据,确认家庭实例的字段、分页语义和实际检索价值。该验证通过前,不接入 OpenClaw,也不建设完整 RAG。
六、待解决技术问题
6.1 ollama.auth 被 migration 重置(已知 bug)
现象:OpenClaw 执行 doctor --fix 或插件安装触发配置迁移后,ollama.auth 被重写为 "none"。
临时修复:
1 | sudo python3 -c " |
6.2 deepseek-chat 模型 ID 变更(已完成 2026-07-20)
DeepSeek 已将 deepseek-chat 重命名为 deepseek-v4-flash,openclaw.json 中所有引用已同步更新。
6.3 SSH 基础设施
-
SSH key 位于
/root/.openclaw/.ssh/openclaw_id(Docker volume 挂载,持久化) -
已配别名
mac(→ 192.168.2.13)、mihome(→ 192.168.2.14) -
日志、TODO 可直接通过 SSH 写入 Mac 笔记目录
6.4 微信 getuploadurl API 大小写敏感(2026-07-21)
现象:文字消息可正常发出,但文件发送持续失败,返回 getUploadUrl returned no upload URL,API 原始响应为 {"ret":-1}。
根因:ilink/bot/getuploadurl 的 to_user_id 参数严格区分大小写。将 openid 转为全小写后请求失败;使用 getupdates API 返回的原始混合大小写格式则正常。sendmessage(文字消息)对大小写相对宽松,因此出现两者表现不一致的情况。
规则:永远从 incoming 消息上下文取原始 openid,禁止手动拼写或 .toLowerCase()。详见 调试踩坑文章。
七、当前 TODO 快照(2026-07-27)
| ID | 优先级 | 状态 | 任务 | 依赖 / 验收 |
|---|---|---|---|---|
| OC-01 | P0 | 完成 | 本地模型重载与可靠切换 | 已完成 Q3_K_M → UD IQ3_S 实际重载、健康检查、配置备份与回滚;WebChat UI 核对转入 OC-03 |
| OC-02 | P0 | 完成 | GPU Guardian 手动受控启停联调 | 已完成 PrepareStop → 手动停止 → PrepareStart → 手动启动 → RestoreLocal;最终复核 UD IQ3_S、单实例、路由恢复与配置校验,Guardian 仍保持 dry-run |
| OC-03 | P1 | 完成 | WebChat 与模型验证矩阵 | NO_PROXY 最小修复后云端 V1 成功;本地 UD IQ3_S、49152、单实例与完整路由恢复通过,Guardian 仍 dry-run |
| OC-04 | P1 | 阻塞 | 服务入口收口 | MT Photos 旧公网入口已关闭;按用户要求暂停继续退役 qBittorrent/WebDAV |
| OC-05 | P0 | 完成 | exec-approvals 审批基线核验与历史治理 |
生产策略、真实询问/拒绝、历史脱敏与受限归档均已验证 |
| OC-06 | P1 | 阶段完成 | 请求语义分类与能力路由 | Win11 Qwen3-4B 主集/holdout 为 97.5%/96.875%,冷/热 TTFT 87/26 ms,8 路最慢 929 ms;未接线适配器的异常与高风险路径均回退 ask。生产接线仍需另批 |
| OC-07 | P2 | 阶段完成/不晋级 | 工具调用安全审查模型 | deterministic PoC 32/32、重复 100 次、fuzz 1000 且 fail-open=0;Qwen3-4B 冷/热 pilot 均触发冻结 3 秒超时并安全回退人工,未继续 192 次、未调参、未接生产。设计与结果见审批专题 |
| OC-08 | P2 | 下一步 | 本地知识库 / MT Photos 检索 | 离线只读适配器与安全测试已通过;待专用可撤销只读凭据和一次真实查询验证 |
| OC-09 | P3 | 候选 | QQ Bot、飞书、iMessage、HA 等 | 有明确使用场景后再分别立项 |
| OC-10 | P1 | 完成 | OpenClaw 常见场景模型验证 | UD IQ3_S canonical-v2 单模型基线及 SHA-256 冻结清单已归档;第二模型选型与横向测试延期至 OC-15 |
| OC-15 | P1 | 阶段完成 | 本地备用模型与视觉能力池 | 已完成 coder、VLM、SDXL 生成/编辑、Real-ESRGAN、通用量化和隔离低对齐候选的实测与生产恢复;授权受限和生成式修复质量档延期 |
| OC-20 | P1 | 下一步 | 专业能力池补位与低对齐边界消融 | 三档场景横评已收口:Dolphin8B继续性能档;35B Abliterated v2内容/格式最强但预算内完成和稳定性不足,KEEP而不晋级均衡档。Code、图片编辑、超分和低对齐均衡档仍有缺口;详见模型选型专题 |
| OC-21 | P1 | 完成 | 基础工具、纯本地记忆与审批边界收口 | 搜索、代理、微信权限和三套本地索引已验收;仅追加精确插件 ID llama-cpp,无私人数据上云。无审批能力覆盖评估见专项笔记 |
| OC-22 | P1 | 完成 | 微信内文本式交互审批 | 精确 upstream、镜像与 Weixin artifact SHA 已冻结;官方 approval capability 与 Gateway resolve 已接入,SQLite WAL 跨 worker CAS、TTL、重放、并发、崩溃恢复和 unknown fail-closed 闭合。生产无投递、无执行合成拒绝链通过 |
| OC-23 | P0 | 进行中 | 微信下载真实全生命周期回归 | 实现阶段完成后出现 context overflow、grammar、session lock、可信 handoff 和确认路由回归,已重新打开;模型可用窗口再做真实微信全链路 |
| OC-24 | P1 | 下一步 | 下载最高综合画质与媒体验收 | 下载前质量排序,完成后核验分辨率、编码、HDR、默认音轨和中文字幕 |
| OC-25 | P0 | 进行中 | 日常可靠性收口 | 统一处理 compaction、会话 drain、错误分类和 fallback/隐私矩阵 |
| OC-41 | P2 | 完成 | fnOS NAS Skill审计与N100安全适配 | fnOS制品继续不晋级;独立NAS Observer已扩展为17项固定工具,包含全面脱敏诊断、受控探针、SMART short receipt/ETA和只读恢复preview,仍无Docker socket、通用root或任意路径。见静态审计、基础只读架构与能力扩展专题 |
最近完成:本地模型切换、GPU Guardian dry-run、运行配置挂载核对,以及一次完整的人工受控停机/恢复与路由 handoff 闭环。真实自动启停尚未启用。详细过程与流程图见 《OpenClaw 模型路由与 Guardian 交接》。
当前优先顺序与手动 GPU 模式(2026-07-27)
近期先处理三项:
-
OC-25:收口 compaction、维护操作前的 session drain、用户可见错误分类,以及按错误类型和隐私边界决定的 fallback 矩阵。
-
OC-23:在 desktop 模型可用窗口重新完成真实微信下载全生命周期回归。
-
OC-22:已生产收口;后续仅在 OpenClaw/Weixin 升级时重放隔离矩阵并复核官方接缝。
其余 OC-06/12、OC-20、OC-24、OC-11、OC-16 暂后移。近期 GPU 会被游戏占用,
llama-server 由用户手动关闭;Guardian 继续 dry-run,不自动拉起服务。健康检查应把这类停机标为计划状态。普通公开请求是否转云与私人内容不得上云,必须由 OC-25 的明确
fallback 矩阵分别处理。
OC-25 日常可靠性收口
真实使用已经确认四类问题需要统一处理:
-
上下文预算紧张,main 和 download-discovery 都出现过 overflow 与自动压缩失败;
-
sessions.reset与活动微信请求并发会触发 session takeover,维护操作必须先 drain; -
session lock、格式错误、网页提取失败和管理 abort 目前都可能只显示通用错误;
-
已配置 fallback 不代表所有错误都应重跑,副作用工具和私人内容尤其不能无条件回退。
验收目标不是“任何错误都切云”,而是每种失败都有确定分类、用户可理解的下一步和可审计的 provider 决策;不得重复下载、删除、发送等副作用,也不得上传私人数据。
OC-10 UD IQ3_S 单模型基线(2026-07-24)
canonical-v2 已完成 cold 3 条、hot 3 条和 repeat 12 条有效样本。全部请求都使用本地 UD IQ3_S,未出现 fallback、工具调用、模型身份漂移或运行错误。普通对话题长期稳定为 3/4,中文理解题稳定为 4/4;严格结构化输出题多数为 4/4,但 cold 阶段为 2/4,repeat 中另有一次因额外循环和无关文字降为 1/4,说明格式遵循存在可复现的概率性波动。所有原始扣分均保留,没有重测或调整评分标准。
离线批次校验也已补强:空批次不得存在结果;完成批次必须核对数量、质量失败计数、唯一运行标识、schema、版本、比较组、模型身份以及无 fallback/工具/运行异常。当前三个批次校验均通过。
2026-07-24 决定先冻结并归档这套 UD IQ3_S 单模型基线,当前不继续第二模型选型或横向测试。已有第二模型受控切换方案只作为延期参考,不触发模型切换、服务启停或新样本发送。OC-10 当前阶段以“单模型结果可复现、原始扣分不改写、质量波动有记录”为验收重点;以后重新启动备用模型能力池时,再决定是否恢复同版本横向测试。
最终归档复核确认 18 条结果对应 18 个唯一运行标识,严格 preflight、schema、版本、比较组、模型身份及无 fallback/工具/运行异常检查全部通过;冻结 SHA-256 清单仅包含题库、schema、rubric、离线校验器、manifest 和脱敏结果。按调整后的范围,OC-10 当前阶段完成。
备用模型与视觉能力池(OC-15,2026-07-26 阶段完成)
后续需求不再只定义为“替换主模型”,而是按任务建立独立能力池:
-
coder:均衡无 offload 与允许 CPU offload 的质量档;
-
低拒答/审计与质量通用模型:仅用于敏感数据无法交给云端时的本地备选,并与有工具权限的主 Agent 隔离;
-
VLM:面向 OCR、截图、图表、UI 和一般视觉理解的均衡档与复杂视觉推理质量档;
-
图像管线:文生图、参考图编辑/风格迁移、保真超分与生成式修复分别建立均衡档和质量档。
完整受控窗口已经完成,所有大文件都由 milin_desktop 直接下载,并为模型固定仓库 revision、许可证、大小和 SHA-256。结果不是“下载即入选”:
-
Qwen3-Coder 30B-A3B Q3_K_M 六题传输全部成功,但语义 0/6,拒绝接入 code 路由;
-
Qwen3-VL 8B 三个截图/图表/表格样例语义 3/3,但严格裸 JSON 0/3,必须加确定性清洗和 schema 校验;
-
SDXL 文生图可运行,但拓扑约束只部分满足;两档 img2img 都没有通过“只改背景”的受控编辑要求;
-
旧 Real-ESRGAN NCNN 在 RTX 5080 上输出损坏,PyTorch/ComfyUI x4plus 正常且速度约 0.47 秒,应作为默认超分路径;
-
同基础 Qwen3.6 35B-A3B Q3_K_M 的三项通用冻结题通过,但只是比较候选,不替换稳定 UD IQ3_S;
-
Meta-Llama 3.1 8B abliterated Q4_K_M 五项中通过四项,中文通用题失败,只能作为无工具、无网络、无凭据的隔离顾问。
需账号接受条款的 FLUX 等权重标记为 DEFERRED_AUTH_REQUIRED,没有绕过 gated 下载;SUPIR 和 Qwen Image/Edit 质量档继续等待许可证与运行时审计。最终已恢复 UD IQ3_S、49,152 context、parallel 1、单实例、本地路由、维护前 session 快照和 cron 状态。视觉与性能细节同步记录在 《milin_desktop(RTX 5080 16GB)本地 LLM 选型分析》。
专业能力池第二轮(OC-20,2026-07-26)
第二轮统一使用冻结题目、严格 adapter、真实 wall time、显存采样与缺失指标原因,不因输出不理想而改题重测。最初发现 PowerShell 5.1 请求体没有显式 UTF-8,中文提示被破坏;相关结果全部标记为无效,完成固定中文 marker 回显后才重新计分。
当前结论:
-
三个 code 候选在有效重跑中分别为 0/6、0/6、1/6,均不接入 code 路由;Qwen3.6-27B 虽唯一通过严格解析器题,但约 11 tok/s,并有两题输出截断。
-
30B VLM 对 UI、图表和表格三张冻结图片均通过严格 adapter 与语义评分,P50 约 2.18 秒、平均约 55.7 tok/s,晋级下一轮视觉横评。
-
Qwen Image Q3_K_M 固定工作流成功生成中文“入口—路由—模型”流程图,服务端约 69 秒;当前 Image Edit 组合因视觉 encoder 投影维度不兼容而失败。
-
Dolphin 8B 的五项隔离基础能力全部通过,平均约 158 tok/s;它不获得 Agent、工具、网络、凭据、私人数据或生产路由权限。
所有维护窗都遵守“先云端、排空请求、再停本地;恢复时先健康检查、再 RestoreLocal”的顺序。最终主服务仍是 UD IQ3_S、49,152 context、parallel 1;21 个 session、六项 cron、Guardian maintenance 和 ownership 均恢复或清空。Guardian 仍为 dry-run,未启用真实自动动作。
后续补位评测已完成:Dolphin 24B、SwinIR-L、Devstral 24B 与 Unlimited-OCR 均因格式、质量或鲁棒性门禁未晋级;PaddleOCR-VL 和 Qwen3-4B 完成非生产验收,但未接入生产路由。模型、运行时与复算证据按 KEEP 清单保留,生产 OpenClaw、controller、Guardian 和 session 未改变。官方 Edit FP8 encoder 兼容性仍待安排;许可证不明确或限制通用使用的权重不进入能力池。完整指标、失败边界与生成样例统一维护在 《milin_desktop(RTX 5080 16GB)本地 LLM 选型分析》。
2026-08-14补充的低对齐三档v3横评进一步确认:35B Abliterated v2具有明显低拒绝和较强结构能力,但在实用输出预算内的任务完成度不足,且非日常高风险诊断几乎不形成有效边界,因此仅KEEP为完全隔离候选,不接OpenClaw或真实工具。后续消融与Code分层复测继续归OC-20,稳定结论统一回写模型选型专题。
八、归档的历史短期 TODO
九、分流与工具审核调研结论(2026-07-23)
-
请求难度分流:当前不建议直接部署“所有请求先过小模型”的 router。固定 agent + fallback 已满足主要需求;优先采用确定性规则(本地敏感数据、本地服务健康、明确云端许可、不可逆操作人工确认)。只有积累到两周成本/延迟/误分流样本后,再以 N100 CPU 上的 0.6B 短上下文 JSON 分类器做 MVP。
-
N100 CPU:Intel N100(4 核、16 GiB RAM)可承载低频小模型分类,但不应承担主 Agent 推理、复杂工具决策或安全放行。
llama-server的 router mode 是按请求模型 ID 转发,不会替你判断质量、成本或隐私。 -
工具审核:需要的是分层防护而不是“一个审核模型”。先收紧既有
exec-approvals的宽松 agent 策略、处理敏感历史记录并保留人工审批;后续小模型仅做无凭据的只读风险建议,超时或不确定一律不放行。 -
成本与隐私:云端分类虽便宜但会把请求先外发;本地分类没有 token 费但有运维和误判成本。DeepSeek V4 Flash 当前支持工具调用,且价格随官方页面变化,应按实时价格核算。
