> ## Documentation Index
> Fetch the complete documentation index at: https://docs.myrmagent.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 竞品对比

> Myrm 与主流 AI Agent 平台的对比，以及迁移你能获得什么。

# 竞品对比与迁移指南

Myrm 被设计为完整的 AI Agent 工作空间。与仅面向终端的编程 Agent 不同，Myrm 提供 GUI 优先的体验、持久化沙箱、跨会话记忆与企业级安全——同时保留完整编程能力。

<Note>
  **迁移信心**——数据与节奏在你手里：可选 SaaS、自托管或桌面三模；Hermes 技能可 GUI 拖拽 ZIP 导入；先对照下方能力表与分竞品章节再决定。对于插件中心化用户（如 Grok Build），Myrm 支持一键安装**完整 Agent 能力包**（模型 + 技能 + MCP + 子代理 + 安全策略），无需手工拼装多插件。文档与产品均支持 **6 种语言**（zh/en/ja/ko/de/zh-TW）；首次访问自动识别浏览器语言（RFC 7231 Accept-Language 协商），三种部署模式（WebUI / 云托管 / Tauri 桌面端）均适用。
</Note>

在记忆能力上，Myrm 现已形成完整的**诊断可解释 + 遥测完整性闭环**：stream 阶段状态、persist 阶段状态、控制平面聚合告警、前端 `preflight`/`runtime_fallback` 来源解释（含移动端非 hover 文案），并在云模式提供严格 fail-closed 入库（共享 `envelope_id` 幂等 + 共享去重后端不可用时禁止静默本地回退 + `dedup_reject` 原因指标）。最近一次定向回归（2026-07-19）：server 28 passed、control-plane 55 passed、frontend 14 passed。

在单轮能力控制上，Myrm 已提供 **一次性 Skill/MCP 覆写 Chips**，并具备完整可观测闭环（提交/生效/noop/排队/busy/终态 + 失败原因）。2026-07-29 定向验证：frontend 29/29、server 10/10 全通过；聚焦覆盖率达到 frontend 核心文件 lines 62.47%，server 遥测模块 total 72%。迁移团队可直接基于证据做成本与稳定性调优，而非凭经验猜测。

## 最新验证快照（2026-07-30 · Chat Wiki Knowledge Quick Lane · Roadmap #30）

* **Chat Wiki 知识快路径（vs Hermes llm-wiki / OpenClaw memory-wiki / deer-flow / LobsterAI / CoPaw / jiuwenclaw）**：intent **+** knowledge\_query\_service **+** wiki\_knowledge\_lane **+** API query = **16 pytest, 0 failures**（约 6s、server lane、**Chrome MCP E2E 待签收**）。
* **已验证**：`should_use_wiki_knowledge_lane` 闸门（Agent 模式 + `enable_wiki` + vault ready + 问句 intent）；`execute_wiki_knowledge_query` SSOT（Settings `POST /wiki/query` 与 Lane 共用）；`wiki_knowledge_lane` 输出 STATUS → SOURCES → MESSAGE → `execution_lane=wiki_knowledge`；查询失败显式 failed STATUS（不 bare raise、不 silent fallback GeneralAgent）；FE ProgressSteps `wiki_knowledge_lane` / `_clear` + `message_end` lane 字段。
* **对用户可见的竞品优势**：Settings 已可零 LLM 查 Wiki，Chat 短知识问句不再多轮 GeneralAgent tool call — **GUI Chat 零 LLM wiki lane 独家**；Hermes 为 SKILL/CLI 多步；OpenClaw 为 memory-wiki 工具链；六家均无 Settings+Chat 检索 parity + ProgressSteps + SOURCES Drawer 闭环。
* **诚实边界**：无 lite 合成；闸门外仍走 GeneralAgent；Chrome MCP Chat E2E + FE vitest `completionEvents.wikiKnowledgeLane` 本地 bun 待签收。
* **Material SSOT：** `temp-docs/materials/WIKI_KNOWLEDGE_BASE_ADVANTAGE.md` · `USER_EXPERIENCE_ADVANTAGE.md` §22 #30 小节 · `services/wiki/_ARCH.md` · `lanes/_ARCH.md`

## 最新验证快照（2026-07-30 · ChatExecutionPrewarm Turn1 · Roadmap #29）

* **Turn1 冷启动预热（vs Hermes CLI 并行 init / OpenClaw TUI 发送前 prewarm）：** coordinator **4/4** + prewarm API **3/3** + CDP log helper **2/2** = **9 pytest，0 失败**（\~10s，server lane）。Chrome E2E 另断言 `Turn prewarm requested` 日志 ≥1，再接既有 **2msg1build** execution-cache 证明（`test_execution_cache_chrome_e2e.py`）。
* **已验证：** EmptyChat 挂载 + MessageInput focus + AgentConfigPanel 切换 → `POST /agents/chats/{id}/prewarm`；发送路径 `join_for_turn(0.3s)` + `coalesced_acquire`；SSE ProgressSteps `turn_prewarm_agent` / `turn_prewarm_memory` + `brief_pending` 时无条件 `turn_prewarm_memory_clear`；FE 模块级 inflight 去重；autoOnMount **不在** unmount 时 DELETE（首条发送 EmptyChat→ChatWindow 安全）。
* **对用户可见的竞品优势：** Hermes v0.19 并行 init **仅 CLI**；OpenClaw prewarm **仅 TUI 首条发送前** — 均无 GUI EmptyChat/focus/换 Agent 触发 + ProgressSteps 等待 UX。Turn2+ 仍走 per-chat `execution_cache_reuse`（Chrome E2E 2msg1build）。
* **诚实边界：** join 窗口 0.3s — 极慢 memory 仍可能 Turn1 miss brief（与旧 250ms 串行同类）；prewarm 失败无 GUI toast（send 冷路径 fallback）。前端 vitest 4 cases 未在 agent 环境跑（无 bun/node）— 本地签收：`bun run test src/hooks/chat/__tests__/useChatTurnPrewarm.test.ts`。
* **Material SSOT：** `temp-docs/materials/COMPETITIVE_HERMES_ADVANTAGE.md` §31 · `USER_EXPERIENCE_ADVANTAGE.md` §22 Turn1 小节 · `prewarm/_ARCH.md`

## 最新验证快照（2026-07-30 · Hermes 八篇系列 + OpenClaw 对比总结 · Article 13）

* **系列结论（庄码收官文 · 无评论）**：OpenClaw = 稳定工具 · Hermes = 成长搭档。Myrm = **GUI-first 成长搭档** + OpenClaw 级 Channel/Skill/Tool 骨架，三端（Local/Tauri/云 CP）同构。
* **迁移用户实得（诚实）**：
  * **Myrm ≫**：GUI 迁移向导（5 源 dry-run/confirm/rollback）vs `hermes claw migrate` CLI；Onboarding 4 步 vs 纯终端；8 类记忆+Wiki vs Hermes 2200 字 MEMORY.md；HITL 写入审批 vs Hermes 直写。
  * **Myrm ≥**：Cron+Nudge 类能力（Cron GUI+push+situation\_report+HeartbeatEvaluator）；FTS5 跨会话（`conversation_search`）；云 sleep/wake（CP `sleep_sandbox`）；子代理（SubagentDashboard）；国产模型 Provider GUI。
  * **进行中（不隐瞒）**：Vision Fallback **WebUI 已≥** · **飞书/渠道/cron 未注入 vision\_fallback** → roadmap `hermes_auxiliary_vision_*` 2 项 P1；`/learn` 工作流 → `hermes_learn_skill_*` 2 项 P0；Hermes sessions 导入 → memory #3 扩展。
* **WORTH:NO（系列提及但不立项）**：Python RPC 子代理模式（sandbox code-as-action ≥）；Nous Portal 五合一 API；RL 批量轨迹研究管线（非 GUI 主用户）。
* **材料 SSOT**：`temp-docs/materials/COMPETITIVE_HERMES_ADVANTAGE.md` §30 · `temp-docs/roadmap/hermes_openclaw_series_summary_cross_reference_roadmap.md`

## 最新验证快照（2026-07-30 · Wiki Evidence Closure v2 #4+#5）

* **证据引用 GUI（vs OpenClaw / Hermes / deer-flow / LobsterAI / CoPaw / jiuwenclaw）**：`test_query_closure_v2` **4/4** + `test_best_first` **5/5** + `test_source_citations` **6/6** + `test_wiki_recall_benchmark_gate` **1/1** = **16 tests, 0 failures**（约 6s、2 批、harness-only、**无 Chrome MCP** — 本环境无 Node 未跑 vitest）。
* **已验证**：Chat/Settings citation Drawer 展示 claim 状态 + 编译置信度 + raw 摘录；fresh supported claim 检索优先于 stale contested；Settings Query 检索路径 trace（index/seeds/concepts）；citation score 非硬编码 1.0。
* **对比竞品**：OpenClaw 有 CLI `raw-claim`/`source-evidence` + claim confidence rerank（`query.test.ts:602`）**无 GUI Drawer**；Hermes llm-wiki skill / deer-flow / LobsterAI / CoPaw / jiuwenclaw **无** claim-level citation GUI；6 家均无 Settings 检索 trace 卡片。
* **诚实边界**：无 route-question 模式（OpenClaw 有 · frontmatter schema 待办）；Chat 无 retrieval trace（Settings 调试面）；无 Trust card/SSE lineage。

## 最新验证快照（2026-07-30 · Wiki ↔ Memory 边界 #27）

* **Wiki 与 Memory 写入边界（vs Hermes / OpenClaw / Mem0 概念）**：`test_wiki_memory_boundary` **7/7** + save 护栏 **3/3** + extract prompt **2/2** + agent 接线 **1/1** = **25 tests, 0 failures**（约 5s、3 批、harness-only、**无 Chrome MCP** — 后端护栏无浏览器交互路径）。
* **已验证**：`memory_save_tool` 在 wiki 开启时硬拒 document-like knowledge/event（>800 字或 ≥3 markdown 标题 → `wiki_ingest_tool`）；**`persist_extracted_memories` 硬滤** auto-extract semantic/episodic；提取 prompt `wiki_boundary_enabled`；Settings 中英文分工文案。
* **对比竞品**：Hermes 扁平 MEMORY.md **2200 字符上限** — 无编译 Wiki + 无双路径代码 enforcement；OpenClaw MEMORY.md 文件 — 无 vector auto-extract 滤；Mem0 Wiki≠MemCon 概念 — Myrm 增加**写路径 enforcement** + compile + `corpus=all`。
* **诚实边界**：拆条绕过未专门防；无独立 Boundary Card（终极扣问 WORTH:NO）。

## 最新验证快照（2026-07-30）

* **Wiki 外部来源 GUI 同步 + Google Drive（vs OpenClaw / Hermes / deer-flow / LobsterAI / CoPaw / jiuwenclaw / OpenWiki）**：gdrive **3/3** + gmail/rss/status/oauth **12/12** + state/config/defaults/blueprint/hygiene/second\_brain **15/15** + gmail\_html **2/2** = **32 tests, 0 failures**（约 45s、3 批、server lane、**无 Chrome MCP**）。
* **已验证**：Settings **外部来源**面板（Gmail 标签 + **Google Drive 文件夹** + RSS + 集成镜像 → wiki `raw/` · `publish_raw`）；**零 LLM pull**；OAuth 自动开启 Gmail `ReadLater`；缺 Drive read scope 时 **`google_drive_authorized` 重连提示**；持久化同步状态 + **`syncIssue` 错误回显**；Cron 蓝图 **`read_it_later`** router（`__wiki_source_sync__` · 空 tools）。
* **相对竞品的用户收益**：GUI 完整 **摄入→编译→检索** 闭环（收藏邮件 + **Drive 文档** + RSS）——OpenClaw 为 Gmail **Pub/Sub 聊天 hook**（非 wiki vault 管道）；Hermes/OpenClaw **google-workspace CLI** 可读 Drive 但**非**编译 wiki raw 管道 + Settings GUI + cron；deer-flow / LobsterAI / CoPaw / jiuwenclaw 参考仓 **无对等能力**；OpenWiki Gmail 为 **env 配置**且**无 Drive connector**。
* **诚实边界**：Gmail 标签与 Drive 文件夹 ID **手填**——**不做标签下拉 / Drive Picker**（终极扣问 WORTH:NO）；**无 OneDrive**（broken stub 已删）；Integrations API `drive_read_enabled` 对称字段 **WORTH:NO**（OAuth scope 已暴露）。本轮未跑 Chrome MCP E2E；行为由 mock Gmail/Drive API 单测证明。

## 最新验证快照（2026-07-27）

* **Office 文档管线（vs WPS 灵犀 / OpenClaw / Hermes / DeerFlow / LobsterAI / CoPaw / jiuwenclaw）**：file\_parsers **213/213** + document\_reader **26/26** + docx 读链 E2E **16/16** + 交付 Bundle **23/23** = **278 tests, 0 failures**（2026-07-28 分批实测）。**已验证**：LegacyFormatParser OLE2 + soffice 自动转换、docx.py cell\_map 结构元数据、Goal 全链路交付 ZIP 打包。**写保真（in-place）**：Harness `OfficeBashAudit` bash 后 OPC/公式 diff + baseline-missing honest warn + 损坏 Office 包 warn + 可选 LibreOffice recalc 错误扫描 + layout QA（**18 pytest**, 2026-07-28）——OSS 六竞品无同类 harness 级 post-bash audit。灵犀在政府固定模板填表上仍领先（闭源内核）；Myrm 在 Legacy 格式、结构化解析、交付 Bundle、三端独立部署上已实测领先。
* **前端 Agent 状态管理架构（vs CopilotKit AG-UI useAgent/useAgentEvents Hooks）**：multiplexChunkBridge **16/16** + SSE handlers (gap+clarification+completion) **24/24** + messageStreamHandler core **27/27** + Zustand store (snapshot+navigation+subagent+model config) **30/30** + integration & event dispatch **39/39** + UI data model merge **6/6** + state recovery (budget+memory+reasoning) **40/40** + plan lifecycle **13/13** = **195 tests, 0 failures**。修复预存在 bug 1 枚（日语 locale「必須」更新后测试断言未同步）。
* **为何 CopilotKit SDK Hooks 在此过时**：CopilotKit 的 `useAgent()` / `useAgentEvents()` 是面向 SDK 嵌入场景（将 Agent 嵌入第三方 App）的简化封装；Myrm 作为独立 AI 产品，前端团队直接使用 Zustand store + 13 专职 Handler 模块 + `streamConsumer`（含断线重连 / Last-Event-ID 续流 / chunk 缓冲 / capability\_gap 延迟重发 / missed HITL 恢复 / 历史状态水合）——66 种 SSE 事件类型对比 CopilotKit \~10 种抽象事件，粒度 6.6x，精确 re-render 无额外 Hook 开销。
* **用户迁移收益**：基于 CopilotKit AG-UI 构建的 Agent 前端迁移至 Myrm 后，无需编写任何 SDK hook、EventSource 管理、重连逻辑——开箱即用的实时流 + 断线自愈 + UI 状态机。
* **声明式 Agent UI 框架（vs CopilotKit Generative UI useRenderTool/A2UI）**：前端 interactive-ui 组件 **65/65** + Harness render\_ui\_tool + update\_ui\_data\_tool **30/30** = **95 tests, 0 failures**。Myrm 23 种白名单组件注册表（表单10+布局5+展示6+基础3）+ 8 种内置表单验证 + 条件渲染（visible binding）+ UIComponentErrorBoundary 单组件容错 + validate\_ui\_adjacency 结构校验 + update\_ui\_data\_tool 增量深合并——Agent 只需输出 JSON schema，零前端代码即可获得完整交互 UI。
* **为何 CopilotKit Generative UI 在此过时**：CopilotKit 需要前端为每个 tool 手写 render callback，无内建验证/错误边界/增量更新。Myrm 的声明式注册表模式在安全性、一致性、开发效率上全面优于。

## 最新验证快照（2026-07-26）

* **任务导航 & AI 自动路由（vs mattpocock/skills `ask-matt`）**：DiscoverCapability **57/57** + Clarification/ask\_question **15/15** + capability\_gap SSE **37/37** + StreamDispatcher **17/17** + Kanban API **361/361** + Kanban Service **102/102** + Kanban Integration **33/33** + Kanban Channels **89/89** = **711 tests, 0 failures**。
* **验收接缝门（vs mattpocock/skills `/to-spec`）**：Goal Engine（VerificationGatekeeper + ShellCriterion + SemanticCriterion + CompletionGuard + 熔断保护）**209/209** + PlanConfirmMiddleware **13/13** + Kanban Verifier + Criteria Integration **47/47** = **269 tests, 0 failures**。
* **修复预存在 bug**：`kanban_command_handler.py:326` — `by_agent` 字典含 `None` key 导致排序 `TypeError`；已安全处理。
* **为何 CLI 手动导航在此过时**：Matt 的 ask-matt 需要用户从 17 个孤立 CLI 技能中手动选择工作流路径。Myrm 的 6 层自动路由让用户只需描述需求——Agent 自动规划并执行。
* **为何手动 `/to-spec` 在此过时**：Matt 的 to-spec 需要用户手动触发接缝定义。Myrm 拥有 5 层自动验收：GoalMode acceptance\_criteria（用户定义）+ PlanConfirm HITL（计划审核）+ Kanban completion\_criteria（结构化 shell+semantic）+ VerificationGatekeeper（任务完成后自动执行）+ CompletionGuard（反幻觉）。
* **用户迁移收益**：使用 Matt skills 的开发者切换到 Myrm 后不丢失任何能力；他们获得的是 AI 自动任务路由和程序化验证，而非记忆斜杠命令。
* **实时任务监控（vs mattpocock/skills GTE 工作台概念）**：GoalStatusCard+GoalControlPlane+GoalPlanStepsList **27/27** + SubagentDashboard **2/2** + Kanban DnD+Markdown **48/48** + Goal Engine **164/164** + Subagent Engine **179/179** + Kanban API **250/250** + Kanban Integration **100/100** = **770 tests, 0 failures**。Myrm 提供 9 层实时监控（GoalStatusCard fixed overlay + GoalPlanStepsList + GoalControlPlane + SubagentDashboard + ArtifactPortal + BrowserLiveView + DesktopLiveView + KanbanBoardView + MobileStatusBoard）——所有组件均可在 0-1 次点击内访问。Portal 支持三模式布局：overlay（快速预览）、side-by-side（宽屏 ≥1280px 自动并排，用户可手动切换）、fullscreen（沉浸式编辑），用户偏好通过 localStorage 持久化。
* **智能运行时 HITL vs 任务级 AFK/HITL 声明（vs mattpocock/skills `/to-tickets`）**：Kanban task\_runner **25/25** + unattended\_mode **2/2** + approval\_flow+yolo **111/111** + unattended\_mode\_guard **2/2** + approval\_edge\_cases+batch+ptc **38/38** + rate\_limiter+denial+subagent\_safety **22/22** + interception+correction+scheduler **104/104** + security\_config+execution\_policy+permission **169/169** + server approvals **67/67** + personality\_yolo+payload **19/19** + HITL\_resume+kanban\_binding **11/11** + subagent\_approval\_integration **4/4** + batch\_decisions+session **72/72** + workspace\_boundary **12/12** = **658 tests, 0 failures**。Myrm 的设计哲学：Kanban=天然 AFK（yolo+unattended）、Chat=天然 HITL、Cron=天然 AFK、GoalMode=智能切换。运行时 ToolApproval 按操作粒度触发（而非按任务），配合 4 级 Allow-Always 学习。Matt 的任务级 AFK/HITL 标记是 CLI 能力缺失的补丁——它制造了语义冲突（AFK 任务执行危险操作时怎么办？），而 Myrm 的操作级方案优雅解决了这一问题。
* **上下文管理 & 智能 Handoff（vs mattpocock/skills ask-matt Context Hygiene + `/handoff`）**：ContextBudgetGuard **24/24** + ConversationForkManager **24/24** + ContextUsageIndicator **25/25** + Context pipeline **111/111** + Filter+cache\_ttl\_prune+resume **68/68** + Handoff API **24/24** + SummarizeProcessor **49/49** = **325 tests, 0 failures**。Myrm 提供 6 层上下文管理：(1) ContextBudgetGuard 4 层溢出保护 (2) 50+ 文件自动压缩 pipeline (3) compactChat 手动压缩 API (4) ≥75% 时 checkpoint-based fork (5) ContextUsageIndicator 环形+CTA (6) HandoffDialog 跨渠道迁移。Matt 的 `/handoff` 是手动 CLI 命令，产生文本摘要会丢失上下文；Myrm 的 Fork 保留完整 LangGraph checkpoint 状态。修复预存在 bug：summarize\_processor `_NoOpMetric` AttributeError。

## 最新验证快照（2026-07-23）

* **Shell Pattern Allow-Always 全链路**：Harness pattern **20 passed**；Server SHPOIB + allowlist API **11 passed**；前端 derive-pattern parity **13 passed**；**Chrome LIVE\_AGENT E2E 1 passed**（bash HITL → 始终允许此命令模式 → 设置页列表/删除 → 下次自动放行）。
* **相对竞品的用户收益**：四级 Allow-Always（permission / tool / exact / **命令模式**）+ 设置页 CRUD——Claude Code / OpenClaw 多止于工具名或 CLI 签名；复合 shell（`&&`/管道）永不写入 pattern。
* **真实并行负载下的 Dev Gate 稳定性**：执行 `./myrm ready --chrome` 预检后，`./myrm test` 定向套件全绿（**ready/install 回归 54 项 + dev-gate 契约 32 项 + Chrome E2E 三条流程：READ spill / READ expired / LIVE marketplace 聊天**）。共享栈短暂不可达时，attach 预检通过内置重试自动恢复，无需让用户手动停掉其他 pytest。
* **迁移收益（可落地）**：从 CLI-only 测试链路迁移到 Myrm 后，团队可统一使用“ready → test → 真实 Chrome 签收”闭环，并拿到 `clientHot`、runtimeId、lane 队列等显式健康证据，不再依赖经验式排障。

## 最新验证快照（2026-07-24）

* **TTFT 启动路径实证（最小批次、低负载）：** Harness `test_backend_detector.py` **21 passed**，定向模块覆盖 **84%**（`backend_detector`）；Server 端 TTFT 链路测试（`test_stream_loop_ttft.py`、`test_stream_collector_coverage.py`、`test_usage_aggregation_coverage.py`）合计 **18 passed**，`stream_loop` / `stream_collector` / `usage_aggregation` 定向覆盖 **48%-72%**。
* **资源边界（实测非估算）：** 通过 `/usr/bin/time -l` 记录，以上批次峰值 RSS 约 **90MB / 337MB / 144MB / 355MB**，重复执行未出现持续爬升。
* **用户可感知收益：** 在本机真实约束下，首字响应（TTFT）端到端可观测链路保持可验证，同时外部 Agent 探测启动路径稳定、无卡死回退。
* **诚实范围说明：** 为避免高 CPU/高内存负载，本轮（2026-07-24）未追加重型浏览器 E2E；真实 Chrome MCP 证据仍以 2026-07-23 与 2026-07-20 快照为准。

## 最新验证快照（2026-07-20）

* **浏览器自动化基线（分批低负载）**：Harness 定向 109 项通过（`snapshot`、事件分发链路、takeover）。
* **契约一致性校验**：Server SSE 事件一致性 1 项通过；前端事件 schema 6 项通过。
* **快速交互稳定性（定向回归）**：前端 `deep-link-listener` + `flow-pad-inline-mode` + `intent page` 套件 **36/36** 通过；服务端 gate/finish/integration 套件 **43/43** 通过。
* **覆盖率证据（定向文件）**：前端（`deep-link-listener.tsx`、`flow-pad-modal.tsx`）定向覆盖 **78.28%**；服务端 `desktop_control/gate.py` **89%**、`background_job_finish_handler.py` **94%**。
* **真实浏览器证据（非纸面）**：在真实 Chrome MCP 上对 WebUI 页面执行 `take_snapshot` + `evaluate_script`；已实测 `/intent/ask?text=...` 自动回首页并拉起预填文本 FlowPad。
* **Chrome UI E2E**：`test_background_tasks_panel_chrome_e2e.py` 3 项通过。
* **委派控制面 Chrome LIVE E2E**：`test_subagent_dashboard_chrome_e2e.py` 3/3（340s）；Session 级委派暂停 + Dashboard cancel/token/model 在真实 Chrome 签收。
* **验证过程中修复的预存缺陷**：`mode=running` seed fixture 因 `UnboundLocalError` 导致 500，已修复 API fixture 路由并补齐集成回归测试。
* **资源安全边界**：本轮验证期间系统可用内存保持在 **36%-40%**，未出现高压（已用 >80%）状态。
* **已知环境前提（诚实说明）**：captcha coordinator 测试仍依赖本机 `patchright`，但不影响本次浏览器语义快照/遥测基线结论。

## 一览

| 能力                       |                                                                                                                                                                                                                                                                                                                                                                                               Myrm                                                                                                                                                                                                                                                                                                                                                                                               |                                                                   Hermes Agent (v0.15)                                                                   |                OpenClaw               | 360 Security OpenClaw |        OpenClacky        | MiniMax Mavis |    MemPalace   |
| ------------------------ | :----------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------: | :------------------------------------------------------------------------------------------------------------------------------------------------------: | :-----------------------------------: | :-------------------: | :----------------------: | :-----------: | :------------: |
| **记忆系统**                 |                                                                                                                                                                                                                                              ✅ 8 类 + 知识图谱 + 27 源集成（9 类别）+ 14 种竞品导入 + 跨任务 SharedContext + 归档自动恢复 + 15 种诊断 + 9 层自动提取（ZeroCost + 反馈信号 + Deep PII）+ 冲突自动检测与 GUI 裁决（4 种裁决 + 72h 安全降级）+ 三引擎行为推导（CognitiveDeriver + PreferenceStability + FrustrationDetector→技能进化）+ BM25/Vector/RRF 三通道检索（7-Signal + MMR）+ Protocol-first SDK（3,100+ 项测试）                                                                                                                                                                                                                                              |                                                                        ⚠️ 2,200 字符                                                                       |                 ⚠️ 3 类                |         ⚠️ 3 类        |           ❌ 仅会话          |    ⚠️ 基础更新    |     ⚠️ 扁平抽屉    |
| **对话搜索**                 |                                                                                                                                                                                                                                                                                                                                                                                        ✅ FTS5 + Qdrant 混合                                                                                                                                                                                                                                                                                                                                                                                        |                                                                      ⚠️ v0.15 仅本地文本                                                                      |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **代码搜索**                 |                                                                                                                                                                                                                                                                                                                                                                  ✅ ripgrep grep/glob + `@codebase` 概览 + 路径分组密集化（省 18-39% Token）                                                                                                                                                                                                                                                                                                                                                                  |                                                                         ❌ 仅 grep                                                                         |          ⚠️ tree-sitter 精确匹配          |           ❌           |         ❌ 仅 grep         |       ❌       |        ❌       |
| **GUI 界面**               |                                                                                                                                                                                                                                                                                                                                                                                             ✅ Web 原生                                                                                                                                                                                                                                                                                                                                                                                             |                                                                   ❌ CLI（v0.15 TUI 多会话）                                                                   |                  CLI                  |       ✅ Web/App       |        ⚠️ 基础 WebUI       |    ⚠️ 飞书嵌入    |     ❌ 仅 CLI    |
| **桌面应用**                 |                                                                                                                                                                                                                                                                                                   ✅ Tauri + 开机自启 + 零闪烁 + **跨设备遥控中心**（E2EE加密穿透 + CF Tunnel一键公网 + Mobile Hub手机控制面: SSE实时流/HITL审批/Steer/Stop/Live Preview/语音 + QR扫码即连 + 17 Channel任何IM远程操控 + Node Events自动化触发）— **401 项跨设备遥控全栈测试**                                                                                                                                                                                                                                                                                                  |                                                                         Electron                                                                         |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **部署**                   |                                                                                                                                                                                                                                                                                                            ✅ Web/Tauri/SaaS · **本地一条命令启动完整服务**（桌面/Web 数据一致）· **后端未启时有清晰界面指引**（不会弹出难懂报错，离线可浏览已保存设置）· **Cloud/Sandbox Loopback Guard** 会在流程开始前拦截仅 localhost 可用的 MCP 连接并引导切换 Local/Tauri                                                                                                                                                                                                                                                                                                            |                                                                            自托管                                                                           |                  自托管                  |        ❌ 仅 SaaS       |        本地 + WebUI        |   ❌ 闭源 SaaS   |       仅本地      |
| **Harness 升级契约**         |                                                                                                                                                                                                                                                                                                                                           ✅ `myrm_agent_harness.api` + CI 禁止私有 `_` import；按沙箱滚动 runtime 镜像 tag；`api.hooks`/`api.skills` 保 Server 胶水层稳定                                                                                                                                                                                                                                                                                                                                           |                                                                       ❌ 单体深 import                                                                       |              ❌ 单体深 import             |           ❌           |             ❌            |       ❌       |        ❌       |
| **工作区隔离 (Worktree)**     |                                                                                                                                                                                                                                                                                                                                                                       ✅ 一键 GUI 沙箱模式 + Kanban 任务自动分配隔离 Worktree，含完整合并/丢弃审批流                                                                                                                                                                                                                                                                                                                                                                       |                                                                   ⚠️ 仅支持后台自动创建，缺乏生命周期管理                                                                  |                  ❌ 无                  |          ❌ 无          |            ❌ 无           |      ❌ 无      |       ❌ 无      |
| **多端会话接力 (Handoff)**     |                                                                                                                                                                                                                                                                                                                                                                       ✅ Web ↔ IM (Telegram/WeChat) 无缝转移，瞬间克隆结构化状态，连终端进程都能接力                                                                                                                                                                                                                                                                                                                                                                      |                                                                       ⚠️ 仅桌面端本地模型切换                                                                      |                  ❌ 无                  |          ❌ 无          |            ❌ 无           |      ❌ 无      |       ❌ 无      |
| **多账号凭证池**               |                                                                                                                                                                                                                                                                                                                                                           ✅ 4 种轮换策略 + 错误感知冷却与熔断器 + ManagedLLM/KeyPool 智能体内故障转移（33 项 openai\_compat 测试）                                                                                                                                                                                                                                                                                                                                                           |                                                                          ⚠️ 单一账号                                                                         |                ⚠️ 单一账号                |        ⚠️ 厂商账号        |          ⚠️ 单一账号         |    ⚠️ 厂商账号    |     ⚠️ 单一账号    |
| **纯本地直连**                |                                                                                                                                                                                                                                                                                                                                                                       ✅ Tauri 轻量级直连官方 API，满足企业绝对隐私合规，内存占用仅为 Electron 的 1/10                                                                                                                                                                                                                                                                                                                                                                      |                                                                   ⚠️ 依赖 Electron 内存占用极大                                                                  |                ⚠️ 云端中转                |         ❌ 仅云端         |      ⚠️ 依赖 Electron      |     ❌ 仅云端     | ⚠️ 依赖 Electron |
| **零配置迁移 (OOBE)**         |                                                                                                                                                                                                                                                                                                     ✅ 首次启动自动扫描 Claude Code, Cursor, Codex 等 11 种凭证，一键导入 + **自动迁移默认模型配置**（迁移后首次对话即用，无需手动选模型）+ **OpenClaw vault 绑定闭环**（导入后 GUI 绑 Project → 首条消息写 chat SSOT — **5 pytest 2026-07-28**）（216项测试验证）                                                                                                                                                                                                                                                                                                    |                                                                   ⚠️ 仅支持少数 CLI 工具的粗糙调用                                                                   |                  ❌ 无                  |          ❌ 无          |            ❌ 无           |      ❌ 无      |       ❌ 无      |
| **零配置首跑 (Express Lane)** |                                                                                                                                                                                                                                                                                                                                                                ✅ 平台预置托管模型，Cloud 新用户无需 API Key 即可对话；WU 额度计费 + tier 降级 + 额度耗尽引导 BYOK                                                                                                                                                                                                                                                                                                                                                               |                                                                         ❌ 必须 BYOK                                                                        |               ❌ 必须 BYOK               |       ⚠️ 闭源厂商提供       |         ❌ 必须 BYOK        |    ❌ 仅闭源厂商    |    ❌ 必须 BYOK   |
| **SaaS 登录**              |                                                                                                                                                                                                                                                                                                                                                                           ✅ Google OAuth + 一次性交换（JWT 不进 URL）；企业 OIDC 就绪                                                                                                                                                                                                                                                                                                                                                                          |                                                                             ❌                                                                            |           ❌（OAuth 仅 LLM Key）          |        ⚠️ 厂商账号        |             ❌            |   ❌ 闭源 SaaS   |        ❌       |
| **模型支持**                 |                                                                                                                                                                                                                                                                         ✅ 100+ 供应商经 LiteLLM + 小模型自动调优 + API 方言自动转换（DeepSeek/Kimi/MiMo 零配置）+ 原生思考模型支持（6 级强度 + 思考面板 + 20+ 推理模型检测 + 逐模型超时底线自动适配，思考期间永不超时）+ **base\_url 全路径统一管理**（Agent/视觉/视频/检索/Structured Output 7 条 LLM 创建路径统一尊重自定义端点，企业内网代理与离线部署开箱即用，147 项验证测试）— 310 项测试                                                                                                                                                                                                                                                                         |                                                                   200+ 经 OpenRouter 网关                                                                   |                   固定                  |        ⚠️ 固定三档        |         BYOK 多模型         |  ❌ 仅 MiniMax  |       N/A      |
| **渠道**                   |                                                                                                                          ✅ 26 渠道 + 三级 Agent 绑定（Thread/Chat/Channel）+ 六维身份隔离 + **Topic→Project/Vault 工作区绑定**（GUI Project 下拉 + IM `/bind workspace=`；执行前 sync 到 chat SSOT；解绑双向清空；fail-loud — OpenClaw 仅 Agent 级 workspaceDir；**9 pytest 2026-07-28**）+ **Obsidian vault 原位写入保真**（file\_edit 自动补回 YAML frontmatter + FormatObserver 豁免 vault `.md` — **44 pytest 2026-07-28**；OpenClaw/Hermes：仅 prompt 或 wiki 编译层）+ IM Goal 管理 + **微信语音闭环** + **IM /undo /retry 联动文件快照 Revert（独家）**（iLink 语音 STT + channel\_notify\_tool 文件回推 + DLQ 去重 + 656 项专项测试全通过 2026-07-14）（5,756 测试）                                                                                                                         |                                                                     \~23（无 Topic 级绑定）                                                                    |                  \~7                  |        ⚠️ 飞书/钉钉       |         ⚠️ IM 机器人        |     ❌ 仅飞书     |        ❌       |
| **公网 Ingress 引导**        |                                                                                                                                                                                                                                                                                                                                            ✅ SSOT API + 入站/出站徽章 + 一键 Cloudflare 隧道 + 自选穿透文档（cpolar/NATAPP/frp）+ E2EE 端到端加密 + 6 级 TrustZone + DNS 重绑定防护                                                                                                                                                                                                                                                                                                                                           |                                                                           ❌ 纯文档                                                                          |           SSH+Tailscale(CLI)          |   ⚠️ 文档教 cloudflared  |             ❌            |       ❌       |        ❌       |
| **手机远程指挥台**              |                                                                                                                                                                         ✅ 完整 PWA（离线缓存+安装引导）· E2EE NaCl Box 加密配对令牌 Hub · 实时 Status Board（SSE 进度 · 视觉审批 · 语音 push-to-talk · 中途 steer · 紧急停止 · **Browser/Desktop Live Preview** — Agent 操作画面实时截图预览，Lightbox 全屏放大，浏览器/桌面 Tab 切换，可折叠卡片，零新 API）· 会话级 **chat cancel**（配对安全）· 100dvh + pb-safe 视口 · **Web Push VAPID 离线推送**（8 类事件、iOS PWA 安装引导、过期订阅自动清理）· **144 项移动端测试**（2026-07-11：MobileStatusBoard 8 + MobileActionSheet 28 + PWA Install 4 + Web Push 53 + Remote Access 51）                                                                                                                                                                         |                                                                        ❌ 仅 CLI/TUI                                                                       |         ⚠️ macOS 远程模式(SSH+CLI)        |           ❌           |             ❌            |       ❌       |        ❌       |
| **子 Agent**              |                                                                                                                                                                                                                                                                                                                                         ✅ 8 模式 + 动态工作流 + **单 Agent 门控** + **AI Build**（一句话意图自动生成完整 Agent 配置）+ Template Market + Org Marketplace（606+ 项测试）                                                                                                                                                                                                                                                                                                                                        |                                                                ⚠️ v0.15 Kanban Swarm（1 模式）                                                               |            ⚠️ 基础 spawn（仅线性）           |      ⚠️ 基础 spawn      |         ❌ 单 Agent        |    ⚠️ L-W-V   |        ❌       |
| **工具生态集成**               |                                                                                                                                                                                                                                                                                                     ✅ 自有 Agent 引擎 + MCP 行业标准（OAuth+安全扫描+Schema容错+动态发现+连接池自愈）+ **Settings 页 MCP GUI 全链路（options/scan/verify/registry）** + **Agent/Team 模板市场一键实例化** + 5层安全审批 + 技能自动进化 + 8种SubAgent编排（8,687 项测试）                                                                                                                                                                                                                                                                                                    |                                                              ⚠️ 单文件 Copilot 适配器（686 行，仅 CLI）                                                             |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **安全**                   |                                                                                                                                                                                                                                                                                               ✅ 6 层防御 + **四级 Allow-Always**（permission/tool/exact/**命令模式**，设置页 CRUD，复合 shell 防护，Chrome LIVE E2E）+ DM Pairing（4 策略、GUI 审批、防刷冷却）+ **GUI 安全健康仪表板**（6 维度实时评分 + 逐项 finding 详情 + 一键修复/配置跳转引导——7 大竞品均无此能力）                                                                                                                                                                                                                                                                                              |                                                                 ⚠️ v0.15 Promptware 3 卡口                                                                 |                  1 层                  |         ⚠️ 未知         |          ⚠️ 基础沙箱         |     ⚠️ 闭源     |        ❌       |
| **凭证库**                  |                                                                                                                                                                                                                                                                                                                                                                                      ✅ 标签注入 + TOTP（浏览器 + 桌面）                                                                                                                                                                                                                                                                                                                                                                                     |                                                                         ❌ 工具参数明文                                                                         |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **WebUI 访问安全**           |                                                                                                                                                                                                                                                                                                                                                                                    ✅ 零信任 WebSocket + 安全 Cookie                                                                                                                                                                                                                                                                                                                                                                                   |                                                                      ⚠️ 仅 HTTP，WS 脆弱                                                                     |               ⚠️ 基础 JWT               |         ⚠️ 未知         |         ⚠️ 仅 HTTP        |   ⚠️ 闭源 SaaS  |    ❌ LAN 裸奔    |
| **目标模式**                 |                                                                                                                                                                                                                                                                                                                                                              ✅ 8 状态 + 4D 预算 + 14层防死循环盾 + **逐步人工确认**（opt-in 每步自动暂停等待用户确认——6大竞品均无此能力）                                                                                                                                                                                                                                                                                                                                                              |                                                                           /goal                                                                          |                   ❌                   |           ❌           |             ❌            |    ⚠️ 计划审批    |        ❌       |
| **上下文管理**                |                                                                                                                                                                                                                ✅ 6 层 Prompt Cache + 22+ 中间件 + 11 步压缩流水线 + **compression\_intent 结构化 retain**（业务层自动提取 focus 文件/失败命令/目标提示 → Filter 与 Compress group 级对齐，结构裁剪替代 LLM 摘要，保留最近 5 组工具调用——竞品无此链路）+ 七层防鞭尸 + 数据库级会话压缩持久化 + 确定性回退 + **三层 tool\_call 配对完整性防护** + **Human Anchor** + **7 层超大输出纵深防护** + **上下文健康环** + **压缩参数零配置热更新**（**1092+** 上下文管线 unit 测试 + 2 API E2E 长会话验证 + 209 Goal 守卫链测试）                                                                                                                                                                                                                | ⚠️ system\_and\_3（4 断点）+ 8 层固定栈 + 单层 ContextCompressor（内存态，无 DB 持久化）+ 运行时 `_is_real_user_message` 检查（新增合成消息类型时有绕过风险）+ 强防误导 Prompt（但无 XML 边界和 U-curve 布局） |                  LCM                  |          LCM          |       ⚠️ 空闲压缩 + 双缓存      |  ⚠️ Worker 隔离 |     ⚠️ 4 层栈    |
| **智能并发路由**               |                                                                                                                                                                                                                                                                                                                                     ✅ 五层守卫（会话互斥+用户级+全局信号量+内存压力熔断+分层超时）+ O(1) 路径锁 + **Busy Ack**（IM：即时 i18n 排队/满队回复，30s 防抖；Web：toast 携带队列位置）— 103项并发+busy测试通过                                                                                                                                                                                                                                                                                                                                     |                                                             ⚠️ 粗粒度写锁 + runtime-id 映射（双ID易出错）                                                             |                 ❌ 不安全                 |         ⚠️ 未知         |             ❌            |     ⚠️ 未知     |        ❌       |
| **无头无人值守**               |                                                                                                                                                                                                                                                                                                                                                                                           ✅ 标签工具隔离（零死锁）                                                                                                                                                                                                                                                                                                                                                                                          |                                                                         ⚠️ 易交互死锁                                                                         |                 ❌ 不支持                 |           ❌           |             ❌            |       ❌       |        ❌       |
| **极端防爆**                 |                                                                                                                                                                                                                                                                                                                                                                                       ✅ 4 层护城河（卫生/护盾/剥离/预算）                                                                                                                                                                                                                                                                                                                                                                                      |                                                                        ⚠️ 大负载崩溃/丢失                                                                       |                ⚠️ 单点失败                |         ⚠️ 未知         |          ⚠️ 基础限制         |     ⚠️ 未知     |        ❌       |
| **输出净化**                 |                                                                                                                                                                                                                                                                                                                                                                              ✅ 双层防护（流式+投递前），覆盖全角管道符和 DeepSeek token                                                                                                                                                                                                                                                                                                                                                                              |                                                                  ⚠️ 单层，仅 ASCII 管道符（近期修复）                                                                 |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **MCP 工具参数智能修复**         |                                                                                                                                                                                                                                                                                                                                                     ✅ required+nullable 缺失自动补 null + mixed-union 对象/数组解析（含类型守卫）+ schema 规范化保障 Prompt Cache 稳定                                                                                                                                                                                                                                                                                                                                                    |                                                                   ⚠️ 部分/旧式 coercion 路径                                                                   |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **智能路由与模型自动升级**          |                                                                                                                                            ✅ 六层体系: ComplexityRouter 三档路由（40+ 中英关键词 + 20 种异常正则 + 多维信号评分）+ LLM 裁判(256条TTL缓存) + 会话动量(长度加权衰减) + 隐私感知路由 + PenaltyTracker误路由反馈学习(24h衰减) + ESCALATION\_CONTRACT (模型自主升级合约) + EscalationScrubber + 11模块降级链 + 10模块Token经济学(成本溯源+工具归因+延迟统计+多维预算) + 17+维度路由透明度（tier badge+成本+缓存+隐私+工具归因+路由分析面板）+ 6级推理强度GUI控件(off/low/medium/high/xhigh/max+自定义值+per-model持久化+reasoning模型自动检测) + **25+ 内置提供商**（OpenRouter、Moonshot/Kimi 双端点、DeepSeek、Xiaomi MiMo 等 — 粘贴 API Key 即用）+ **session/daily/per-call 三维预算守卫** — 3,926 项测试                                                                                                                                           |                                                                   ⚠️ 仅 Sonnet→Opus 单维度                                                                   |                   ❌                   |        ⚠️ 手动三档        |             ❌            |     ⚠️ 未知     |        ❌       |
| **后台任务托盘**               |                                                                                                                                                                     ✅ GUI-first 闭环 v1（2026-07）：统一 `bash_process_tool`（list/output/kill）Turn1 eager（Prefix Cache 稳定，不 mutate bind\_tools）→ 自然结束写入 i18n 聊天 + **单次** SSE toast + 自动刷新；Navbar **Activity Panel** — 分区 **耗时任务 / Long-running tasks**（failed/running 列表 + 一键 Cancel `data-testid`）+ Tauri 托盘 running 数；kill/cancel/流取消静默 — **9 条集成 + 120+ 项自动化测试全绿** + **Chrome MCP E2E R23 Dev Gate**（2026-07-21：Panel READ **9/9** 连跑 3 轮 + LIVE spawn **3/3** 连跑 3 轮，mux 分 lane）                                                                                                                                                                    |                                                                         ⚠️ 仅运行+取消                                                                        |                   ❌                   |           ❌           | ⚠️ Background Agent（无转向） |     ⚠️ 未知     |        ❌       |
| **错误恢复**                 |                                                                                                                                                                                                                                                                            ✅ 8层纵深防护(LoopGuard 7种模式+ToolStuck→GraphInterrupt+FrequencyGuard+E-Stop+4层熔断器+僵尸自动回收+Gateway超时+内存压力熔断) + **工具调用四层自主修正**(7+种JSON修复策略适配弱/本地模型+错误→ToolMessage自动回传LLM自修正+LoopGuard防死循环+CorrectionLearning审批修正持久化记忆) + 14类自愈 + 9层纵深降级 — 3,276项测试                                                                                                                                                                                                                                                                            |                                                                         try/catch                                                                        |                   基础                  |           基础          |        ⚠️ 上下文溢出恢复        |     ⚠️ 未知     |        ❌       |
| **企业可靠性**                | ✅ xdist 锁、EventBus 截断、OTEL 安全、路径边界 + TOCTOU 审批测试；聊天 SSE 状态机回归；**521 份分形 `_ARCH` 模块文档 + 296 项架构 CI 门禁**；**Eval 引擎：4 类 12+ 种断言体系（Tool+State+Sandbox+Semantic LLM 裁判，支持自定义 judge\_prompt/model/threshold）+ 多轮评测（MultiTurnEvalCase）+ 一键 chat→eval 捕获（GUI Flywheel 闭环）+ AdaptiveEvalManager 智能算力让步 + GUI 集成 + 多数据集 CRUD + A/B 历史报告 + SSE 流式进度 + 6 项 IR 指标（Recall/Precision/NDCG/MRR/HitRate/Latency）+ ModelTier 自动调优 + 评测工作空间物理防污染隔离 + 记忆检索质量评测子系统 + EvalManifest 10 维环境快照（模型/工具/提示词指纹/数据集哈希/推理深度——自动嵌入每份报告确保 A/B 对比公平，竞品无此能力）+ **Benchmark Headless Profile**（一键 GUI 开关：空 System Prompt + 仅 CORE 工具 + 禁用 MCP/技能/子 Agent/记忆/搜索/Replan/上下文压缩 — Terminal-Bench/SWE-bench 标准化公平评测；Eval Lab 仪表盘内 A/B 对比）— 142 项 eval 测试验证，唯一具备完整评测 GUI+AI 裁判+并发执行+一键捕获闭环+环境可复现快照+标准化 Benchmark 模式的 Agent 框架**（2026-07-25） |                                                                        ⚠️ 仅快乐路径测试                                                                        | ⚠️ 易竞态（ClawEval: CLI 59 角色基准测试，无 GUI） |         ⚠️ 未知         |           ⚠️ 未知          |     ⚠️ 未知     |        ❌       |
| **模块文档地图**               |                                                                                                                                                                                                                                                                                                                                                                       ✅ **521** 份 `_ARCH.md` + CI 防漂移（`check_fractal_docs`）                                                                                                                                                                                                                                                                                                                                                                      |                                                                        ❌ 仅集中式 docs                                                                       |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **文件编辑安全**               |                                                                                                                                                                                                                                                       ✅ **8 层多代理文件保护**（先读后写 + 版本匹配 + 完整读取前置 + 行级冲突检测 + 跨代理活动追踪 + 自动工作空间隔离 ISOLATED\_COPY + 延迟串行合并 + 完成自动清理 — **192 项多代理测试**）+ 三层写后防呆（内存语法校验+CLI深度诊断+12种自动格式化）+ 语法错误自动回滚 + Shadow Git 快照**选择性文件恢复**（checkbox 多选）+ 行级变更统计 (+X/−Y) + 回退后 Agent 自动感知 + 配置保护 + 敏感文件保护 + 实时 diff SSE（1,380+ 项测试）                                                                                                                                                                                                                                                       |                                                             ⚠️ py\_compile 级写后检查（无自动格式化、无回滚）                                                             |                   ❌                   |           ❌           | ❌ 仅 Prompt 文件互斥（LLM 可绕过） |     ⚠️ 未知     |        ❌       |
| **文件系统智能**               |                                                                                                                                                                                                                                                                  ✅ 19 种原生操作 + 11模块解析引擎（PDF 3策略 + Office全格式 + Jupyter Notebook含kernel语言检测+语法高亮+全栈拖拽入库 + 未知格式附件感知兜底）+ 5 层观察者 + **智能文件检索**（glob通配递归 + grep三级引擎 ripgrep>mmap>Python + ReDoS防护 + token节约格式化 + 前端typeahead路径补全）——**163项file\_search+suggest测试 + 788项文件系统测试 = 951项全通过**                                                                                                                                                                                                                                                                 |                                                          ⚠️ 4 种基础操作 + 基础 ipynb/docx/xlsx（同步、无降级）                                                         |               ⚠️ 仅 bash               |       ⚠️ 仅 bash       |             ❌            |     ⚠️ 基础     |        ❌       |
| **代码执行引擎**               |                                                                                                                                                                                                                                                                                                      ✅ 零进程开销 pathlib I/O + 语法错误自动回滚 + 持久化 Shell 会话 + 环境自动探测 + seatbelt/bwrap 沙箱 + PTC 双向通道 + 输出压缩 + 虚拟环境管理 + 工具自动发现 + **BashExecutor/BashTool 模块化拆分（13 文件，97.1% 覆盖，架构门禁）** — **1,520+ 项测试**                                                                                                                                                                                                                                                                                                      |                                                                      ⚠️ 仅 Shell 子进程                                                                      |               ⚠️ 仅 bash               |       ⚠️ 仅 bash       |             ❌            |     ⚠️ 基础     |        ❌       |
| **工作区上下文**               |                                                                                                                                                                                                                                                                                                                                                      ✅ 7 种 @ 引用（文件/文件夹/staged/diff/URL/上传/行范围）+ 工具层全文件系统访问 + Dynamic Workflow 多项目并行（259 项测试）                                                                                                                                                                                                                                                                                                                                                     |                                                                     ⚠️ 仅 @file（沙箱限制）                                                                     |                 ❌ 单目录                 |           ❌           |             ❌            |     ⚠️ 未知     |        ❌       |
| **本地文件"数据不出域"**          |                                                                                                                                                                                                                                                                                                                                                                                   ✅ 天然支持 — Agent 在本地运行，所有文件原地处理                                                                                                                                                                                                                                                                                                                                                                                  |                                                                           ❌ 仅云端                                                                          |               ⚠️ Docker               |       ⚠️ Docker       |           ❌ 云端           |       ❌       |        ❌       |
| **定时任务**                 |                                                                                                                                                                                                  ✅ 20+ GUI 组件 + 27 项配置能力 + 7 种触发器（cron/event/system/webhook/poll/stream/manual — HMAC-SHA256 + SSRF + ReDoS 三重安全）+ 3 种会话模式(Isolated/Main/Daily — Daily 自动注入同日执行历史用于趋势检测) + 指数退避重试 + 误火恢复 + Agent 绑定 + 结果投递 + Merkle 审计链 + 智能噪音过滤 + **按任务执行策略（能力围栏 + 工具范围 + fail-closed 默认）** + **5 层并发控制**（全局信号量 + 用户信号量 + skip\_if\_active + active\_hours + stagger）+ **无内容跳过**（无事可报时零 token 消耗）（**985+ 项测试**）                                                                                                                                                                                                 |                                                               ⚠️ CLI 基础 cron（无GUI/无重试/无恢复）                                                               |                   ✅                   |           ✅           |             ❌            |       ❌       |        ❌       |
| **统一工具网关 + 行为审计**        |                                                                                                                                                                                                                                                                                                                                                 ✅ 四合一网关 + 弹性 BYOK 回退 + Bash 独立审计面板(12 字段) + 全工具 ExecutionTrace 时间线 + 会话回放 + OTel 全链路(**669 项测试**)                                                                                                                                                                                                                                                                                                                                                |                                                                        ⚠️ 硬切换（易出错）                                                                       |                 ❌ N/A                 |         ⚠️ 未知         |             ❌            |     ⚠️ 未知     |        ❌       |
| **OpenAI 兼容代理**          |                                                                                                                                                                                                                                                                                                                              ✅ **Agent API** — OpenAI 兼容 `/v1` 运行 Myrm 智能体（记忆/工具/技能）；严格 API Key 认证；`/v1/models` 列出智能体。**Cursor/Codex LLM 代理**：搭配独立的外部 LLM 网关（33 项测试）                                                                                                                                                                                                                                                                                                                             |                                                     ⚠️ `/v1/chat/completions`（仅 Agent，无 LLM 直通，无模型发现）                                                    |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **语音**                   |                                                                                                                                                                                                                                                                                                                                  ✅ 3 种模式（标准/Bridge/Realtime）+ 10 提供商（5 TTS + 5 STT 含免费 Edge TTS 与 Local Whisper）+ Discord 唤醒词 + 打断检测 + Vision 融合 — **1,176 项测试**                                                                                                                                                                                                                                                                                                                                 |                                                                       ⚠️ Discord 语音                                                                      |           WebRTC + iOS 原生唤醒           |         ⚠️ 基础         |             ❌            |       ❌       |        ❌       |
| **多模态生成**                |                                                       ✅ 图片（20+ 模型 + 智能 Failover + Gateway 回退 + 图片编辑含 Inpainting 局部重绘 + 4 层校验含 SSRF 防护 + 批量生成 + **异步生图：即时 task\_id + 聊天气泡 ImageTaskCard + SSE 进度，生图时继续对话；API Key 与 Gateway Token 写入任务队列前 AES 加密，云沙箱 tasks.db 无明文密钥**，370+ 项测试）+ 视频（5 引擎：Sora/Veo/Qwen/MiniMax/xAI Grok + T2V/I2V/V2V + 幂等任务管理 + **对话内 VideoTaskCard 内嵌播放器+重试 — 即时预览，无需导出门控**）+ TTS（5 Provider 含免费 Edge + 流式 + 长文本自动摘要 + OpenAI 兼容 base\_url）+ 截图即操作管线（粘贴/拖放 → 标注编辑器 → OCR/Vision → 工具调用闭环）+ Vision 自动降级 + **创意设计全覆盖**：沙箱内 ffmpeg 视频剪辑 / Pillow+ImageMagick 批量图片处理 + computer\_use 智能操控 Adobe PS/AI/InDesign（AppleScript/COM 自动路由）+ Figma MCP 接入——AI 原生引擎比专用 PS 插件更可靠（Adobe 版本更新常破坏 API）— **401 项多媒体全栈测试全通过** — 总计 1,293+ 项测试                                                      |                                   ⚠️ FAL.ai 图片（7 编辑模型，同步阻塞，无 mask/无 SSRF/无 failover）+ 2 视频插件 + 10 TTS（含 5 个 niche 本地方案）                                  |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **Computer Use**         |                                                                                               ✅ 桌面自动化 + 三平台后台静默输入（不抢焦点）+ 前台权限主动授权门控（三级粒度 once/session/always）+ BBox 审批 + Tauri OS 叠加层 + 敏感应用防火墙（银行/通信自动阻断）+ 原生 API 智能路由（95+ 应用：AppleScript/COM/D-Bus 自动检测，零配方零依赖）+ 三平台完整语义 AX invoke（macOS AX/Windows UIA/Linux AT-SPI）+ **增量 AX 树 Diff**（follow-up 快照仅渲染增删改元素，连续操作节省 80%+ Token，4 层自动 fallback 全量兜底）+ 跨平台环境诊断卡片（macOS TCC + Linux 依赖+xvfb + Windows 依赖 — GUI 一键修复）+ VNC 安全 Token 签名（HMAC+TTL 防重放）+ Takeover/Resume 全生命周期人工接管 — **454 项 VNC+ArtifactPortal 专项测试全通过** + 办公文件三层覆盖（ExcelParser 4模式直读 + python-pptx/docx 原生生成 + 17渠道 Bot API 直发文件附件，「读Excel→生成PPT→发企微群」零 GUI 操控）— **519 项办公+通讯全栈测试全通过**                                                                                              |                                                                             ❌                                                                            |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **浏览器引擎**                |                                                                                                                                                                                                                                     ✅ 双隐身引擎（Patchright + Camoufox）+ 跨会话指纹持久化 + 三级拟人化交互（高斯延迟 + 贝塞尔鼠标轨迹）+ 三层 GlobalBrowserPool（零冷启动、三层崩溃恢复）+ Shadow DOM 穿透 + API-First 网络智能（CDP 懒加载响应体 + 请求重放）+ 域名引擎亲和记忆 + 后台无感执行（双层隔离）+ 同源智能Tab路由 + 4 大云浏览器 Provider（GUI 配置 + 热更新免重启）+ 语义 inspect→snapshot 链路 + 浏览器事件遥测基线，已由 **127 项定向测试** 与真实 Chrome MCP snapshot/evaluate 验证                                                                                                                                                                                                                                    |                                                                  ⚠️ 第三方云浏览器（环境变量配置，需重启）                                                                  |                   ❌                   |           ❌           |             ❌            |     ⚠️ 未知     |        ❌       |
| **网页搜索**                 |                                                                                                                                                                                                                                                                                                                                                       ✅ 8 引擎 + 中文全网搜索（百度/搜狗/360/夸克自托管零成本）+ 7类意图零LLM路由 + BM25/Reranker 过滤 + 三层防幻觉 + 191项搜索测试                                                                                                                                                                                                                                                                                                                                                      |                                                                        ⚠️ 云 API 透传                                                                       |             ⚠️ DDG/Bing 抓取            |     ⚠️ 同 OpenClaw     |        ⚠️ DDG/Bing       |       ❌       |        ❌       |
| **网页抓取**                 |                                                                                                                                                                                                                                                                                                                                                              ✅ 三层自动降级 + 自学习 AdaptiveRouter + 反爬自动绕过（主流 WAF）+ 向量提取 + DOM 修剪（391 项测试）                                                                                                                                                                                                                                                                                                                                                              |                                                             ⚠️ web\_extract（Firecrawl + LLM）                                                             |         ⚠️ HTTP / Firecrawl 回退        |         ⚠️ 同上         |         ⚠️ 仅 HTTP        |       ❌       |        ❌       |
| **工作区 RAG**              |                                                                                                                                                      ✅ **四层管线**：BM25 + 向量 + RRF融合 + Reranker；7类19种格式解析（PDF/Word/Excel/PPT/ipynb/OCR）；双后端知识图谱；Karpathy Wiki 编译引擎；**frontmatter `type` 枚举硬闸门**（编译 + 待审批准 + Linter 修复 + Settings Repair Page Types — 7 类 OKF 兼容，47 pytest Jul 2026）；**认知地图三件套**（`wiki/index.md` + `log.md` + `hot.md` 事件驱动刷新；hot 仅 wiki\_query 消费 — cache-safe，25 pytest Jul 2026）；Skill Evolution 自学习；RSG质量守卫（2,886项测试——Wiki 159 + Evolution 437 + Skills 565 + Memory 1,901 + 索引/RAG 159 + Marketplace 52 + Optimization 23）                                                                                                                                                      |                                                                        ⚠️ 仅代码AST索引                                                                       |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **图片搜索**                 |                                                                                                                                                                                                                                                                                                                                                                            ❌（web\_search + web\_fetch / browser 可找页面图）                                                                                                                                                                                                                                                                                                                                                                           |                                                                             ❌                                                                            |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **长文目录**                 |                                                                                                                                                                                                                                                                                                                                                                                        ✅ 聊天内自动 TOC + 滚动同步                                                                                                                                                                                                                                                                                                                                                                                        |                                                                             ❌                                                                            |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **富内容渲染**                |                                                                                                                                                                                                                                                                                                                                                          ✅ Mermaid（缩放/全屏/图例/导出）+ KaTeX 数学公式 + GFM Alerts（5 种类型带图标）+ 脚注 + 代码 Diff + 平滑流式                                                                                                                                                                                                                                                                                                                                                          |                                                                       ⚠️ 基础 Mermaid                                                                      |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **精准多模态**                |                                                                                                                                                                                                                                                                                                                                                                                ✅ 意图感知视觉（无 UI 操作 = 0 vision token）                                                                                                                                                                                                                                                                                                                                                                                |                                                                      ⚠️ 常开（浪费 token）                                                                     |               ⚠️ 盲（无截图）               |         ⚠️ 未知         |           ⚠️ 盲           |      ⚠️ 盲     |        ❌       |
| **标题生成**                 |                                                                                                                                                                                                                                                                                                                                                                                          ✅ O(1) 防阻塞 + 脱敏                                                                                                                                                                                                                                                                                                                                                                                         |                                                                         ⚠️ 易卡死/泄漏                                                                        |               ⚠️ 易卡死/泄漏               |         ⚠️ 未知         |           ⚠️ 未知          |     ⚠️ 未知     |        ❌       |
| **全局闪念捕捉**               |                                                                                                                                                                                                                                                                                                   ✅ macOS+Windows 双平台截屏 + UI 文本提取 + 语音 + FlowPad + Inline Agent Switcher/Profile 路由 + 隐私黑名单 + request-id 串流归因 + route-switch 请求级 abort + deep-link 去重队列（**36 项前端定向 + Chrome MCP `/intent` 实证**）                                                                                                                                                                                                                                                                                                  |                                                                             ❌                                                                            |                   ❌                   |           ❌           |             ❌            |       ❌       |        ❌       |
| **Token 效率**             |                                                                                                                                                                                                                                                                                                                                                                                    ✅ 总计 \~2,167 tokens（少 86%）                                                                                                                                                                                                                                                                                                                                                                                    |                                                                         \~15,520                                                                         |                \~18,000               |        ⚠️ 手动三档        |   ⚠️ \~9 Kanban LLM 工具   |     ⚠️ 高成本    |   ⚠️ \~900 唤醒  |

## vs PilotDeck — 代理操作系统与多 Agent 协作平台

PilotDeck（清华 THUNLP 等联合开源）主打“Agent 操作系统”概念，提供 WorkSpace 工作空间隔离、白盒化记忆（Dream Mode）、智能路由降本以及 Always-on 后台驻留执行功能。

### Myrm 的领先之处

| 领域               | PilotDeck                                  | MyrmAgent                                                 | 用户收益                                                                                                                                                                                                                                                                                                                                                                       |
| ---------------- | ------------------------------------------ | --------------------------------------------------------- | -------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| **项目工作区隔离**      | 虚拟 WorkSpace 隔离与状态存储                       | **物理级 Git Worktree 沙箱**                                   | 真正的零冲突并行读写。分配子 Agent 重构代码时，主分支代码完全不受影响，结束后一键可视化合并/丢弃。                                                                                                                                                                                                                                                                                                                      |
| **持久化后台任务**      | CLI Always-on 进程                           | **跨生命周期队列守护 (Daemon)**                                    | 随时关掉浏览器或 Tauri 桌面端，长任务状态安全落盘，醒来推送结果，绝不半途而废。                                                                                                                                                                                                                                                                                                                                |
| **多 Agent 监控**   | 基础日志流或简单 Waterfall                         | **SubagentDashboard 全景大盘**                                | 对话不被子任务刷屏。子任务拥有独立折叠抽屉与状态灯，支持 Working/Review/Done 实时监控和断点可视化干预。                                                                                                                                                                                                                                                                                                             |
| **委派暂停控场**       | Hermes 等 CLI 全局 `spawn_paused`（一次暂停影响所有会话） | **Session 级 Delegation Pause**                            | 在 Dashboard 一键暂停「本会话新委派」，在途子任务继续跑；多标签页互不干扰。Chrome LIVE E2E 签收（2026-07-20）。                                                                                                                                                                                                                                                                                                 |
| **Agent 全局存活状态** | 文件轮询 (gateway\_state.json)                 | **五态 Liveness SSOT**（busy/idle/degraded/offline/draining） | `GET /health/liveness` 返回全局五态 + 活跃会话 + 并发槽位。前端 LivenessIndicator 精确区分 degraded（后端可达但异常）和 offline（后端不可达），状态同步到 Tab 标题前缀、Tauri 托盘图标、聊天输入区圆点指示灯。33 项单测 + Chrome MCP E2E 验证。                                                                                                                                                                                                   |
| **记忆引擎与整合**      | 定时 Dream Mode 汇总                           | **GUI 指挥中心 + 10 模块专用机制**                                  | 不仅支持“白盒化记忆”，更配备 GUI 仪表盘、知识图谱视图与健康评分。统一 /journey 页面将知识图谱+技能趋势+成长 KPI 一页呈现。包含降维除重和“主动遗忘”算法。                                                                                                                                                                                                                                                                                  |
| **智能模型路由**       | 简单的 Judge 模型判断                             | **复杂度与隐私双重路由 + 账单系统 + 实时 Rate Limit 仪表盘**                 | ComplexityRouter + PrivacyRouter + FallbackManager + KeyPool + **实时 Rate Limit 监控**（RPM/RPH/TPM/TPH 四维圆形进度条 + SSE 实时更新 + 三级颜色预警）+ **SSE 模型切换实时通知**（model\_failover + model\_recovery ProgressStep + Toast 弹窗）+ EscalationScrubber 自升级检测 + 13 模块工业级 Fallback 体系（CircuitBreaker + ProbeThrottle + 场景感知选择）。Premium 模型 rate limit 问题通过自动降级 + 实时监控解决，而非静态警告文本。240+ 项路由/降级测试全通过。 |
| **全平台一键部署**      | 终端 3 分钟 `curl` 脚本                          | **可视化向导 + 启动预检 + 双 wheel 校验 + 24 项精瘦核心**                  | 4步引导向导自动探测本地能力 → 启动前预检全部配置（错误即阻断+修复建议）→ 跨版本配置schema自动迁移 → 7大GUI设置面板零YAML编辑。Tauri原生安装包支持。引擎：**24** 项锁定核心依赖 + **11** 组可选 Extras（浏览器/检索/ACP/可观测性…），二次开发者按需安装、终端用户自动获得完整 bundle；装错平台 wheel 在**启动时**失败而非对话中途（**327** 项 harness 架构测试，2026-07）。                                                                                                                                   |

### 从 PilotDeck 迁移到 Myrm

从 PilotDeck 迁移过来，你将从一个“命令行偏向的操作系统”彻底升级为一个 **“面向图形化交互的现代智能体工作站”**。你不仅继承并超越了其引以为傲的多项目隔离、省钱路由、后台执行等高级能力，更将获得可视化、可拖拽、可回滚的安全体验，以及与主流 MCP 插件生态无缝打通的开放性。

## vs 360 Security OpenClaw（企业封装版）

360 Security OpenClaw 是基于 OpenClaw 核心的闭源企业封装，通过「Shrimp Coach」引导配置和手动「Token 成本模式」（轻量/经济/全功率）降低上手门槛。

### Myrm 的领先之处

| 领域               | 360 Security OpenClaw             | Myrm                                                                                                                                                                                                                                                                                          | 用户收益                                                                                                                                                                                                         |
| ---------------- | --------------------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------ |
| **Agent 创建**     | 「Shrimp Coach」对话                  | **26 预设 Agent（6 种工具预设：MINIMAL/DEFAULT/CODING/RESEARCH/DESIGN/VIDEO\_STUDIO）+ 10 YAML 模板市场 (individual+team, i18n, 原子性实例化) + GUI 向导 + 每 Profile 15 维独立工具开关**                                                                                                                                   | 零提示词即开即用，角色工具边界已优化。                                                                                                                                                                                          |
| **Token 成本控制**   | LLM Judge 单阶段路由 (PilotDeck)       | **规则+Judge 双阶段复杂度路由**                                                                                                                                                                                                                                                                         | 80%+ 请求规则阶段即可决定（0 额外 token），仅歧义 case 调 Judge。                                                                                                                                                                |
| **成本可见性**        | 基础统计                              | **双层消息级可视化（内嵌缓存节省 banner + 17 项 tooltip）+ 14 维统计大屏 + Per-Agent 成本归因 + SessionSpendSurface 常驻胶囊（每轮 WU/-\$、会话累计、burn-rate ETA）**                                                                                                                                                                | 每条回复显示缓存命中率与节省金额、5 类 Token、TTFT/P95/TPS、per-model/per-tool 成本分解、会话基线对比、cache-break 归因+修复建议。常驻胶囊实时展示每轮 WU 消耗（沙箱）或 USD 成本（本地/Tauri），含会话累计与剩余天数 ETA。竞品中无一具备消息级实时成本可视化。                                          |
| **执行 Trace 与回放** | 仅日志 / AI Purpose Title（额外 LLM 调用） | **产品内嵌 7 层 Trace（ProgressSteps 实时树 + 语义工具标签 28 工具 × 5 语言 + 内联 AI 意图描述 + 分类图标 + 阶段折叠分组 + 思考过程 + 17 项 tooltip + 缓存节省 banner + ExecutionTraceTimeline + SessionReplayPlayer + SessionAnalyticsDialog）**                                                                                          | 每个工具调用显示人类可读标签 + AI 意图描述，零额外成本（意图由主模型在 tool\_call 中直接提供，无需独立 utility model）。任意消息一键查看完整执行回放——无需外部 SaaS 和额外费用。                                                                                                 |
| **云环境**          | 云电脑                               | **沙箱 + 持久终端 + SaaS**                                                                                                                                                                                                                                                                          | 真跨平台隔离与数据归属。                                                                                                                                                                                                 |
| **多媒体**          | 基础视频 Agent                        | **原生 `video/generator.py` + 全双工语音 + 工具无关沙箱（Agent 可 npm/npx 安装任意视频工具 HyperFrames/Remotion/FFmpeg——不锁定单一框架）+ 7 步 Multi-Shot Pipeline（自动检测 provider 时长限制→分镜规划→base image 一致性→I2V 生成→FFmpeg 无损拼接→BGM 叠加→关键帧 QC）+ 平台导出规格控制（10 种画幅 + 3 级分辨率 + 自动归一化 + 6 平台问卷 + QC 双通道：ffprobe 硬指标 + Vision 字幕安全区）** | 创作内容并支持打断（barge-in）免提交互。对话内 VideoTaskCard 内嵌播放器+重试。沙箱架构让 Agent 使用任意 CLI 视频工具，无框架锁定。内置 shot pipeline 指引解决 6-12s provider 时长限制——Agent 自动规划多段拍摄工作流制作长视频。平台导出规格自动归一化确保视频符合目标平台规范（抖音 9:16、YouTube 16:9 等），无需手动配置。 |

**结论：Myrm 提供更自动化、原生的 GUI 体验。无需「教练」问答，直接给可用模板；双阶段路由比竞品的纯 LLM Judge 方案更省 token 且更准确，并提供约 10 倍成本透明度。**

## vs OpenClacky — Token 优化本地 Agent

OpenClacky 主打低成本本地 AI Agent，宣称 Token 约为 Hermes 的 1/6。核心策略：16 个最小工具、空闲压缩、先插入后压缩、双缓存标记、BYOK 多模型路由。

### Myrm 的领先之处

| 领域                | OpenClacky                                                  | Myrm                                                                                                                                                                              | 用户收益                                                                   |
| ----------------- | ----------------------------------------------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ---------------------------------------------------------------------- |
| Tool Architecture | 16 core + invoke\_skill (2-tier)                            | **3-tier (CORE/COMMON/EXTENDED)** + ASCS cognitive load scoring + **Dynamic Schema Weaver**                                                                                       | Scientifically optimized, dynamic tool pruning prevents hallucinations |
| Idle Pipeline     | Single-purpose message compression (Thread)                 | **3 parallel tasks** (memory consolidation + evidence mining + cache preheating) + **CacheKeepAliveManager** (4分钟探测间隔, 活跃时自动暂停) + MaintenanceScheduler + crash-resilient registry | 空闲时完成3倍工作 + 缓存永不过期                                                     |
| Compression       | LLM-based summarization (each compression costs LLM tokens) | **Rule engine 3-tier (Dedup/Truncate/Remove)** — zero LLM cost + Cold Cache Drain + Anti-Thrashing                                                                                | No extra LLM calls for compression                                     |
| Cache Strategy    | Fixed last-2-message marking                                | **Multi-breakpoint** (system + 15-block protection + compression boundary + last message) + TTL strategy + 20-block window protection + token distance validation                 | More precise, provider-aware caching                                   |
| Model Routing     | Simple main/sub-task model split                            | **4-layer routing** (ComplexityRouter + PrivacyRouter + FallbackManager + KeyPool)                                                                                                | Comprehensive cost + privacy + reliability routing                     |
| Cache Protection  | None                                                        | **Hot Cache Bypass** (skip compression when cache is warm) + **Anti-Thrashing** (stop after 2+ ineffective compressions)                                                          | Unique — no competitor has this                                        |
| Deployment        | CLI + WebUI                                                 | **Web + Tauri + SaaS** (3 modes)                                                                                                                                                  | More deployment options                                                |
| Memory System     | Session-only (lost on restart)                              | **8 memory types + knowledge graph + cross-session consolidation**                                                                                                                | Persistent intelligence across sessions                                |
| GUI               | Basic web terminal                                          | **Full workspace GUI** — agent templates, Kanban, memory panel, analytics                                                                                                         | Professional workspace vs terminal                                     |
| Security          | Basic sandboxing                                            | **6-layer defense** with PII protection + taint tracking + audit                                                                                                                  | Enterprise-grade security                                              |

### 关键架构差异

**压缩成本**：OpenClacky 调用 LLM 生成压缩摘要 — 每次压缩都产生 API 成本。Myrm 使用确定性规则引擎（Dedup → Truncate → Remove），零 LLM 开销。

**缓存智能**：OpenClacky 双缓存标记是静态模式（始终标记最后 2 条消息）。Myrm 的 ExplicitCacheProcessor 根据内容块、token 距离与压缩边界动态计算断点，并带完整校验流水线。

**空闲利用**：OpenClacky 空闲定时器仅压缩消息。Myrm 空闲流水线并行 3 项：认知记忆整合、会话证据挖掘（从失败中学习）、前缀缓存预热 — 由容量感知调度器协调，带熔断保护。此外，`CacheKeepAliveManager` 每 4 分钟发送轻量 probe，防止 Anthropic/Qwen 5 分钟缓存 TTL 过期，确保用户暂停后继续对话时 TTFT 一致（0.5-1s vs 冷启动 2-5s）。

### 从 OpenClacky 迁移到 Myrm

| OpenClacky 功能        | Myrm 对应                                 | 体验         |
| -------------------- | --------------------------------------- | ---------- |
| 16 core tools        | 3-tier tool system + ASCS scoring       | ⬆️ Upgrade |
| Idle compression     | Idle pipeline (3 tasks + scheduler)     | ⬆️ Upgrade |
| Insert-then-Compress | Rule engine compression (zero LLM cost) | ⬆️ Upgrade |
| Dual cache marking   | Multi-breakpoint strategy + validation  | ⬆️ Upgrade |
| BYOK model routing   | 4-layer routing system                  | ⬆️ Upgrade |
| Session persistence  | 8-type memory + knowledge graph         | ⬆️ Upgrade |
| WebUI                | Full workspace GUI (Tauri + Web + SaaS) | ⬆️ Upgrade |
| Skill system         | 42-module skill evolution with safety   | ⬆️ Upgrade |

**结论：8 项升级、0 项持平、0 项降级。OpenClacky 用户获得零成本压缩、智能缓存保护、跨会话持久记忆与完整 GUI 工作区，同时保留全部 Token 效率优势。**

## 统一工具网关与弹性 BYOK（vs Hermes / OpenClaw）

竞品常迫使用户管理大量 API Key，或依赖僵硬、易出错的网关。Myrm 提供 **四合一统一工具网关** 与 **弹性 BYOK 回退** 机制。

### Myrm 的领先之处

* **四合一网关**：一次订阅解锁 LLM、网页搜索、图像生成与 TTS，开箱零配置。
* **弹性 Try-Catch 回退**：官方网关不可用或 Work Units (WU) 用尽时，Myrm 自动无缝降级到你本地配置的 API Key，业务不中断。
* **配额结转**：与传统 SaaS 未用配额作废不同，Myrm 允许未用 WU 结转至下月。
* **可视化网关状态**：专用 GUI 仪表盘展示各工具状态（网关托管 / 自定义 Key / 未配置），Pro 用户有智能提示启用网关能力。
* **金融级安全**：PAT 经安全 POST 体传输，严格正则校验，防 SSRF，保证 token 不进 URL 日志。
* **极端网络韧性**：命令式按需轮询 + `AbortController` 8 秒硬超时，消除竞品自动轮询仪表盘导致的 UI 卡死与 API 配额空耗。

### 竞品痛点

* **Hermes**：网关「非黑即白」硬切换；网关失败或额度用尽则 Agent 直接崩溃停工。
* **OpenClaw**：完全依赖用户通过扩展提供的 Key，无统一网关与计费。
* **云浏览器依赖**：Hermes 网页任务依赖第三方云浏览器（如 Browser Use），高延迟与隐私风险。Myrm 坚持本地/自托管沙箱做浏览器自动化，零延迟、数据完全私有。

### 迁移收益

* **零 Key 管理**：不再为 OpenAI、Firecrawl、FAL 等疲于切换 API Key。
* **安心**：弹性回退 = 托管网关便利 + 自有备份 Key 可靠性。

## WebUI 安全与本地/远程分离

多数竞品的 Web 界面要么在公网桥接时裸奔暴露（LAN/隧道无保护），要么对单人本地开发过于沉重（`localhost` 也强制数据库与登录）。

Myrm 以奥卡姆剃刀式 WebUI 安全方案，解决本地优先部署的「最后一公里」。

### Myrm 的领先之处

* **本地零摩擦 vs 远程铁壁**：WebUI 自动识别 `localhost` 回环免登录；一经隧道或 LAN 暴露即强制密码保护。
* **零信任 WebSocket 网关**：竞品常只保护 HTTP，WebSocket（实时日志/语音）裸奔。Myrm `WsAuthMiddleware` 在 session cookie 缺失或无效时物理拒绝握手（HTTP 403）。
* **CORS 三层纵深防护**：scheme+host 双层输入校验（通配符 `*` 直接拒绝）+ WebSocket Origin Guard（复用 CORS 配置统一安全边界，4003 拒绝非法 origin）+ HostAllowlist DNS Rebinding 防护（动态 ingress/tunnel hostname 白名单）。Tauri 桌面端 `tauri://localhost` 原生 scheme 支持。云部署 default-deny。29 项 CORS 安全测试验证。
* **即时会话驱逐**：改密码或切换保护时自动轮换全局 HMAC Session Signing Key，瞬间作废所有会话（类似失窃设备一键熔断）；竞品旧 JWT 常仍有效。
* **单租户 Vault vs 重型 DB**：本地模式用单一高加密 `admin.json`，非 SaaS 式 Postgres/MySQL + RBAC 膨胀；安全、可移植、零依赖。

## 数据防泄漏（DLP）与隐私感知路由

Agent 对话可能涉及敏感个人信息。竞品（如 ClawVault）仅在对话消息级别做简单的"检测→占位符替换→还原"，遗漏了工具参数、工具结果、流式输出等多个泄漏通道。

### Myrm 的领先之处

| 领域         | ClawVault / 竞品        | Myrm                                        | 用户收益      |
| ---------- | --------------------- | ------------------------------------------- | --------- |
| **PII 检测** | 正则基础检测                | **正则 + LLM 语义双层**（可识别"我家住在XX小区"等隐含地址）       | 无遗漏检测     |
| **敏感度分级**  | risk\_score 数值（无分级）   | **S1/S2/S3 三级**自动分类 + 不同级别不同处理策略            | 精准保护      |
| **处理动作**   | sanitize/restore（2 种） | **WARN/REDACT/PSEUDONYMIZE/BLOCK**（4 种）     | 灵活应对      |
| **隐私感知路由** | 无                     | **S2→脱敏后云端或本地，S3→本地模型或阻断**                  | 敏感数据永不出沙箱 |
| **拦截通道**   | 1（对话消息）               | **7 通道**（消息+工具参数+工具结果+SSE流+数据导出+标题生成+上下文摘要） | 无死角防护     |
| **前端可视化**  | 无                     | 每条消息旁显示 **S2/S3 色彩标签 + 脱敏状态 + 路由方式**        | 透明可信      |
| **用户自定义**  | 无                     | 自定义敏感关键词 + 自定义正则模式 + 自定义敏感工具标记              | 完全掌控      |

**2033 项离线/隐私/安全测试全通过**（2026-07-14 验证），覆盖 PrivacyRouting（44）+ Hardware API + 部署模式（48）+ LLM Fallback 降级（153）+ 安全全套（1766）+ OfflineGuardian 通知（22）。vs QoderWork「离线运行」仅绑定通义千问本地版，无隐私路由、无硬件推荐、无熔断降级——Myrm 9 项离线维度全面碾压。

## 多 Agent 编排：确定性调度（vs Hermes / OpenClaw / JiuwenSwarm）

竞品多依赖单一编排模式（如 Hermes Kanban Swarm、OpenClaw 基础线性 spawn、或 JiuwenSwarm 的静态 DAG 工作流脚本）。Myrm 提供 **8 模式确定性编排引擎**，辅以 **5 层工具安全围栏** 与 **4 维预算控制**。与 JiuwenSwarm 需要用户编写 Python `workflow.py` 脚本来定义执行顺序不同，Myrm 的 Leader Agent 通过自然语言动态调度子 Agent，并支持运行时转向/取消 —— 这是静态 DAG 无法提供的能力。

### Myrm 的领先之处

| 领域                         | Hermes / OpenClaw                              | Myrm                                                                                                                     | 用户收益                                                                                                                                                          |
| -------------------------- | ---------------------------------------------- | ------------------------------------------------------------------------------------------------------------------------ | ------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| **Orchestration Modes**    | ⚠️ 1-2 modes (Kanban or Spawn)                 | **8 Modes** (Spawn, Chain, Batch, DAG, Verified, Swarm Fission, Alternatives Race, Council Debate)                       | Right tool for the right job; DAG guarantees execution order without relying on LLM improvisation.                                                            |
| **Tool Isolation**         | ⚠️ Basic global scope                          | **5-Layer Fence** (Type, Blocklist, Config, Intersection, Role)                                                          | Complete prevention of child agents escalating privileges or executing unauthorized tools.                                                                    |
| **Budget Control**         | ⚠️ Token limit only                            | **4D Budget** (Tokens, USD, Time, Descendants)                                                                           | Perfect predictability for cost and execution depth. Zero bill shock.                                                                                         |
| **Execution Verification** | ❌ None                                         | **CompletionGuard** (Evidence-based + Temporal + Independent Re-run)                                                     | Children must prove task completion with actual STDOUT/STDERR. Temporal check detects post-verification code writes; independent re-run validates in sandbox. |
| **Handoffs（控制权转移）**        | ❌ 无（OpenAI Swarm 仅 Demo 级 `transfer_to_agent`） | **run\_chain**（A→B→C 接力赛）+ **delegate\_task\_tool**（动态路由）+ **handoff\_chat**（跨平台会话交接）+ **context\_mode:"fork"**（可控上下文继承） | 完整的接力赛语义，不牺牲安全边界。733 项测试验证。                                                                                                                                   |

**结论：Myrm 用确定性软件工程模式取代「提示并祈祷」式多 Agent。流水线每次可靠、安全、在预算内执行。1,680 项编排测试通过，0 失败（2026 年 7 月）。**

:::tip vs AWS Codex Agent Team — 代码级编排
AWS 的 sample-codex-agent-team 通过 6 个纯 Prompt 的 `SKILL.md` 模板（头脑风暴→规格→协调→评审→文档→项目管理）指导多 Agent 协作——完全依赖 LLM 自律。Myrm 用代码级原语替代每一步：`run_council` 多专家交叉审查、`execute_dag_plan` 确定性 DAG、`run_with_verification` 对抗验证自动重试、31 组件看板 GUI 实时项目管理。LLM 无法绕过任何一环。

竞品的 12 字段 "Handoff Contract"（role、objective、file scope、acceptance criteria、verification command 等）同样是纯 Prompt 约定。Myrm 通过 `DelegateTaskInput` Pydantic schema + 8 项代码级强制检查（payload-hash 去重、深度/容量限制、类型白名单、暂停控制、验证模式）全部覆盖——还额外拥有 4 项竞品完全没有的独有机制。2,488 项测试通过，0 失败。
:::

## 智能并发路由 — 消除读写竞态（vs Hermes / OpenClaw）

高并发 Agent 沙箱中，LLM 常幻觉出破坏数据的操作，例如在同一并行工具批次中「同时读文件 X 又写文件 X」。竞品架构会导致脏读与灾难性写覆盖。

Myrm 引入 **智能并发路由**，在中间件层主动拦截并重路由冲突操作。

### Myrm 的领先之处

| 领域                          | Hermes Agent       | OpenClaw | Myrm                                            | 用户收益                                               |
| --------------------------- | ------------------ | -------- | ----------------------------------------------- | -------------------------------------------------- |
| **Race Condition Defense**  | ⚠️ Write-only lock | ❌ None   | **Full read-write exclusion**                   | Prevents dirty reads and corrupted files           |
| **Concurrency Degradation** | ⚠️ Basic serial    | ❌ Fails  | **Auto-degrade to safe sequential**             | Safe fallback without crashing                     |
| **Lock Granularity**        | ⚠️ Coarse path     | ❌ None   | **Deep directory & block-level fingerprinting** | Unrelated parallel tasks keep running at max speed |
| **Performance Overhead**    | O(N) linear scan   | N/A      | **O(1) path lock resolution**                   | Zero latency penalty for the engine                |

**结论：Myrm 彻底消除 LLM 幻觉导致的文件级竞态。冲突批次优雅展开为顺序队列，无关并行任务零性能损失。**

## 无头 Agent：零死锁后台任务（vs Hermes / OpenClaw）

SaaS 定时任务（Cron）、批处理或后台自动化等无头环境中，Agent 无人监督运行。若 LLM 幻觉调用人工介入（HITL）工具（如提问或渲染 UI 表单），竞品会无限等待永不到来的用户输入，灾难性死锁并烧穿算力。

Myrm 在框架最底层提供 **基于标签的环境降级** 架构。

### Myrm 的领先之处

| 领域                          | Hermes Agent                         | OpenClaw      | Myrm                                     | 用户收益                                                                                |
| --------------------------- | ------------------------------------ | ------------- | ---------------------------------------- | ----------------------------------------------------------------------------------- |
| **Deadlock Prevention**     | ❌ Prone to freeze                    | ❌ Unsupported | **100% Guaranteed Zero Deadlock**        | Scheduled background tasks will never hang waiting for human input.                 |
| **Tool Stripping**          | ⚠️ Hardcoded in business logic       | ❌ None        | **Automatic via `tags=["interactive"]`** | The LLM doesn't even know the tool exists, preventing hallucination errors.         |
| **Ecosystem Compatibility** | ❌ Needs manual wrapper for each tool | ❌ None        | **Works with any MCP Tool natively**     | Any third-party MCP tool tagged `interactive` is automatically isolated.            |
| **Architectural Layer**     | ⚠️ Server-level hack                 | ❌ None        | **Core Harness / Agent engine layer**    | The protection travels with the engine, whether deployed locally, Desktop, or SaaS. |

**结论：Myrm 保证无人值守工作流防弹可靠。后台任务物理剥离交互工具，在 LLM 犯错前根除 Cron 死锁根因。**

此外，Myrm 的 **Stuck Task Watchdog** 可检测基础设施层面卡死的 Agent 任务（如 LLM API 半开连接、工具死锁），并在可配置超时（默认 600 秒）后自动取消。Watchdog 运行于现有 60 秒 janitor 周期内，零新增组件，向用户发送本地化超时通知（支持 5 种语言），并释放会话以便后续消息正常处理。竞品 OpenClaw 需容器级 `killContainer`（粗暴），Hermes 需手动 `/stop` — Myrm 全程透明处理。

## 极端场景防爆（vs Hermes / OpenClaw）

自主多模态场景（如 Computer Use）或超长会话中，Agent 必然撞上下文窗口上限；竞品频繁 OOM、断连或记忆全丢。

Myrm 实现 **四层极端防爆护城河**，确保 Agent 不崩溃、对话上下文不丢。

### Myrm 的领先之处

| 领域                         | Hermes / OpenClaw                                                                                                                                      | Myrm                                                       | 用户收益                                                                                                                                                                                                                                           |
| -------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------ | ---------------------------------------------------------- | ---------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| **Gateway Hygiene**        | Allows massive payloads to hit the LLM layer, leading to severe compute node OOMs.                                                                     | **Millisecond Interception**                               | Blocks malformed/gigantic payloads (>120K tokens) at the API gateway before they even touch the agent engine.                                                                                                                                  |
| **Auxiliary Model Shield** | Crashes the application if the summarizer model's context window is smaller than the payload being compressed.                                         | **Dynamic Ratio Validation & Graceful Degradation**        | Automatically falls back to the main model for summarization if the cheap auxiliary model is too small. No crash, no data loss.                                                                                                                |
| **Media Stripping**        | Treats all images equally; long-tail screenshots from past turns quickly bloat the context window. Base64 images stored in checkpoints cause DB bloat. | **Lazy-Resolve Pipeline + Sliding Visual Evidence Window** | Images stored as lightweight URL references (\~50 bytes vs \~2-5MB base64). MediaResolverProcessor resolves to base64 only when sending to LLM. Sliding Window retains last 2 turns. **>99.99% checkpoint size reduction for image messages.** |
| **Tail Budget Protection** | Hardcoded turn truncation (e.g., keep last N messages) often chops off critical working memory.                                                        | **Token Budget Reservation**                               | Strict reservation (e.g., 20% of max context tokens) exclusively for the most recent tail, guaranteeing active tasks are never squeezed out.                                                                                                   |

**结论：极端负载下仍丝滑。剥离历史图片大幅省 Token，不必担心 Agent 突然崩溃抹掉劳动成果。**

## 网页搜索 + 网页抓取 — 双引擎（vs Hermes / OpenClaw / Claude Code）

Myrm 将 **web\_search** 与 **web\_fetch** 作为一等内置工具。竞品要么缺失、要么透传原始 API 结果、要么按次向云 API 计费。

### 你将获得

| 能力                             | Technical                                                                                          | 用户收益                                                                                        |
| ------------------------------ | -------------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------- |
| **Web Search**                 | 8 engines + 7 intent types (zero LLM) + 双层智能去重（URL 仲裁+镜像站哈希去重）+ BM25/RRF + Reranker + Autocut 动态截断 | 只保留高相关结果 —— 重复结果自动合并（同 URL 保留信息最丰富的版本，镜像站自动折叠），Autocut 检测分数断崖自动截断低相关内容                      |
| **Web Fetch**                  | HTTP → Browser → Stealth + DOM pruning + Markdown + Schema-Driven structured extraction            | Article body, not nav/ads HTML — **\~40–50% fewer tokens**; Schema extraction saves **97%** |
| **可选 L4 远程兜底**                 | L1–L3 失败后 Jina → Firecrawl；**默认关闭**；会话 cap                                                         | 极难页面可选云端，但不强制像 OpenClaw/Hermes 那样默认走 Firecrawl                                              |
| **Logged-in fetch**            | SessionVault: CookieJar (HTTP) + `storage_state` (browser)                                         | One login works across fetch tiers — competitors often lose cookies on engine switch        |
| **fetch\_and\_extract**        | Crawl → BM25 + vector hybrid → Reranker                                                            | Long pages → only relevant passages (zero LLM cost vs Hermes Gemini summary)                |
| **web\_fetch vs browser 智能分工** | 工具描述 + Dynamic Hints + Loop Guard 对称建议；web\_fetch=CORE Turn1，browser=按需                            | 只读页面少开浏览器（更快更省）；需交互仍走完整浏览器 — Hermes 仅 browser→web 单向 hint                                   |
| **Cost**                       | 100% local processing                                                                              | **\$0/month** vs Firecrawl/Jina/Exa subscriptions                                           |
| **Chinese search**             | SearxNG + Baidu aggregation                                                                        | Works out of the box — no Tavily/baidu Skill hacks                                          |
| **PTC inline**                 | 同脚本批量本地工具（RPC stub）；**单次搜网仍 native**                                                               | 多文件分析无需 N 轮 LLM；相对 Hermes/OpenClaw 逐步调用更诚实路由                                                |

### 竞品痛点

| Product                   | Search                               | Fetch                              | Problem                                             |
| ------------------------- | ------------------------------------ | ---------------------------------- | --------------------------------------------------- |
| **Hermes**                | Exa/Tavily/Firecrawl API passthrough | `web_extract` + Gemini LLM summary | Paid APIs + **extra LLM token per page**            |
| **OpenClaw / OpenClacky** | DuckDuckGo/Bing HTML scrape          | Single HTTP or Firecrawl fallback  | Poor Chinese results, rate limits, regex HTML strip |
| **OpenCode**              | Exa/Parallel cloud only              | Single HTTP + Turndown (full page) | Requires API keys; no local filter pipeline         |
| **Claude Code**           | Hosted web\_search                   | Hosted web\_fetch                  | No self-host, no engine choice, opaque filtering    |

:::note 诚实边界
Hermes `web_extract` 看似「零配置」因用 LLM 摘要而非本地 embedding — 但每页消耗 token。Myrm `web_fetch` 开箱本地 DOM 修剪；配置后可 `fetch_and_extract` 向量+Reranker。SSRF 防护相当 — Myrm 优势在 **过滤流水线**，非基础安全。
:::

### 迁移收益

| From        | After migrating to Myrm                                                    |
| ----------- | -------------------------------------------------------------------------- |
| Hermes      | Drop Firecrawl dependency; local 3-tier fetch; GUI search engine config    |
| OpenClaw    | No manual Tavily/baidu Skill; 7-engine fallback; BM25/Reranker filtering   |
| Claude Code | Self-hosted + 100+ models; auditable filter pipeline; PTC-native web tools |

配置与用法见[网页搜索与抓取指南](/zh/guides/web-search-and-fetch)。

### 引用溯源与来源展示

每条 AI 回复中引用的信息均可追溯到原始来源。支持 4 种来源类型（网页搜索、MCP 工具调用、知识库文档、历史对话），通过 hover 预览查看完整摘要、域名和 favicon，触屏设备自动切换为点击模式。

| 能力                      |               Myrm               |   竞品  |
| ----------------------- | :------------------------------: | :---: |
| 来源类型数                   | **4 种**（web/MCP/KB/conversation） | 0–1 种 |
| 触屏兼容                    |              ✅ 自动检测              |   ❌   |
| Hover 预览（域名+摘要+favicon） |                 ✅                |   ❌   |
| 跨消息来源累积去重               |                 ✅                |   ❌   |
| 后端 cache-safe 引用规则注入    |                 ✅                |   ❌   |

### 文档解析引擎

Myrm 内置 11 模块专业文档解析引擎，提供从 PDF 到 Office 到 Jupyter Notebook 全格式的深度解析能力（184 项测试验证）：

| 能力                                                                  | Myrm |                  竞品                 |
| ------------------------------------------------------------------- | :--: | :---------------------------------: |
| PDF 智能编排（3策略：文本/嵌入图/全页渲染）                                           |   ✅  |               ❌ 仅文本读取               |
| 超大文档支持（默认 500 页，上限 2000 页 + 并行解析 + 截断透明提示）                          |   ✅  |          ❌ OpenClaw 硬限 50 页         |
| 书签/目录注入 + 字体标题双模检测                                                  |   ✅  |                  ❌                  |
| 表格 L0/L2 两层封装 + RAG 反碎片                                             |   ✅  |                  ❌                  |
| 图像 3 级噪点过滤（尺寸+纵横比+MD5去重）                                            |   ✅  |                  ❌                  |
| PaddleOCR（CJK 原生·懒加载·可选 GPU）                                        |   ✅  |                  ❌                  |
| Office 全格式（docx: 文档顺序+标题+列表+表格含合并单元格去重; xlsx: 多Sheet; pptx: 幻灯片+备注） |   ✅  | ⚠️ 部分（无表格Markdown、无合并单元格处理、文档顺序被打乱） |
| Jupyter Notebook 解析（token 节省 84-99%）                                |   ✅  |                  ❌                  |
| MediaResolver Lazy-Resolve（URL 引用→按需 base64）                        |   ✅  |             ❌ base64 内嵌             |

## vs Hermes Agent (v0.15 Velocity) — 多 Agent 平台

Hermes v0.15（Velocity，2026-05-28）将核心循环从 16k 行重构为 14 模块共 3.8k 行，新增 Kanban Swarm 编排（104 PR），`session_search` 重写为无 LLM（\~20ms，原 \~30s），引入 Promptware 防御（3 卡口、\~15 Brainworm/C2 模式）。显著「还技术债」版本。

### Myrm 的领先之处

* **事件驱动看板** vs Hermes 轮询 — 即时分派 + 心跳 + 僵尸检测 + 三层防冲突（原子认领 + 所有权强制 + 分配审计，817 项测试）
* **6 条诊断规则** + 严重度自动升级（warning→error→critical）— 检测滞留 Ready、重复失败、长期 Blocked、死依赖、Triage 停滞、Block↔Unblock 循环（每卡 O(1) vs Hermes O(N) 事件扫描）
* **8 种编排模式**（Spawn/Chain/Batch/DAG/Verified/Swarm Fission/Alternatives Race/Council Debate）vs v0.15 单一 Swarm
* **CompletionGuard** 物理证据验证 — Hermes 无完成验证器
* **流水线模板向导**（发现问题 + 角色自动匹配）— Hermes `hermes kanban swarm` 为固定 CLI
* **35+ 消息渠道**（25 带输出提示）vs \~23（19 带平台提示）— Myrm 覆盖钉钉、Teams、Google Chat、LINE、IRC、iMessage、Voice、Webhook、Zalo 等 Hermes 缺失项
* **8 类记忆** + 知识图谱 vs 2,200 字符扁平记忆（MEMORY.md + USER.md § 分隔）
* **网页搜索 + 抓取双引擎** — 8 引擎 BM25/Reranker + 三层本地抓取 DOM 修剪（\$0/月）vs Hermes 云 API 透传 + Firecrawl/LLM web\_extract
* **FTS5 + Qdrant 混合搜索** + 作用域/谱系过滤 — Hermes v0.15 仅本地文本（\~20ms，无语义检索）
* **108 模式安全扫描** vs Hermes threat\_patterns.py（3 作用域 \~20 模式）
* **22+ 中间件流水线** vs 8 层固定栈 — Myrm 各组件可独立配置
* **四层模型纪律**（CORE→ENFORCEMENT→FAMILY→ESCALATION）vs Hermes 模型门控文本块 — Myrm 含 ESCALATION\_CONTRACT 自动模型自升级
* **GUI 优先** + Tauri 桌面 vs 仅 CLI（v0.15 加 TUI 多会话，仍终端绑定）
* **4D 预算**（Token + USD + 时间 + 最大子代）— Hermes v0.15 仅每任务超时（1 维）
* **三级智能模型路由** — Hermes v0.15 仅手动每任务选模型（无自动路由）
* **6 层 Prompt Cache** vs Hermes `system_and_3`（4 断点、仅 Anthropic）— Myrm 支持 5+ 提供商 + 缓存断裂检测 + 防抖动
* **Cache 友好的记忆注入**：Myrm 将记忆分为 Stable（SystemMessage，缓存安全）+ Learned（HumanMessage + UNTRUSTED\_DATA 安全隔离，绝不污染 System Prompt）。Hermes 文章声称「以 User Message 形式注入」，但其真实代码（`system_prompt.py:424-486`）将记忆合并到 System Prompt volatile 层——每次记忆更新都会导致缓存失效。**175 项缓存专项测试已验证**
* **IP 人设保护零额外成本**：用户配置的 `system_prompt` 通过 `UserInstructionsMiddleware` 以 `priority="highest"` + `[ABSOLUTE OBEDIENCE OVERRIDE]` 最高优先级注入，确保 LLM 严格遵从 IP 身份事实。Hermes 仅依赖纯文本 `SOUL.md`，无优先级强制执行机制。AI Builder 自动生成包含反捏造指令的人设定义——**765 项中间件测试已验证**
* **4 层工作区上下文注入**：`workspace_rules_middleware` 自动发现 **15 种格式**（`.myrm.md`、`AGENTS.md`、`CLAUDE.md`、`.cursorrules`、`.clinerules`、`.windsurfrules`、`SOUL.md`、`MEMORY.md`、`.cursor/rules/*.mdc`、`.claude/CLAUDE.md`、`.github/copilot-instructions.md` 等）的项目规则文件，注入为 `<workspace_context>`。包含 prompt injection 检测（score≥0.8 阻断）、隐形 Unicode 清洗、YAML 前言清除、inode 去重、20K 字符总预算内 head/tail 截断。每层按作用域划分（跨用户/per-user/per-workspace）最大化 Prompt Cache 效率。Hermes/WorkBuddy 需要手动创建 `MEMORY.md` + `SOUL.md` 且无优先级控制——**17 项集成测试已验证**

### 技能进化 — 真·自进化 Agent

Myrm 技能进化（42 模块、原生内置）实现 Self-Improving Agent 研究可工程化概念。Hermes「自进化」是第三方 AGPL `darwinian_evolver` 的外部 CLI 包装，非原生能力。

| 能力                                                                            |              Hermes             |                                                                           Myrm                                                                          |
| ----------------------------------------------------------------------------- | :-----------------------------: | :-----------------------------------------------------------------------------------------------------------------------------------------------------: |
| Integration                                                                   | External CLI wrapper (AGPL-3.0) |                                                          **Native built-in** (42 modules, MIT)                                                          |
| Auto-learn from conversations                                                 |             ✅ Basic             |                                                    ✅ CAPTURED + structured extraction + deduplication                                                   |
| Auto-fix failed skills                                                        |                ❌                |                                                    ✅ FIX + Retrieve-Before-Generate + evidence-driven                                                   |
| Multi-variant competition                                                     |                ❌                |                                                        ✅ 3 parallel variants + LLM-Judge scoring                                                        |
| Evolution cost per run                                                        |         50-500 LLM calls        |                                                          **3 variants** (1% of competitor cost)                                                         |
| Safety boundary                                                               |           1-layer scan          |              ✅ 6-layer (LoopGuard 7-detector graduated WARN→BREAK + sandbox + GUI approval + validator + evolution lock + frequency guard)              |
| Quality monitoring                                                            |                ❌                |                                    ✅ 3-dimension degradation detection (success rate + P95 latency + 5xx error rate)                                    |
| User frustration detection                                                    |                ❌                |                                                     ✅ 5 categories, 38 patterns (Chinese + English)                                                     |
| Evidence aggregation                                                          |                ❌                |                                           ✅ Success/failure case grouping with common error pattern extraction                                          |
| Description optimization                                                      |                ❌                |                                                ✅ Auto-refine trigger conditions for better skill matching                                               |
| GUI approval workflow                                                         |          ❌ Auto-execute         |                                                   ✅ Review, modify, approve or reject before applying                                                   |
| **Per-agent Insights Inbox** (background distill → approve in Agent settings) |       ❌ Global auto-apply       |                                 ✅ **Insights tab** — nothing applies until you approve; dismiss writes negative exemplar                                |
| **Real-time growth notification**                                             |            ❌ CLI text           |                             ✅ **SSE push → Toast** (info/success/error/warning) with action button — works across all pages                             |
| **Growth policy engine**                                                      |       Simple apply/reject       | ✅ **6-path decision matrix**: auto-apply safe skills, security pre-scan, BM25+Embedding semantic dedup (75%), evolution lock, fallback to manual review |
| Per-agent skill isolation (no cross-agent habit pollution)                    |          ⚠️ Shared pool         |                                                 ✅ **agent\_id scoping + CoW fork** on cross-agent mounts                                                |
| Growth dashboard                                                              |                ❌                |                                                    ✅ KPI + heatmap + radar chart + evolution timeline                                                   |
| 跨设备技能同步                                                                       |                ❌                |                         ✅ **协议驱动的双向同步**（iCloud/Dropbox/NAS）+ SHA256 增量追踪 + 推送质量门控 + 4 种冲突策略 + 自动更新检测 + 后台空闲自动同步（366 项同步/发现/安全测试）                        |
| 回归安全进化                                                                        |                ❌                |                                              ✅ **EvalCase 协同进化** — 自动生成测试用例验证每个变体不破坏已有行为（6 种断言类型 + 非阻塞惩罚门控）                                             |
| Batch confirmation                                                            |                ❌                |                                                      ✅ 90% cost reduction for multi-skill evolution                                                     |
| Evolution constraints                                                         |                ❌                |                                                   ✅ Historical error memory prevents repeated mistakes                                                  |
| Prebuilt skill upgrade protection                                             |        ❌ Silent overwrite       |                                          ✅ **Three-way hash** — user edits preserved, "Update Available" badge                                          |
| Daily work journal                                                            |                ❌                |                                                ✅ 6-source aggregated daily timeline with date navigation                                                |
| AI Daily Wrap summary                                                         |                ❌                |                                    ✅ LLM-generated daily summary with keywords + next-day suggestions + SQLite cache                                    |

**vs ECC (Everything Claude Code) `continuous-learning-v2`：** ECC 在后台蒸馏原子化「本能」YAML 习惯 — 对高级用户强大，但其 v2.1 项目隔离仅有 2 级（git remote hash → 项目/全局），且 "2+ 项目出现自动晋升全局" 存在误报风险。Myrm 提供相同 *思路*（空闲蒸馏 → 技能提案）+ 架构级更强隔离：**5 级作用域层级**（GLOBAL > AGENT > CHANNEL > CONVERSATION > TASK）+ 命名空间 + 每 Agent CoW 进化。Agent 设置中的 **Insights Inbox** 确保提案保持草稿直至你批准；驳回写入负例以防重复提案；内置 Agent 在 inbox 只读。**3,519 项测试验证**覆盖技能注入、模型纪律、进化、搜索、安全全链路。MCP 方面 Myrm 已提供 **GUI 启用前扫描 + 验证 + 运行时 fail-closed**（见下文 MCP 安全门）— 领先 Hermes 仅日志流；我们**尚未**提供 ECC 的 `/aside` 分叉聊天、`/context-budget` 树图或 102-hook 全量静态包（roadmap #6）。

### 技能模块架构 — 八维优势

除进化外，Myrm 技能系统架构在各维度上更成熟：

| 领域                          | Hermes                                                                         | Myrm                                                                                                                                                                       | 用户收益                                                       |
| --------------------------- | ------------------------------------------------------------------------------ | -------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ---------------------------------------------------------- |
| Tool-Conditional Activation | Procedural if/else in prompt builder                                           | **4-field declarative** (requires\_tools/fallback\_for\_tools + tool group variants)                                                                                       | Skills auto-adapt to available tools across Web/Tauri/SaaS |
| Skill Injection             | Manual `@skill-name` selection                                                 | **Zero-roundtrip** auto-injection via slash commands + template variables (`${SKILL_DIR}`, `!`cmd\`\`)                                                                     | Say one word, skill activates instantly                    |
| Config Management           | Plain text KV injection (`[Skill config: key=value]`) — secrets visible to LLM | **JSON Schema** standard with auto-generated forms + multi-instance + env\_overrides (secrets never reach LLM)                                                             | Secure API key management + same skill, multiple configs   |
| Prebuilt Skill Protection   | No migration path (pre-hash users lose protection)                             | **Three-way hash** with GUI "Update Available" badge + accept/reject workflow                                                                                              | Customize freely, never lose your changes                  |
| Installation Security       | Hardcoded 4×3 policy matrix                                                    | **6-layer install defense** (quarantine → 26 categories/113 patterns + AST → LLM semantic audit → REJECT block → trust attenuation → GUI approval) with 532 security tests | Intelligent, layered security that adapts at every stage   |
| Curator Governance          | Coarse-grained skip (foreground skills never managed → list bloat)             | **Non-destructive archive** (always recoverable) + pinned + evolution\_locked                                                                                              | Skills stay organized, important ones stay protected       |
| Missing Dependency Handling | Load full doc then append setup note                                           | **XML summary shows reason at L0/L1** (save tokens) + 3-level fallback degraded docs                                                                                       | Know instantly what's missing, fix it fast                 |

### 技能生态发现与导入 — 7 源并行聚合 vs 单一来源

竞品仅扫描单一本地目录（`.claude/skills/`、`.agents/skills/`），Myrm 从 **7 个并行发现源**（含 ModelScope 80K+ / Aliyun AgentExplorer）聚合技能，配备完整 GUI 导入管线：

| 能力       | Hermes / OpenClaw |                                            Myrm                                           | 用户收益           |
| -------- | :---------------: | :---------------------------------------------------------------------------------------: | -------------- |
| 发现来源     |    1 个（本地目录扫描）    |                   **5 个并行**（ClawHub + GitHub + LobeHub + skills.sh + 预置）                  | 一次搜索覆盖全生态      |
| 搜索界面     |      CLI / 无      |                         **GUI SkillDiscoverTab** 支持筛选、排序、14 类技能分类                         | 像应用商店一样浏览      |
| URL 导入   |         ❌         |                                **URL → 自动分析 → 批量安装**（含冲突检测）                               | 粘贴链接即装技能       |
| ZIP 批量导入 |         ❌         |           **拖拽 → 安全扫描 → 冲突检测 → 双阶段 preview/confirm（`message+error_code`）→ 原子安装**          | 秒级批量迁移，报错稳定可恢复 |
| 热重载      |        需重启        |                **零停机**：`bump_skill_config_version()` → Agent 检测过期 → 自动重初始化                | 安装即用           |
| 安全扫描     |      无 / 硬编码      | **安装前隔离** + `SkillSecurityValidator` + 安全 ZIP 解压（entry 上限 + 防 Zip Bomb + 路径穿越 + 可执行二进制拦截） | 默认安全           |
| 原子安装     | `os.replace` 文件替换 |                                **蓝绿目录切换** + 事务化 DB 写入 + 回滚                                | 永不出现损坏状态       |
| 自动更新     |         ❌         |                           **`SkillAutoUpdateChecker`** + "有更新"徽章                          | 始终保持最新         |
| 格式兼容     |       仅自有格式       |           **SKILL.md** + YAML frontmatter（与 Hermes/OpenClaw 共享）+ 任意 Markdown 技能           | 零摩擦生态导入        |

**结论：9 项升级、0 项持平、0 项降级。Myrm 将技能发现打造为一流 GUI 体验，具备企业级安全保障与 preview/confirm 一致错误契约；竞品仍局限于本地目录扫描。**

### 进化验证管线 — 5 层纵深 vs 零验证

竞品提案建议用户手写 `validator/*.md` 测试用例——这对 SOP 提示词类型的技能来说是根本性的设计缺陷，且大幅增加使用摩擦。Myrm 的 **5 层自动验证管线** 提供全方位保护，用户零摩擦：

| 层级                   | 功能                                                                                                           | 类型     | 竞品    |
| -------------------- | ------------------------------------------------------------------------------------------------------------ | ------ | ----- |
| L1: SkillValidator   | 危险模式正则 + Python AST 语法 + 元数据完整性                                                                              | 确定性    | 无     |
| L2: SandboxValidator | AST 静态分析(eval/exec 拦截) + 子进程干跑 + 安全验证步骤执行                                                                    | 确定性    | 无     |
| L3: BatchEvaluator   | 3 维评分(accuracy 50% + anti-fragmentation 30% + redundancy 20%) + 长度惩罚 + 硬阈值熔断(score \< 0.6 拒绝) + 幻觉 import 检测 | AI 质量关 | 无     |
| L4: GUI 审批           | 完整审批生命周期(approve/reject/revise/rollback) + 简洁/详细双视图 + 内置 Diff 编辑器                                            | 用户控制   | 仅 CLI |
| L5: A/B 测试           | 影子测试(采样+worker pool+重试) + 95%阈值自动晋升 + 延迟比率限制                                                                 | 实证验证   | 无     |

**核心洞察**：绝大多数技能是 Markdown SOP 提示词（如"审查代码时按以下步骤..."），无法为提示词编写确定性测试用例——我方 5 层管线通过互补验证类型优雅解决了这一问题。**3,519 项测试验证。**

### 进化透明化 — 6 个 GUI 面板 vs 平文本文件

竞品提案建议将 DB 记录同步到技能目录下的 `HISTORY.md` 文件以实现"透明化"。Myrm 提供 **6 个专用 GUI 面板**，其丰富交互性让平文本文件显得过时：

| 面板                          | 展示内容                                                                                                     | 竞品            |
| --------------------------- | -------------------------------------------------------------------------------------------------------- | ------------- |
| SkillHistoryPanel           | 进化记录 + Monaco DiffEditor + 状态徽章(approved/rejected/rolled\_back) + 一键回滚                                   | HISTORY.md 文件 |
| EvolutionRejectionDashboard | 7 种状态分类 + 统计卡片 + 时间范围筛选(7/30/90/180天) + SSE 实时推送 + 强制重试                                                  | 无             |
| PendingEvolutionsDashboard  | 简洁/详细双视图 + SQL 精确 stats/筛选徽章 + lazy detail + 列表 scope 提示 + approve/reject/revise 生命周期 + localStorage 持久化 | 无             |
| SkillGrowthCaseCard         | 单个提案卡片 + Monaco DiffEditor 就地编辑 + 拒绝理由输入                                                                 | 无             |
| SkillVersionsPanel          | 版本列表 + 跨版本对比(任意 v1 vs v2) + 回滚确认                                                                         | 无             |
| SkillQualityGuardian        | A/B 测试状态 + 影子样本 + 质量指标                                                                                   | 无             |

**负例记忆**：3 张 DB 表（`evolution_constraints` + `evolution_rejections` + `execution_analyses`）自动从失败中学习。引擎通过 `get_evolution_constraints()` 将历史约束注入变体生成提示词，防止重复犯错——完全自动的闭环系统，用户零维护。**新增 332 项测试验证。**

### 有界编辑控制 — 6 层软约束 vs 硬熔断

竞品提案强制实施"最多 1 个变更点"的硬熔断规则。这在根本上是有缺陷的：一个 bug 修复通常合理地涉及 2-3 个相关节，且 Markdown 没有可靠的 AST 来计数"变更点"。Myrm 使用 **6 层软约束** 在不设人为限制的情况下保证修复质量：

| 层级                             | 机制                         | 效果                        |
| ------------------------------ | -------------------------- | ------------------------- |
| L1: `_CONSERVATIVE_EDITING`    | LLM 提示词中的 4 条编辑规则          | 保留标题、成功部分不动、优先收紧而非新增      |
| L2: `_HARD_CONSTRAINTS`        | LLM 提示词中的 6 条禁令            | 禁止重写、禁改 API 契约、禁加通用建议     |
| L3: `_FAILURE_ATTRIBUTION`     | 3 分类根因分析                   | 仅针对技能问题编辑，Agent/环境问题不膨胀技能 |
| L4: `length_penalty`           | 超 120% 起罚分，200% 达 40% 最大罚分 | 量化膨胀控制，不阻止合理添加            |
| L5: `anti_fragmentation_score` | AI 评分 30% 权重               | 防范围蜘宛和硬编码                 |
| L6: `redundancy_score`         | AI 评分 20% 权重               | 防冗余逻辑和废话                  |

配合硬阈值拒绝（score \< 0.6 或 accuracy \< 0.7 自动拒绝），实现有界编辑同时不牺牲修复完整性。Monaco DiffEditor 提供行级红/绿变更高亮——比竞品的"高亮单个节"更精确。**1783 项测试验证。**

### 框架驱动引擎 — Python 框架 + 5 层定制 vs 纯 Prompt 文件

部分竞品完全通过可编辑的 Markdown 提示文件（如 `reflect.skill.md`、`edit.skill.md`）驱动技能进化。表面灵活，实则脆弱——改错一行整条管线崩溃，SaaS 部署不可用，且存在双源真相冲突。

Myrm 使用 **Python 框架引擎** 搭配 7 个硬编码安全提示模块，结合 **5 层结构化定制体系**：

| 层级       | 机制                          | 控制范围                |
| -------- | --------------------------- | ------------------- |
| L1: 策略级  | `evolution_strategy`（4 种模式） | 控制允许哪些进化类型——UI 一键切换 |
| L2: 技能级锁 | `evolution_lock`            | 保护指定技能不被自动进化覆盖      |
| L3: 陷阱注入 | 每技能 `traps`                 | 领域特定警告注入到 LLM 提示中   |
| L4: 约束学习 | `evolution_constraints`     | 系统自动积累拒绝原因——越用越聪明   |
| L5: 偏好嵌入 | `_PREFERENCE_EMBEDDING`     | 用户风格/格式偏好从挫败信号中自动学习 |

为用户提供**结构化、安全的定制**，无需冒险编辑原始提示文件。Local、Tauri、SaaS 三端体验完全一致——无文件系统依赖。**1923 项测试验证。**

### 进化可视化 — 9 面板全生命周期 vs 仅命令行

部分竞品完全依赖 Cron 和命令行输出监控技能进化。Myrm 提供 **9 个独立可视化面板** 覆盖进化全生命周期：

| 面板            | 展示内容                                   |
| ------------- | -------------------------------------- |
| 待审提案仪表盘       | 所有等待审批的提案——简洁或详细视图                     |
| 成长案例卡         | 每个提案配 Monaco DiffEditor——就地审查、编辑、审批    |
| 拒绝审计仪表盘       | 提案被拒原因、系统学到了什么                         |
| 历史面板          | 已处理进化记录 + 一键回滚                         |
| 版本面板          | 完整版本历史 + 并排 Diff 对比                    |
| 质量守卫          | Shadow A/B 测试——新技能先影子测试再上线             |
| 成长仪表盘         | KPI 卡片 + GitHub 风格活跃度热力图 + 健康雷达图 + 周统计 |
| 每日日志          | 逐日时间线：会话、审批、Cron、看板等                   |
| 每日战报          | AI 生成的自然语言日总结 + 关键词 + 明日建议             |
| WebSocket 实时流 | 新提案即时推送通知                              |

无需解析命令行输出，无需翻看日志文件。一切可视化、可交互、可操作。**2062 项测试验证。**

### 跨 Skill 全局规则 — 三层有机学习体系 vs 自动写入 AGENTS.md

部分竞品提案在检测到跨 Skill 共性失败模式时，自动向 `AGENTS.md` 或系统 Prompt 注入全局规则。这种做法**在架构层面十分危险**：修改用户手动维护的工作区文件、制造双源冲突、破坏 Prompt Cache 效率。

Myrm 采用**三层有机学习体系**安全地实现同一目标：

| 层级                   | 机制                                   | 功能                                         |
| -------------------- | ------------------------------------ | ------------------------------------------ |
| Per-Skill 约束         | `evolution_constraints` + `traps`    | 每个技能独立积累历史教训，自动注入进化提示词                     |
| Memory Learned Rules | `ProceduralMemory`（trigger → action） | 全局规则通过对话自然沉淀，支持 CRITICAL/HIGH/NORMAL 三级优先级 |
| Workspace Rules      | 只读扫描 AGENTS.md + 14 种规则文件格式          | 尊重用户编写的规则，绝不修改                             |

相比自动写入方案的关键优势：

* **安全**：不修改用户文件或系统 Prompt——Learned Rules 通过 MemoryContextMiddleware 流动
* **缓存友好**：Learned Rules 放在 HumanMessage 位置，不破坏 System Prompt 的 KV Cache
* **精确作用域**：规则可设为全局或工具级（`tool_name` 字段），不是一刀切的全局注入
* **安全防护**：所有学习数据经过 `sanitize()` + `wrap_untrusted()` 安全边界标记
* **三端通用**：Local、Tauri、SaaS 体验完全一致——无文件系统依赖

**324 项测试验证**，覆盖证据聚合、工作区规则、记忆中间件和 Server 集成。

### 从 Hermes 迁移（技能系统）

| Hermes Skill Feature               | Myrm Equivalent                                                                                                 | 体验                                |
| ---------------------------------- | --------------------------------------------------------------------------------------------------------------- | --------------------------------- |
| `/skill-name` manual activation    | Slash command auto-injection                                                                                    | ⬆️ Upgrade                        |
| `[Skill config: key=value]` config | JSON Schema form + env\_overrides                                                                               | ⬆️ Upgrade (secrets safe)         |
| `skills_guard` security scan       | 6-layer defense: quarantine + 26-category/113-pattern scan + AST + LLM audit + trust attenuation + GUI approval | ⬆️ Upgrade                        |
| `INSTALL_POLICY` matrix            | Dynamic SkillTrustRecommendation (532 tests)                                                                    | ⬆️ Upgrade                        |
| `lock.json` provenance             | origin.json + DB-backed trust + version history                                                                 | ⬆️ Upgrade                        |
| `curator --dry-run` CLI            | GUI Curator panel with preview                                                                                  | ⬆️ Upgrade                        |
| `skill_provenance` ContextVar      | pinned + evolution\_locked + non-destructive archive                                                            | ⬆️ Upgrade                        |
| 176 skills (quantity)              | 28 precision skills (quality + structured contracts)                                                            | ↔️ Tradeoff (quality vs quantity) |

**结论：7 项升级、1 项权衡、0 项降级。用户获得智能安全、安全配置管理与有序技能生命周期，零能力损失。**

## vs MiniMax Mavis — 多 Agent 团队平台

MiniMax Mavis 是闭源 SaaS 多 Agent 系统，采用 Leader-Worker-Verifier 架构，仅通过飞书（Lark）集成提供。

### Mavis 做得好的地方

* **Leader-Worker-Verifier 模式** — 规划、执行、验证角色清晰分离
* **IM 原生体验** — 飞书聊天内直接多 Agent 协作
* **「即时回复」+ 后台执行** — 立即确认用户，任务异步运行
* **Worker 间上下文隔离** — 各 Worker 独立运行

### Myrm 的领先之处

| 领域                  | MiniMax Mavis                           | Myrm                                                                                                                                                                                                                | 用户收益                                                      |
| ------------------- | --------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | --------------------------------------------------------- |
| Orchestration       | Leader LLM dispatches tasks             | **8 deterministic modes** (Spawn/Chain/Batch/DAG/Verified/Swarm Fission/Alternatives Race/Council Debate)                                                                                                           | Structured scheduling, not dependent on LLM improvisation |
| DAG Dependencies    | ❌ None                                  | ✅ Dependency graph + cycle detection + concurrency limits                                                                                                                                                           | Complex tasks auto-resolve execution order                |
| Verification        | Text-based review                       | **Physical evidence enforcement** — must provide STDOUT/STDERR execution logs; claiming PASS without evidence is forced to FAIL                                                                                     | No rubber-stamp reviews                                   |
| Tool Isolation      | Not disclosed                           | **5-layer isolation** (type admission → global blocklist → per-config → parent-child intersection → role control)                                                                                                   | Sub-agents cannot escalate privileges                     |
| Budget Control      | Token Plan (commercial tier)            | **4-dimension control** (Token + USD + time + max descendants)                                                                                                                                                      | Precise cost management, not plan-tier anxiety            |
| Model Freedom       | Locked to MiniMax models                | **100+ 模型** 三种兼容协议(OpenAI/Gemini/Anthropic-like)无极接入 + models.dev 实时模型发现 + 多密钥轮换 + 2M Token 超大上下文全链路 + API 方言自动转换 + 原生思考模型支持（6 级强度 + 思考面板）+ 双层 Schema Normalizer（Myrm 通用层 + LiteLLM per-provider 层，50 项单测）— 538 项测试 | 零供应商锁定，切换任意模型工具零报错                                        |
| Channels            | Lark only                               | **35+ channels** (WeChat/DingTalk/Slack/Telegram/Discord/Email...)                                                                                                                                                  | Not limited to one platform                               |
| Deployment          | Closed-source SaaS only                 | **Web + Tauri + SaaS** (MIT open source)                                                                                                                                                                            | Full data sovereignty                                     |
| Skill Evolution     | Basic "learned something" memory update | **49-module native system** with A/B testing + GUI approval + 5-layer safety + Enterprise Marketplace (1,110 tests)                                                                                                 | True self-improvement vs simple memory                    |
| Checkpoint Recovery | Not mentioned                           | ✅ Checkpointer saves stage-by-stage state                                                                                                                                                                           | Long tasks survive crashes                                |
| Cost Efficiency     | Users report "tokens are burning"       | DelegationBudget + intelligent routing saves 60-80%                                                                                                                                                                 | Zero cost anxiety                                         |
| Auditability        | Closed-source, not auditable            | MIT open source + 48 EventKind streaming trail + 37 SecurityDecision audit types                                                                                                                                    | Enterprise compliance                                     |

### 从 Mavis 迁移到 Myrm

| Mavis Feature              | Myrm Equivalent                                                                                 | 体验                                      |
| -------------------------- | ----------------------------------------------------------------------------------------------- | --------------------------------------- |
| Leader-Worker-Verifier     | DAG + Verification orchestration mode                                                           | ⬆️ Upgrade (8 modes vs 1)               |
| IM multi-task parallel     | WebUI multi-session + Goal continuation                                                         | ↔️ Equivalent (different design)        |
| Verifier adversarial check | `_enforce_evidence` + ReadonlySandbox                                                           | ⬆️ Upgrade (physical evidence required) |
| Plan → Approve → Execute   | 主 Agent `todo_write` + Goal approval workflow                                                   | ⬆️ Upgrade (7-state lifecycle)          |
| "Learned something"        | 42-module Skill Evolution system                                                                | ⬆️ Upgrade (full evolution pipeline)    |
| Lark integration           | 35+ channel support (including Lark)                                                            | ⬆️ Upgrade                              |
| Worker 上下文隔离               | **四层写入防护**：行级冲突检测 + CoW 工作区隔离 + git worktree + 串行批量合并 + 三层沙箱（毫秒级启动，无需Docker）— 1,101 项子代理与沙箱专项测试 | ⬆️ 工业级升级                                |
| Token display              | 4D budget + real-time tracking + alerts                                                         | ⬆️ Upgrade                              |

**结论：7 项升级、1 项持平、0 项降级。用户获得开源数据主权、模型自由与多平台接入，零能力损失。**

## vs Claude Code — Fork 子 Agent 与 Prompt Cache

Claude Code 采用「Fork 子 Agent」设计，字节级 prompt 前缀对齐以复用 KV Cache，子 Agent 成本最高可降 90%。

### Myrm 的领先之处

| 领域                        | Claude Code                              | Myrm                                                                                                                          | 用户收益                                      |
| ------------------------- | ---------------------------------------- | ----------------------------------------------------------------------------------------------------------------------------- | ----------------------------------------- |
| Prompt Cache Architecture | 1 strategy (prefix alignment)            | **6-layer system** (tool layering → system freeze → explicit breakpoints → cache-friendly compression → pipeline → LLM layer) | Comprehensive caching, not just alignment |
| Fork Context Reuse        | Empty system prompt (loses cache prefix) | **Full prefix reuse** (`context_mode="fork"`) → 100% Prefix Cache Hit + **结论性过滤**（fork Token 降低 60-80%）                       | 更高缓存命中率，成本大幅降低                            |
| Cache Breakpoints         | None                                     | **4 strategies** (after system / every 15 blocks / after compression / last message)                                          | Anthropic best-practice coverage          |
| Cache Break Detection     | ❌ None                                   | **2-phase attribution** with 5 root causes (system/tools/model/TTL/eviction)                                                  | Quickly diagnose why cache dropped        |
| Anti-Thrashing            | ❌ None                                   | ✅ Prevents compression from repeatedly invalidating cache                                                                     | Stable caching in long sessions           |
| Resume-Aware Cache        | ❌ None                                   | ✅ Preserves cache prefix on session resume (90% savings in resume scenarios)                                                  | Cost-efficient session continuity         |
| Multi-Provider Cache      | Anthropic only                           | **5+ providers** (Anthropic + Qwen + OpenAI + DeepSeek + Gemini)                                                              | Zero vendor lock-in                       |
| Sub-Agent Tool Control    | All-or-nothing (Fork = no tools)         | **5-layer isolation** (type → blocklist → per-config → parent-child → role)                                                   | Fine-grained per-tool control             |
| Cost Budget               | None                                     | **4-dimension** (Token + USD + time + descendants)                                                                            | Precise cost management                   |
| Observability             | CLI text                                 | **NDJSON metrics + Cache Metrics Collector + 5-level monitoring**                                                             | Full-stack cache visibility               |

### 从 Claude Code 迁移到 Myrm

| Claude Code Feature               | Myrm Equivalent                                                                                       | 体验                                         |
| --------------------------------- | ----------------------------------------------------------------------------------------------------- | ------------------------------------------ |
| Fork Subagent (lightweight child) | `context_mode="fork"` with prefix reuse                                                               | ⬆️ Upgrade (100% cache hit vs lost prefix) |
| Prompt Cache prefix alignment     | 6-layer Prompt Cache system                                                                           | ⬆️ Upgrade (6 layers vs 1 strategy)        |
| Agent Team (parallel agents)      | 8 orchestration modes (Spawn/Chain/Batch/DAG/Verified/Swarm Fission/Alternatives Race/Council Debate) | ⬆️ Upgrade                                 |
| sendTask message passing          | P2P Mailbox + AgentHandoverState                                                                      | ⬆️ Upgrade (structured handover)           |
| CLI interface                     | Web GUI + Tauri Desktop + SaaS                                                                        | ⬆️ Upgrade                                 |
| Anthropic-only models             | 100+ models with intelligent routing                                                                  | ⬆️ Upgrade                                 |

**结论：6 项升级、0 项持平、0 项降级。Myrm 缓存经济性更强，具备 Claude Code 完全缺失的三项能力（断裂检测、防抖动、Resume 感知）。**

### Claude Code 2.1.154\~2.1.157 Harness 升级

随 Opus 4.8，Claude Code 推出 `/effort`（6 级推理预算）、Dynamic Workflows、精简 system prompt 与增强 `--resume`。Myrm 对比如下：

| Feature                    | Claude Code                                               | Myrm                                                                                                                                                                                              | 结果                                   |
| -------------------------- | --------------------------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ------------------------------------ |
| Reasoning budget control   | `/effort` 6 levels (manual)                               | `complexity_router` 3-tier auto-routing + PenaltyTracker                                                                                                                                          | ⬆️ Smarter (auto vs manual)          |
| Workflow orchestration     | Dynamic Workflows (unpredictable LLM JS, keyword trigger) | 8 deterministic modes + manual Dynamic Workflow (Python PTC + SQLite event sourcing)                                                                                                              | ⬆️ Dual-path: safe DW + richer modes |
| System prompt optimization | lean system prompt                                        | 6-layer Prompt Cache + TaskAdaptiveMiddleware                                                                                                                                                     | ⬆️ Complete cache engineering        |
| Autonomous execution       | "Ask fewer questions"                                     | Goal 7-state machine + auto\_approve + continuation guard                                                                                                                                         | ⬆️ Systematic                        |
| Skill system               | .claude/skills directory scan                             | 42-module Skill system + 6 discovery sources + evolution                                                                                                                                          | ⬆️ Full evolution ecosystem          |
| Agent configuration        | CLI-based agent config                                    | 24 预设 + 10 YAML 模板 + 5-Tab GUI（Monaco SmartPromptEditor + AI 生成 + 17 种人格 + 含 3 层 fallback + Context Window Badge + 参考成本展示的模型选择器 + 6 项引擎参数）+ DB 存储 + TimeMachine 回滚 + **Org Marketplace**（562 项测试） | ⬆️ 全可视化构建器                           |
| Code isolation             | EnterWorktree                                             | WorkspacePolicy (INHERIT/ISOLATED\_COPY/READ\_ONLY\_SANDBOX) + GUI 配置                                                                                                                             | ⬆️ 3 策略 + 可视化                        |
| Task resumption            | `--resume` CLI flag                                       | 5 层上下文持久化 (SessionNotes + ContextSnapshot + GoalStorage + SubagentCheckpoint + ArchiveCheckpoint) + OrphanRecovery + StreamRecovery + workspace\_isolation 3 策略 COW + batch\_merge — 501 项测试验证    | ⬆️ Complete recovery                 |
| Cost control               | Manual effort selection                                   | Auto-routing + GoalBudget + DelegationBudget + token\_economics                                                                                                                                   | ⬆️ Automated                         |
| Model support              | Claude-only                                               | 100+ models with intelligent routing                                                                                                                                                              | ⬆️ Model freedom                     |

**结论：10 项升级、0 项持平、0 项降级。**

### 动态工作流 — 真实痛点

基于 Claude Code Dynamic Workflows 用户反馈（2026-05 数据）：

| User-Reported Issue                                   | Root Cause                                               | Myrm Solution                                                                                                                                  |
| ----------------------------------------------------- | -------------------------------------------------------- | ---------------------------------------------------------------------------------------------------------------------------------------------- |
| "Planned 47 agents, only 25 actually ran"             | LLM-generated JS scripts are non-deterministic           | **DAG** for production; **Dynamic Workflow** replays completed sub-agents from SQLite cache on retry                                           |
| "Started with 10, ballooned to 82, burned all tokens" | No budget enforcement in runtime                         | **DelegationBudget** — 4D hard limits (Token+USD+time+descendants), impossible to overshoot                                                    |
| "8 万字 output lost content midway"                     | No checkpointing for long parallel runs                  | **Checkpointer** + OrphanRecovery + **WorkflowEventStore** — stage-by-stage persistence, crash-safe                                            |
| "Had to babysit for 5 hours"                          | No completion guard or auto-recovery                     | **CompletionGuard** + 429/503 auto-backoff + 7×24 unattended operation                                                                         |
| "Accidentally triggered workflow by keyword"          | Keyword-based trigger (mention "parallel" or "research") | **Manual WorkflowModeToggle** — opt-in only, auto-resets after send; zero keyword accidents                                                    |
| "Didn't know I could use workflow mode"               | No discoverability mechanism                             | **Workflow Escalation** — zero-LLM-cost detection proactively suggests workflow mode for complex decomposable tasks (non-blocking inline card) |
| "max 16 concurrency, max 1000 total agents"           | Fixed runtime limits                                     | **Configurable ConcurrencyLimiter** + TokenBucket — no hard ceiling                                                                            |
| "Cost is a black box until the end"                   | No real-time cost tracking                               | **SubagentDashboard** — Real-time `$0.001` precision cost visualization per node                                                               |
| "Approval requests get lost in long terminal logs"    | CLI-only, no visual anchors                              | **Visual HITL Approval** — One-click jump from Dashboard to Approval Card                                                                      |
| "Hard to review what the agent is doing"              | Raw JSON arguments in terminal                           | **Polymorphic Views** — Prism syntax-highlighted diffs with Unified/Split dual-view for code, terminal UI for shell                            |

**关键架构差异**：Claude Code DW 运行时生成带关键词触发的 JavaScript 编排脚本（非确定性，可失败或偏离）。Myrm **双路径**：生产负载用声明式 DAG（确定性、执行前可验证）；可选 **Dynamic Workflow**（手动开关、Python PTC 沙箱、确定性 `workflow_id`、SQLite 事件溯源实现子 Agent 幂等重放）用于临时并行脚本 — 均配 **一等 HITL GUI**。

**置信度分级摘要**：DW 汇总结果自动标注 4 级置信度 — ✅ 已验证（有执行证据）、⚠️ 未验证（仅 LLM 推理）、❌ 已反驳（被证据否定）、💥 失败（任务出错）。用户一眼区分可靠结论与 LLM 猜测。零竞品提供此能力。

## vs Scrapling & BrowserUse — 全自主混合浏览器引擎

典型 AI Agent 用 Playwright/Selenium 包装（如 BrowserUse）在动态页频繁崩溃；传统抓取框架（如 Scrapling）需开发者手写反爬代码。Myrm Agent 提供 **全自主混合浏览器引擎**。

### Scrapling & BrowserUse 做得好的地方

* **BrowserUse**: Wraps Playwright for LLMs to click elements, but relies on slow LLM reasoning every time a locator fails.
* **Scrapling**: Provides powerful stealth tools (`camoufox` / `curl_cffi` HTTP fetching) but requires developers to manually wire them into a crawler script.

### Myrm 的领先之处

| 领域                                              | Traditional Agents / Scrapers                                                 | Myrm Agent                                | 用户收益                                                                                                                                                                                                                      |
| ----------------------------------------------- | ----------------------------------------------------------------------------- | ----------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| **Self-Healing Locators & Shadow DOM Piercing** | Wait 30s for LLM to rethink after DOM changes, completely blind to Shadow DOM | **O(1) Millisecond Healing Engine**       | Agent instantly recovers from dynamic DOM/React changes using absolute BBox + ARIA implicit mapping + Semantic Veto. Fully pierces Shadow DOM and uses strict W3C CSS whitelists for zero data-pollution. Zero LLM delay. |
| **Native Spatial Engine**                       | Fails on dynamic layouts, slow Python-level bounding box calculations         | **Direct C++ Layout Selectors**           | Zero-latency, highly accurate element targeting based on visual layout (e.g. "right-of", "below") seamlessly native to the rendering engine, with 0 LLM hallucination risk.                                               |
| **Render Engine Degradation**                   | Heavy Chromium renders everything                                             | **Autonomous Hybrid Engine**              | Detects static pages and injects HTTP pre-fetch via `page.route` — skipping JS/CSS load. **90% faster and lighter.**                                                                                                      |
| **Anti-Bot Evasion**                            | Fails at Cloudflare (BrowserUse) / Manual config (Scrapling)                  | **Dual Stealth Hot-Swap + Domain Memory** | Seamlessly escalates HTTP → Patchright → Camoufox when challenged, and remembers which domains need stealth — repeat visits skip the probe cycle and load 5–8 s faster.                                                   |
| **Proxy Pool Rotation**                         | Global network hooks cause cross-task pollution & lost login state            | **Zero-Network V8 Injection**             | Swaps IPs instantly while injecting local storage via V8 initialization. Perfect state inheritance with exponential backoff.                                                                                              |
| **Element Safety**                              | Blindly clicks overlapping elements                                           | **Semantic Veto**                         | Prevents mis-clicks using strict contextual checking (even in Chinese/English i18n).                                                                                                                                      |
| **API-First 网络智能**                              | 无网络可见性（BrowserUse 离线写 HAR）/ 仅 CLI dump（bb-browser）                            | **CDP 懒加载响应体 + 页面内重放**                    | Agent 实时看到所有 XHR/Fetch API，按需获取响应体（O(1)内存），带登录态重放请求——可提取 GraphQL/Canvas/SPA 中 DOM 看不到的数据。                                                                                                                                 |

### 迁移收益

从原生 Playwright 或其他 Agent 框架迁移的用户获得：

* **Zero-Crash UI Navigation**: End the frustration of "Element not found" errors ruining a 20-minute agent task.
* **Blazing Fast Data Retrieval**: Don't burn memory on full Chromium instances for simple text extraction; Myrm degrades to HTTP seamlessly.
* **Production Grade Reliability**: Auto-detects 10 CAPTCHA providers and solves them via CapSolver API with FallbackSolver chain (manual HITL takeover when needed). Passes Cloudflare invisibly.

### SubagentExecutor 可靠性（2026-07）

委派子 Agent 时，Myrm 专用 **SubagentExecutor** 处理用户可感知的边界情况：

| 领域             | 典型竞品（如 DeerFlow 单体） | Myrm                                                 | 用户收益            |
| -------------- | ------------------- | ---------------------------------------------------- | --------------- |
| 超大子 Agent 输出   | 截断或灌满主聊天            | **Auto Vault** 归档 + 摘要回注                             | 上下文不爆、Token 更省  |
| 取消父任务          | 子/孙任务可能继续跑          | **级联取消** 全后代                                         | 停止即真停、不再烧 Token |
| 不可信上游上下文       | 静默透传                | **Taint 传播** + 安全警告                                  | 独立验证信号清晰        |
| JIT 子 Agent 配置 | 字段易错/阈值丢失           | **`ephemeralSubagents` + auto\_vault\_threshold 物化** | GUI/测试/API 一致   |

**回归覆盖：** **10,838** 项编排全链路测试通过、0 失败（2026-07-11）：委派核心(97) + 锦标赛与验证(5) + spawn工具与安全注册(21) + sub\_agents全套含manager/executor/event/checkpoint/orphan recovery(603) + 并行与resume compact(5) + Kanban引擎全套(429) + streaming与stream\_recovery(637) + security全套含context\_budget/隔离/权限(1,761) + LLM toolkit含credential\_pool/路由/fallback(1,344) + context\_budget专项(60) + credential\_pool专项(36) + error\_classifier专项(175) + **Item #13\~15 验证(2,431)**：sub\_agents套件(603) + security套件(1,761) + multiplexer与thread\_sharing(27) + 前端Vitest SubagentDashboard+SubagentStore(17) + EventForwarder(12) + TeammateMailbox(11) + **Item #17 验证(105)**：consensus引擎(64) + council编排(25) + council集成(16) + consensus类型(8) + **Item #18\~19 验证(978)**：memory scope绑定(9) + ACP全套(386) + A2A resolver+SSRF(44) + MCP工具集全套(539) + **Item #20+Token预算验证(847)**：budget\_guard(59) + manager\_core(186) + context\_budget(71) + executor+delegation(165) + config+heartbeat(70) + stream+lifecycle(121) + token\_control+memory+loop\_guard(175) + **Item #32+#36 验证(230)**：dynamic\_workflow引擎(64) + DW\_e2e(9) + pipeline+模板(47) + orchestrator+swarm(99) + swarm\_fission+marketplace(11)。

### 核心 Preset 工具可用性 — SCIP Phase 0+1（2026-07）

修复 **silent dead delegate**：browser/analysis 子代理 preset 引用过期工具名 → `filter_tools()` 得 **0 工具** → 父 Agent 误以为委派成功。

| 层级           | 改动                                                                                                               | 用户收益                                   |
| ------------ | ---------------------------------------------------------------------------------------------------------------- | -------------------------------------- |
| Harness YAML | `browser` / `analysis` preset 对齐 `_TOOL_LAYERS` canonical 工具名                                                    | 委派 catalog 开箱可用                        |
| Harness 运行时  | `config_loader` SSOT 校验 + `executor_attempt_mixin` 对空 allowlist **硬失败**                                          | 结构化错误，杜绝空转子代理                          |
| Server       | 开启 Browser 时自动绑定 **外围** `browser-automation` skill（`is_core: false`），经 `AgentFactory` 覆盖 Web/Cron/Channel/Kanban | 操作 loop 指引不污染 Prefix Cache 核心段         |
| WebUI        | Browser 开关旁 delegate 提示（中/英）                                                                                     | 用户发现 `@browser` / `delegate_task` 委派路径 |
| Server L3    | `build_parent_delegatable_toolkit()` 合并 session 级 `browser_*_tool`（修复 `Not in parent toolkit`）                   | WebUI 开 Browser 后委派子代理 **立即可用**        |

**诚实竞品说明：** OpenClaw、Hermes 已支持浏览器委派；Myrm 额外提供 **preset SSOT fail-fast**、**cache-safe 外围 skill 绑定** 与 **L3 父工具集 session 合并**，避免生产环境 silent no-op 与「开了 Browser 仍委派失败」。

**SCIP 测试包：** **65 passed, 1 skipped**（harness preset/护栏 + server binding/spawn smoke + 前端 hint vitest，2026-07）· **API Live E2E** `example_domain_seen` \~6.5s（`mimo-v2.5-pro`，2026-07-08）。

## 凭证库 — 密码与 2FA 永不进入 LLM

多数框架在自动化登录时的默认模式是灾难性的：模型生成密码字符串并通过 `type`/`fill` 工具参数传递，该值残留在聊天历史、MCP 日志与重试缓冲区。

Myrm **表单凭证库** 将「知道凭证」与「使用凭证」分离：

| Layer           | What happens                                                                        |
| --------------- | ----------------------------------------------------------------------------------- |
| **You**         | Configure labels in Settings → Credentials (password + optional TOTP seed)          |
| **Agent / LLM** | Sees label names only; calls `fill_credential` (unified for browser and desktop)    |
| **Harness**     | Decrypts in memory, injects at DOM or OS layer — plaintext never returns to context |

### Myrm 的领先之处

| 领域                             | Hermes / OpenClaw        | FSB (Chrome extension)  | Myrm                                       | 用户收益                                                |
| ------------------------------ | ------------------------ | ----------------------- | ------------------------------------------ | --------------------------------------------------- |
| **Vault boundary**             | ❌ Plaintext in tool args | ✅ Browser DOM injection | ✅ Browser + desktop                        | Login automation without password in chat           |
| **TOTP / 2FA**                 | ❌ Manual                 | ❌ Not documented        | ✅ Built-in RFC 6238                        | Agent completes 2FA without you reading codes       |
| **Management UI**              | ❌ Env vars / chat        | Extension popup         | ✅ WebUI Settings panel                     | One place for all automation credentials            |
| **Security stack integration** | ⚠️ Post-hoc patches      | Standalone extension    | ✅ 6-layer defense + leak detection + audit | Vault is part of enterprise security, not a bolt-on |

### 与 FSB 的诚实对比

FSB 首创浏览器自动化的库边界模式（标签引用 → 扩展解密 → DOM 填充）。Myrm 采用 **相同安全原则**，并扩展到 **桌面 Computer Use**、**原生 TOTP** 与 **统一产品 GUI** — 无需独立 Chrome 扩展。FSB 在支付卡 API（`use_payment_method`）仍领先；Myrm 今日覆盖密码字段与 2FA。

### 迁移收益

* **从 Hermes / OpenClaw**：别再往提示词里贴密码；在设置中配置一次即可。
* **从 FSB**：相同心智模型（标签），外加桌面应用与 TOTP，同一工作区。
* **企业场景**：凭证库 + 12 维权限 + 结构化审计（37 种决策类型 + Prometheus 指标）+ 无痕会话跑敏感任务。

## MCP 安全门 — 启用前先知风险

第三方 MCP 服务器攻击面日益扩大：投毒工具描述、敏感路径访问、运行时工具注入可在对话中途危及 Agent。

Myrm 在 MCP **进入工作区之前** 设门：

| Stage             | What Myrm does                                                            | What you see                      | Typical competitors       |
| ----------------- | ------------------------------------------------------------------------- | --------------------------------- | ------------------------- |
| **Edit**          | Debounced static scan (\~0.03ms)                                          | Amber risk list (EN/ZH)           | No GUI pre-check          |
| **Save / enable** | High-risk requires ack + 4-step verify (static → OSV → connect → runtime) | Clear block or confirmed enable   | Hermes: log only          |
| **Runtime**       | Harness fail-closed disconnect                                            | Poisoned MCP never joins the chat | OpenClaw: env filter only |

**诚实范围**：完整 102-hook 静态规则包在 roadmap — 本门控覆盖真实用户路径（设置 → 启用 → 聊天）。回归：harness + server API 测试（21+ 用例）。

### 迁移收益

* **从 Hermes**：别只在日志里发现坏 MCP — 先在设置中拦截或确认。
* **从 OpenClaw**：环境过滤不够；要启用前扫描 + 运行时断开。

## MCP 协议架构 — 持久连接、事件驱动、缓存友好

Myrm 的 MCP 实现采用持久热连接与事件驱动的工具发现机制 — 而非竞品使用的冷启动重连模式。

| 领域                  | Hermes / OpenClaw | Myrm                                                                     | 用户收益                       |
| ------------------- | ----------------- | ------------------------------------------------------------------------ | -------------------------- |
| **连接模型**            | 每次请求冷启动或会话级       | **持久热连接**（MCPSessionActor）                                               | 零重连延迟；工具即时可用               |
| **客户端身份**           | 默认 "mcp" 笼统标识     | **产品级标识** `myrm-agent` + 版本号                                             | 服务端日志可精准定位连接来源             |
| **工具发现**            | 每次调用时轮询或固定列表      | **事件驱动**（`list_changed` 通知）                                              | 无浪费；始终最新                   |
| **Prompt Cache 影响** | 工具列表每次重连变化 → 缓存失效 | **冻结代理工具**（稳定 Token 指纹）                                                  | 最高可保留 90% Prompt Cache 命中率 |
| **自愈能力**            | 断线需手动重启           | **自动重连 + 工具刷新**                                                          | 无人值守任务可承受网络抖动              |
| **多模态结果**           | 仅文本透传             | **结构化内容规范化**（图像、JSON、注解）+ 9 种多态 UI 渲染器 + 大输出 Eviction Drawer（搜索/Copy/分页） | LLM 获得丰富上下文；用户看到精美可交互的输出   |
| **状态处理**            | 需自定义 Handle 中间件   | **原生 Handle 透传**（不透明 ID 自然流经工具结果）                                        | 有状态 MCP 服务器开箱即用            |

**成本影响**：每次竞品重连 MCP 服务器，工具列表在 Prompt 中的 Token 位置变化，导致 LLM Prompt Cache 失效。启用 10+ MCP 服务器时，这可能带来每小时 **$0.50–$2.00** 的额外缓存未命中开销。Myrm 的冻结代理方案使工具区段在各轮对话中字节稳定。

### 迁移收益

* **从 Hermes**：不再出现空闲超时后的「tool not found」错误 — 持久连接保持热状态。
* **从 OpenClaw**：不再为每次重连造成的工具列表抖动而支付 Prompt Cache 失效的代价。

## Shell 命令可视化审批 — 允许前看清每条管道

Agent 执行 `curl … | bash` 时，单行等宽字体隐藏了哪段下载、哪段执行。

Myrm **Shell 命令展示** 将管道拆为带逐段风险着色的 span — 与 OpenClaw 用户心智模型一致，默认开启并接入六层安全栈。

| 领域                    | OpenClaw                                  | Hermes                | Myrm                                               | User benefit                               |
| --------------------- | ----------------------------------------- | --------------------- | -------------------------------------------------- | ------------------------------------------ |
| **Pipe breakdown**    | tree-sitter explainer (not on by default) | Whole-line allow/deny | **On by default**, same source as redacted display | Know which segment is dangerous            |
| **Risk coloring**     | ❌                                         | ❌                     | ✅ Per-span levels                                  | Red/yellow/green at a glance               |
| **Secrets in UI**     | Basic                                     | Basic                 | **Redact first, then spans**                       | API keys never in approval text            |
| **Edit escalation**   | ❌                                         | ❌                     | **Block edits that change UNKNOWN-risk commands**  | Can't "tweak wording" into a worse command |
| **Sub-agent cards**   | ❌                                         | ❌                     | ✅ Spans flow to delegate approvals                 | Same clarity for spawned workers           |
| **Workspace context** | ❌                                         | ❌                     | ✅ Shows workspace root (EN/ZH)                     | Know where the shell runs                  |

**诚实限制**：超长命令在界面会提示截断。本地使用需同时启动前后端；只开界面时会看到明确启动指引，而不是难懂的报错。

### 迁移收益

* **从 OpenClaw**：熟悉的分段 shell 视图 — 外加 12 维权限、泄漏检测与结构化审计追踪。
* **从 Hermes / Claude Code**：别盲批单行命令 — 一键前看清管道段与风险。

## vs MemPalace — AI 记忆系统（14.9K+ Stars）

MemPalace 是独立 AI 记忆系统，用 Wing/Room/Closet/Drawer 建筑隐喻，奉行「逐字存储一切」，LongMemEval 达 96.6% R\@5。作为 MCP 工具供外部 AI 助手调用。

### MemPalace 做得好的地方

* **Verbatim storage** — stores raw conversations without lossy summarization
* **Architectural organization** — Wing/Room/Closet/Drawer hierarchy gives AI a "navigation map"
* **4-layer memory stack** — L0 identity (\~50 tokens) through L3 deep search, keeping wake-up cost under 900 tokens
* **Multi-format ingestion** — normalizes Claude, ChatGPT, Codex, Gemini, Slack exports into a unified format
* **Local-first** — runs entirely on your machine with ChromaDB, zero cloud API calls

### Myrm 的领先之处

| 领域                         | MemPalace                                     | Myrm                                                                                                                                                          | 用户收益                                                                          |
| -------------------------- | --------------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------- | ----------------------------------------------------------------------------- |
| Memory Types               | 1 flat type (drawer)                          | **8 structured types** (Profile/Semantic/Episodic/Procedural/Conversation/Claim/TaskDigest/Integration)                                                       | AI understands "this is a fact" vs "this is a preference" vs "this is a rule" |
| Verbatim Storage           | ChromaDB single vector                        | **Dual-track** (raw\_exchange + summary) with **dual embedding**                                                                                              | Both precise recall and fast overview                                         |
| Deduplication              | Single-layer vector similarity                | **3-layer smart dedup** (Hash → Vector → LLM) with UPDATE\_REPLACE/UPDATE\_MERGE/NEW                                                                          | No duplicate memories, intelligent merging                                    |
| Forgetting                 | None (memories only grow)                     | **双层智能遗忘**：5维保留分（零LLM成本）+ LLM过期审查（每条记忆独立TTL、严重度排序、batch限制、KEEP冷却期）含4层保护（钉选/纠正链/近期活跃/最小候选数）                                                                    | 记忆保持精简且关键知识不丢失                                                                |
| Knowledge Graph            | Basic halls/tunnels co-occurrence             | **GraphStore + CTE** with visual exploration                                                                                                                  | Rich relationship mapping                                                     |
| Contradiction Detection    | Rule-based name/relationship check            | **LLM-powered ClaimGraph** + cognitive subsumption                                                                                                            | Catches subtle contradictions                                                 |
| Search                     | BM25 + Vector hybrid                          | **FTS5 + Qdrant** hybrid (FTS5 has built-in BM25)                                                                                                             | Production-grade search infrastructure                                        |
| Fact Correction            | ❌ Direct overwrite (history lost)             | ✅ **correct()** — demotes old memory (0.3x weight) + creates high-confidence correction (0.95) linked to original                                             | Wrong memories don't pollute — corrections automatically win in retrieval     |
| User Feedback Rating       | ❌ None                                        | ✅ **rate\_memory** — asymmetric EMA (negative feedback decays faster) auto-adjusts retrieval ranking                                                          | Helpful memories float to top, bad ones sink — no manual curation needed      |
| User Lock                  | ❌ pin blocks delete only, not edit/patch      | ✅ **is\_user\_locked** — Agent cannot overwrite user-edited memories                                                                                          | Your manual edits are safe from AI overwriting                                |
| GUI Management             | ❌ CLI only                                    | ✅ **Full GUI panel** — browse, edit, approve, pin, delete memories                                                                                            | Visual memory management                                                      |
| Pitfalls Extraction        | ⚠️ Markdown `## Pitfalls` section in SKILL.md | ✅ **Structured Gotchas** — auto-extracted as DB records with `source_error` field + `FeedbackSignal` auto-detection (bilingual) + visual amber warning in GUI | Mistakes become searchable, structured knowledge — not buried text            |
| Multi-Agent Rule Isolation | ❌ No `agent_id` — all rules globally shared   | ✅ **6-dimension MemoryScope** (agent\_id + namespace + channel + conversation + task\_id)                                                                     | Different agents' rules never pollute each other                              |
| Memory Safety              | ❌ None                                        | ✅ **Scanner + sanitizer** with real-time security events                                                                                                      | Prevent memory poisoning                                                      |
| Health Diagnostics         | ❌ None                                        | ✅ **Benchmark testing** (Recall\@K, NDCG, MRR, Precision)                                                                                                     | Quantified memory quality                                                     |
| Preference Tracking        | ❌ None                                        | ✅ **Stability scoring** with visual trend cards                                                                                                               | Track how preferences evolve                                                  |
| Backup & Restore           | Manual SQLite copy                            | ✅ **Structured backup/restore** protocol                                                                                                                      | Data safety built-in                                                          |
| Platform                   | Memory library only                           | **Complete AI Agent platform** (100+ tools, 35+ channels, Sub-Agent, Goals)                                                                                   | Memory is part of a full workspace                                            |
| Data Storage               | ChromaDB (known HNSW corruption issues)       | **Qdrant + SQLite** (production-grade)                                                                                                                        | No manual HNSW repair needed                                                  |

### 从 MemPalace 迁移到 Myrm

| MemPalace Feature               | Myrm Equivalent                                      | 体验                              |
| ------------------------------- | ---------------------------------------------------- | ------------------------------- |
| Verbatim drawer storage         | ConversationMemory.raw\_exchange (dual-track)        | ⬆️ Upgrade (raw + summary)      |
| Wing/Room/Closet hierarchy      | 8 memory types + GraphStore knowledge graph          | ⬆️ Upgrade (typed + relational) |
| 4-layer memory stack (L0–L3)    | 5-layer context pipeline + on-demand retrieval       | ⬆️ Upgrade                      |
| ChromaDB vector search          | Qdrant dual-vector + FTS5 hybrid                     | ⬆️ Upgrade (more robust)        |
| MCP tool integration            | Native MCP server + agent-integrated tools           | ⬆️ Upgrade (native, not add-on) |
| Local-only operation            | Local + Tauri desktop + SaaS (your choice)           | ⬆️ Upgrade (3 deployment modes) |
| CLI management                  | GUI panel with visual memory management              | ⬆️ Upgrade                      |
| `mempalace mine` data ingestion | Real-time auto\_extract + tool\_capture              | ⬆️ Upgrade (no manual mining)   |
| `mempalace search`              | Agent-integrated memory recall with source citations | ⬆️ Upgrade                      |
| Hallway connections             | Knowledge graph with CTE traversal                   | ⬆️ Upgrade                      |

**结论：10 项升级、0 项持平、0 项降级。MemPalace 用户获得记忆原生集成的完整 Agent 平台（非外挂），并多出 12 项 MemPalace 不具备的能力（智能遗忘、GUI 管理、安全扫描、偏好追踪、健康诊断等）。**

## 双路径数据可视化 — 零代码图表 & 交互式表格

竞品（Codex、Claude Code）处理数据时只能输出纯 Markdown 表格。Myrm 提供 **双路径架构**，从简单数据展示到复杂交互仪表盘全覆盖：

| 能力               | Myrm                                                                                                                                                                    | Codex / Claude Code |
| ---------------- | ----------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ------------------- |
| 内置图表类型           | 4 种（柱状/折线/饼/环形）+ React Artifact 无限制                                                                                                                                     | 无                   |
| 交互式数据表格          | UITable 动态列 + React Artifact 排序/过滤                                                                                                                                      | 仅 Markdown          |
| 零代码 UI 组件        | 22 种（图表、表格、表单、布局）                                                                                                                                                       | 无                   |
| React 实时预览       | Sandpack 热重载 + 代码编辑 + 控制台                                                                                                                                               | 无                   |
| 数据导出格式           | Markdown / JSON / HTML / DOCX / PNG                                                                                                                                     | 无                   |
| 图表渲染             | Mermaid（30+ 种图表）+ 缩放/平移/图例                                                                                                                                              | 无                   |
| GFM Alerts       | 5 种类型（NOTE/TIP/IMPORTANT/WARNING/CAUTION）+ 主题 icon                                                                                                                      | 无                   |
| 脚注渲染             | 上标链接 + 底部引用（学术论文风格）                                                                                                                                                     | 无                   |
| Artifact 版本管理    | SHA-256 完整性验证 + 版本历史                                                                                                                                                    | 无                   |
| 跨会话数据分析          | pandas + SQLite 沙箱持久化                                                                                                                                                   | 无持久化                |
| **Widget 状态持久化** | **透明 localStorage 桥接 — 组件数据跨页面刷新/重新打开保留**                                                                                                                               | 无 Widget 状态持久化      |
| **Widget 安全沙箱**  | **三层隔离**（iframe `sandbox=allow-scripts` + CSP `default-src 'none'` + `connect-src 'none'`）— Widget 无法访问宿主 Cookie/localStorage/网络；22 个 CSS 语义变量 + 60+ 工具类自动继承宿主主题（含暗色模式） | 无 Widget 沙箱         |

**路径 1 — Generative UI（零代码）**：Agent 通过 SSE 事件渲染 24 种内置组件（UIChart、UITable、UIProgress、UIBadge、UICard、UIGrid、UITabs 等），前后端双重白名单安全保障 + 8 种验证规则 + i18n 国际化 + 条件渲染，用户无需写代码即可看到丰富的交互式数据可视化。

**路径 2 — React Artifact（全功能）**：复杂可视化场景，Agent 生成自定义 React 组件，使用 Recharts/Echarts/D3/Chart.js，在 Sandpack 实时预览中支持代码编辑、控制台输出和 Tailwind CSS。

**697 项测试验证（2026-07-03）** → **render\_ui 全链路 87 项（2026-07-04 新增）**：Harness A2UI spec **24** ✅ | Interactive UI 59 ✅ | Artifact 渲染器 47 ✅ | ArtifactPortalStore + SSE 15 ✅ | Chat 导出+Schema 39 ✅ | 后端 Artifact 系统 61 ✅ | 后端 API（Artifact + Share + UI Stream）57 ✅ | CSP 安全头 41 ✅ | Harness Core Artifacts 27 ✅ | Harness Agent Artifacts 114 ✅ | Inline Artifact Events 9 ✅ | Artifact Judge 9 ✅ | Inline Artifact Push 7 ✅ | Mermaid Theme 18 ✅ | Render UI Tool 9 ✅ | Core file\_id chain + listener 4 ✅ | Artifact Services 13 ✅ | UI Artifact Stream 7 ✅ | DocumentSelectionToolbar + useSelectionAction 12 ✅ | VersionHistory + VersionHistoryBanner 20 ✅ | reactCodeProcessor 35 ✅ | reactPreviewConstants 21 ✅ | Artifact 导航体系全量验证 105 ✅ | 图片标注编辑器 54 ✅ | **render\_ui SSE wiring 14** ✅ | **run\_bind + fail-closed 集成 13** ✅ | **真实 LLM E2E + Chrome DOM 联调 1** ✅

## vs 豆包专业版 — 「AI→办公交付」全流程闭环

豆包专业版内置飞书 Office 套件（文档/表格/PPT），依托字节跳动内部生态实现「AI 生成→排版输出」全流程。Myrm 以更轻量的 Artifact 架构达到同等甚至更优的办公交付体验：

| 能力         | Myrm                                                                  | 豆包专业版          | 对比                                          |
| ---------- | --------------------------------------------------------------------- | -------------- | ------------------------------------------- |
| 文档编辑       | Monaco Editor Code 模式（语法高亮+补全+多语言）+ Markdown Preview                  | 飞书 WYSIWYG 文档  | **Myrm 更优**（LLM 原生 Markdown，可精确 diff/patch） |
| AI 精准协作    | SelectionToolbar: 选中→AI 修改/解释/优化/评论                                   | AI 写入文档        | **Myrm 胜**（选区级 AI 交互）                       |
| 自动保存       | dirty state + 2s debounce                                             | 飞书内置           | 平手                                          |
| 表格查看       | DataGrid: 虚拟滚动+排序+搜索+10K行                                             | 飞书多维表格         | 平手                                          |
| CSV 解析     | RFC 4180 合规 + 5种分隔符自动检测                                               | 基础 CSV         | **Myrm 胜**                                  |
| XLSX 支持    | SheetJS 动态导入 + 多 Sheet 切换                                             | 飞书原生           | 平手                                          |
| PPT/演示     | HTML Artifact → Vercel 部署为在线交互式 PPT                                   | 飞书 PPT         | **Myrm 更优**（在线交互式，可嵌入动态图表）                  |
| 数学公式       | KaTeX LaTeX 渲染                                                        | 飞书公式           | 平手                                          |
| Mermaid 图表 | 原生 Mermaid 渲染                                                         | ❌              | **Myrm 胜**                                  |
| 一键部署       | 多平台 Hosting Targets（Vercel / CF Pages / Netlify / Webhook）+ HMAC 安全分享 | ❌              | **Myrm 碾压**                                 |
| 包体积        | 零额外依赖                                                                 | 飞书 Office 数 MB | **Myrm 胜**                                  |

**52 项测试验证**（2026.6.30）：DataGrid 11/11 ✅ + CsvParser 19/19 ✅ + SelectionToolbar 17/17 ✅ + LocaleKeys 5/5 ✅

**结论：豆包的优势在于飞书 Office 生态壁垒（数千人年产品），非技术可复制。Myrm 以 Artifact 系统（Monaco + DataGrid + HTML Preview + SelectionToolbar + 一键部署）构建了完整的「AI→交付」闭环，在 AI Agent 场景下更轻量、更高效、更易维护。**

## vs Trae/WorkBuddy/deer-flow — 报告排版与 PDF 导出

用户评判 AI 办公产出的第一标准：「成品能否直接发给老板」。Trae 被夸赞的是排版清爽，WorkBuddy 的 stock-advisor 能生成杂志风 PDF 报告。Myrm 在报告生成全链路上全面领先：

| 能力          |                                       Myrm                                      |        WorkBuddy        | deer-flow |  Trae |
| ----------- | :-----------------------------------------------------------------------------: | :---------------------: | :-------: | :---: |
| PDF 生成      |                           **✅ pdfkit+reportlab 沙箱预装**                           | ✅ magazine-layout Skill |     ❌     |   ❌   |
| 报告 Skill 数量 |                                    **✅ 8 个**                                    |          ✅ 2 个          |   ✅ 1 个   |   ❌   |
| Office 文档生成 | **✅ 专业级**（Excel 颜色编码+公式+图表, PPT 6字标题, Word 目录+层级）+ **视觉质量闭环**（自动渲染→检查→修复最多 3 轮） |      ⚠️ 依赖 Skill 市场     |     ❌     |   ❌   |
| Artifact 预览 |                         **✅ 13 种类型**（PDF 文本可选可搜 + 链接可点击）                        |            ❌            |     ❌     | ⚠️ 基础 |
| 一键下载        |                               **✅ Blob download**                               |          ❌ 依赖飞书         |     ❌     |   ⚠️  |
| 一键发布到公网     |                                  **✅ hosting**                                  |            ❌            |     ❌     |   ❌   |
| 定时简报        |                              **✅ cron + 26+ 渠道推送**                              |            ❌            |     ❌     |   ❌   |
| IM 推送报告     |                           **✅ channel\_notify\_tool**                           |           ✅ 飞书          |     ❌     |   ❌   |

**Myrm 独有优势**：沙箱预装 PDF 工具链（pdfkit + reportlab + pdfplumber + pdf2image + img2pdf + Pillow），Agent 无需安装任何依赖即可生成专业 PDF；8 个报告 Skill 覆盖从日报简报到深度研究到竞品分析到数据可视化的全场景；daily-briefing + cron 实现全自动定时简报推送到 26+ IM 渠道。

**4,612 项报告+Artifact 全栈测试通过**（2026-07-14）：Artifact 系统 159 + Skill 系统 398 + 文件/PDF/简报/Cron 492 + 代码执行 1,272 + 前端 2,291。

## vs 豆包专业版 — 「防假死 & 细粒度进度」体验对比

豆包专业版的真实用户痛点：(1) 处理 50 页 PDF 时进度条卡在 87%；(2) 生成长文档时页面无响应约 30 秒。Myrm 已在架构层面彻底解决：

| 能力          | Myrm                                                                                | 豆包专业版            | 对比          |
| ----------- | ----------------------------------------------------------------------------------- | ---------------- | ----------- |
| PDF 渲染      | PDF.js WebWorker（不阻塞主线程）                                                            | 主线程同步处理          | **Myrm 胜出** |
| 前端响应性       | SSE streaming + Zustand immer（永不阻塞 UI）                                              | 同步 DOM 操作→30 秒冻结 | **Myrm 胜出** |
| 细粒度进度       | ProgressItem 20+ 字段（percent/step/total/category/level）                              | 简单进度条            | **Myrm 胜出** |
| 实时反馈        | PTC tools.notify 跨进程通道（10req/s 限流）                                                  | 无实时通知            | **Myrm 胜出** |
| 心跳感知        | TOOL\_HEARTBEAT 显示 elapsed\_ms                                                      | 无心跳              | **Myrm 胜出** |
| 进度 UI       | ProgressSteps 树形渲染器（9 种多态渲染器含 LiveTerminal + EvictedOutputDrawer 大输出查看器：搜索/Copy/分页） | 单一进度条            | **Myrm 碾压** |
| 后台任务        | \_background\_progress 异步监控                                                         | 无                | **Myrm 独有** |
| Subagent 进度 | swarm\_fission 批次进度（含 partial\_success）                                             | 无                | **Myrm 独有** |
| 错误恢复        | recovery\_actions 一键恢复 + ToolErrorCategory 28 种 StrEnum 诊断（4 语言 i18n，46 项同步测试）      | 无                | **Myrm 独有** |

**169 项测试验证**（2026.7.11）：ProgressSteps 25/25 ✅（含语义工具标签 + workflowStage）+ LiveTerminal 27/27 ✅ + PetDispatch 8/8 ✅ + ArchiveRestore 2/2 ✅ + MessageStream handlers 29/29 ✅（toolLifecycle/gapEvents/statusStream/tasksSteps/petDispatch/clarification/completion）+ **structured\_clarify E2E**（SSE 解包 + option.id + live API interrupt/resume 1/1 ✅）+ **Harness step\_builder 38/38 ✅ + scrubbing 5/5 ✅ + event\_handlers 47/47 ✅**（reason 提取 + 敏感信息脱敏）

**结论：豆包的卡死问题源于「没做好」（主线程阻塞 + 无细粒度反馈），而非「未做」。Myrm 的架构（SSE + WebWorker + PTC notify + 树形进度步骤 + Live Terminal）构建了完整的防假死与进度反馈体系，远超简单进度条方案。**

## vs Marvis（腾讯） — 「分屏流媒体工作台」对比

Marvis 的核心卖点：「左侧是 Mac mini 的实时桌面画面，右侧是对话框，操作感和坐在电脑前没什么差别。」Myrm 已具备完整的分屏实时监看能力：

| 能力               | Myrm                                                 | Marvis             | 对比           |
| ---------------- | ---------------------------------------------------- | ------------------ | ------------ |
| 桌面实时视频流          | VisualDesktop（noVNC WebSocket，满帧率实时交互）               | Mac mini WebRTC 推流 | **平手**       |
| 桌面快照+元素检查        | DesktopLiveView（SSE 截图 + ElementOverlay）             | ❌ 无元素级交互           | **Myrm 胜出**  |
| 浏览器实时监看          | BrowserLiveView（截图 + DOM 元素选择器）                      | ❌ 仅桌面              | **Myrm 胜出**  |
| Browser Takeover | Agent 暂停→用户 VNC 接管→Agent 自动恢复 + 学习反馈                 | ❌ 无人机协作            | **Myrm 独有**  |
| 元素级交互指令          | ElementOverlay + InspectorInstructionInput（14 种交互角色） | ❌ 仅查看              | **Myrm 胜出**  |
| 双模式切换            | View/Inspect 切换                                      | ❌ 仅查看              | **Myrm 胜出**  |
| 面板大小调节           | 可拖拽 (320-960px) + localStorage 持久化                   | ❌ 固定               | **Myrm 胜出**  |
| 权限引导             | TCC 探测 + 一键跳转系统设置                                    | ❌                  | **Myrm 独有**  |
| 云沙箱支持            | noVNC 自动连接云沙箱 VNC + 本地 localhost:6080 双模式            | 仅 Mac mini         | **Myrm 胜出**  |
| 服务器基础设施          | 无需额外（SSE + noVNC 轻量）                                 | 需要 STUN/TURN（重）    | **Myrm 胜出**  |
| 带宽消耗             | 双模式灵活（按需截图 / 实时流按需开关）                                | 持续高带宽              | **Myrm 胜出**  |
| 手机端适配            | 响应式全屏                                                | 未知                 | **Myrm 已支持** |

**验证数据（2026.7.14 更新）**：**454 项 VNC+ArtifactPortal 全栈测试全通过**——前端 ArtifactPortal Store 4 + Portal 交互 49 + VisualApproval 4 + Entitlements 3 + ChatWindow 5；后端 VNC Routes 7 + Desktop Snapshot 5 + Takeover Integration 7 + Permissions 5 + Deploy 11 + Artifact System 22 + Stream+DeepLinks 29 + Share 54；Harness VNC 63 + Artifacts 168；Control Plane VNC Proxy 18。

**结论：Myrm 的分屏流媒体能力全面超越 Marvis。实时视频流方面（noVNC），两者持平；但 Myrm 额外提供 DOM 元素级检查器（BrowserLiveView + DesktopLiveView）、Browser Takeover 人机协作（Agent 暂停让用户操作，完成后自动恢复并学习）、云沙箱+本地双模式、macOS 权限自动引导等独有能力。**

## vs Claude Office Visualizer — CLI 状态仪表盘

Claude Office Visualizer 用像素风办公室动画渲染 Claude Code CLI 状态，通过独立 Next.js + PixiJS 应用展示 Agent 状态、上下文用量与任务进度。解决 CLI 用户不盯终端就看不见 Agent 在干啥的痛点。

### Claude Office 做得好的地方

* **Visual agent metaphor** — pixel characters that walk, think, and interact based on real CLI state
* **12 whiteboard modes** — multiple visualization layouts for different data views
* **Tour overlay** — 7-step interactive guide for new users
* **Attention system** — screen flash notifications when the agent needs user input
* **Docker deployment** — easy self-hosted setup

### 为何 Myrm 不需要这个

Myrm 是 **GUI 优先** 应用。Claude Office Visualizer 要解决的「看不见 Agent 状态」「CLI 输出无聊」— 在 Myrm 架构中 **不存在**。

| 领域              | Claude Office Visualizer                    | Myrm                                                                                                                                                                                              | 用户收益                           |
| --------------- | ------------------------------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ------------------------------ |
| Agent Status    | Pixel animation in separate window          | **SubagentDashboard** — structured panel with real-time progress, inline                                                                                                                          | Precise data, no extra windows |
| Context Usage   | TrashCanSprite (filling trash can metaphor) | **ContextUsageIndicator** — exact percentage + multi-level color warnings                                                                                                                         | Numbers > metaphors            |
| Task Management | 12 PixiJS read-only whiteboard modes        | **KanbanBoardView** — interactive drag/drop/filter/edit                                                                                                                                           | Actionable, not just viewable  |
| Notifications   | Screen flash (attentionStore)               | **NotificationBell** — 4 severity levels + unread count + persistence + **切走标签页时流式完成/澄清自动 OS 弹窗**（前台自动静默、权限拒绝时 toast 降级、5 语言）+ **Web Push VAPID 离线推送**（浏览器关闭后仍收到审批/目标/健康告警；iOS PWA 引导安装；过期订阅自动清理） | 结构化告警，而非屏幕闪烁；关闭浏览器也能收到         |
| Onboarding      | TourOverlay 7步引导                            | **4步动态向导** + 自动探测 Ollama/LM Studio + **HardwareCookbook**（反常识智能推荐 + MoE 精准 \~tok/s 速度 + 流式下载）+ SearXNG 一键 Docker + 14种竞品迁移适配器（276项测试验证）                                                           | 零配置启动：探测→激活→开始工作               |
| Companion       | Fixed pixel character                       | **15 species + 9 hats + Agent 外观联动 + 23 态动画 + 进化系统**                                                                                                                                              | 智能体身份可视化 + 完整养成体系              |
| Deployment      | Docker front+back separate deployment       | **Built into the app** — zero extra infrastructure                                                                                                                                                | Zero additional setup          |
| Mobile          | ❌ Desktop-only (PixiJS)                     | ✅ PWA + 35+ messaging channels                                                                                                                                                                    | Monitor from anywhere          |
| Bundle Cost     | +\~200KB (PixiJS engine)                    | **0KB** extra (SVG vector rendering)                                                                                                                                                              | No performance penalty         |

### 从 Claude Office Visualizer 迁移

| Claude Office Feature        | Myrm Equivalent                                                     | 体验                                   |
| ---------------------------- | ------------------------------------------------------------------- | ------------------------------------ |
| Pixel agent animation        | CompanionSprite (15 species + evolution)                            | ⬆️ Upgrade                           |
| 12-mode whiteboard           | KanbanBoardView + GoalDagRenderer + EventTimeline + GrowthDashboard | ⬆️ Upgrade (interactive)             |
| TrashCan context display     | ContextUsageIndicator (precise metrics)                             | ⬆️ Upgrade                           |
| attentionStore notifications | NotificationBell (4-level, persistent)                              | ⬆️ Upgrade                           |
| Tour guide                   | EmptyChat + SamplePrompts                                           | ↔️ Equivalent (different product UX) |
| Docker deployment            | Tauri/Web/SaaS (3 deployment modes)                                 | ⬆️ Upgrade                           |

**结论：5 项升级、1 项持平、0 项降级。用户从独立观察窗口进入数据精准、可交互、完整 Agent 平台的一体化 GUI。**

## vs Coze / 工作流平台 — 批量 LLM fan-out vs SubAgent 批量（2026-07）

工作流产品（含 Coze）常见 **批量 LLM / fan-out 节点**：同一 Prompt 模板 × N 条输入，Lite 调用，工作流级计费。

Myrm **刻意不提供** in-agent `llm_map` 原语。同质或异质批量任务统一走 **`delegate_task_tool`（mode=batch|parallel）** — 每一项启动 **完整 SubAgent**，自带沙箱、工具策略、预算守卫、批量预执行 GUI 成本审批（≥\$0.50）、`subagent_control_tool`（cancel/steer/list）与审计链。

| 需求              | Coze 式批量 LLM | Myrm SubAgent 批量                     |
| --------------- | ------------ | ------------------------------------ |
| 1000× 同质摘要、无需工具 | 通常够用         | 偏重 — 诚实权衡                            |
| 每行需搜索/读写文件/写看板  | 弱 — 无逐行沙箱    | **原生** — 每行是 Agent 作业                |
| 运行前成本可预期        | 工作流估算        | **预执行审批卡片** + 4 维预算硬停                |
| 调试单行失败          | 节点重试黑盒       | **SubagentDashboard** 树 + checkpoint |

**迁移收益**：从 Coze 批量节点迁出、要做 **真实运维级批量** 的团队，获得可追踪、可审批、可恢复的作业，而非一张无法逐行排查的 fan-out 账单。

## vs Coze 3.0 / Lobster / Vercel v0 — 产物部署与只读链接（Sites 2.0）

Coze 将项目锁在生态内；Lobster 擅长公开静态链但非从 Agent 工作区部署 Vercel；v0 面向用 AI 开发的开发者。Myrm 面向 **希望从聊天产物获得可分享结果的 GUI 用户**，非独立建站工具。

| 维度              | Coze 3.0           | Lobster                          | Vercel v0              | Myrm                                                           |
| --------------- | ------------------ | -------------------------------- | ---------------------- | -------------------------------------------------------------- |
| Entry point     | Stay in Coze       | Export/share flow                | Dev-oriented generator | **Deploy or Link from artifact preview**                       |
| Formal deploy   | Platform-hosted    | Not core                         | Vercel-native          | **One-click Vercel** + preflight gate                          |
| Read-only link  | Platform-dependent | Public link (often gated)        | N/A for chat artifacts | **7-day signed Link** with version pinning, no Vercel required |
| Multi-file HTML | Varies             | Strong directory share           | Often single-page      | **Same bundle as deploy**; trailing-slash for css/js           |
| Lock-in         | Closed hosting     | Subscription walls on some tiers | Vercel account         | **Open** — Local BYOK or sandbox platform token                |

**你将获得**：聊天产物 → 落地页/报告/迷你应用 → **\~30s 部署 URL** 或 **即时只读 Link** 供审阅。

**双路径发布 — GUI 零 Token + Agent 对话式**：在 **设置 → 托管目标** 配置 Vercel、Cloudflare Pages、Netlify 或 Webhook，然后在 HTML 工件卡片点 **Globe → 发布**（零 LLM Token，服务端直发）或让 Agent 在对话中通过 `artifact_publish` tool 自动发布（说"给我链接"即可）。Agent tool 按需加载——未配置 hosting 时零 prompt-token 开销。Preflight 在出站前拦截不合格工件；每个 target 独立 publication 历史与过期重部署提示。Clawith 仍走 **5 个 Agent 部署工具**（永久 Token 开销）；Myrm 仅在需要时加载（**104+5** 项 hosting pytest，**3** 项条件加载集成场景）。

**测试覆盖（2026-07-29）**：**109** 项 hosting pytest（**104** 项模块测试 + **5** 项新 artifact\_publish 测试含 **3** 项条件加载集成场景），覆盖多 target CRUD、webhook 全链、SSRF、redeploy upsert、WebSocket 状态、凭证边界及 Agent tool factory；真实 DB/vault/preflight/orchestrator，仅在外部 provider HTTP egress 边界 mock。

**不止部署——完整的产物编辑生命周期**：Myrm 的 Artifact Portal 不只是查看器。代码产物在 **Monaco Editor**（VS Code 内核）中直接编辑。**SelectionToolbar** 支持选中代码后一键 修改 / 解释 / 优化 / 加注释——精准 AI 编辑无需离开预览面板。你的编辑会静默跟踪并自动注入到下条消息，Agent 从你修改后的版本继续工作。React 产物通过 **Sandpack** 实时渲染并热重载。版本 Diff 对比、SHA-256 完整性校验和快照回滚完善了整个生命周期。竞品如 WorkBuddy 依赖外部文档集成（如腾讯文档）而非自建编辑系统。

**诚实限制**：尚无分享撤销/分享码 UI；长期公开站点应用 Deploy + 自有域名；纯 `code` 产物须先导出为 `html`（预检 + UI 门控一致）。

## vs Codex — MCP 生态、Agent 模板与多渠道自动化

Codex 近期展示了 Linear MCP 连接与自动化 PM 工作流。MyrmAgent 的架构在每个维度均已全面碾压——经 **543 项测试**验证。

| 能力            | Codex          | Myrm                                                                                                                                                                              |
| ------------- | -------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| MCP 配置方式      | 仅 CLI          | GUI 引导式对话框 + JSON 批量导入 + 安全扫描                                                                                                                                                     |
| MCP 安全        | 无              | SSRF 防护 + DNS Pinning + OSV 恶意包检测 + 安全注解                                                                                                                                          |
| 服务目录          | 无              | 27 个预配置服务 / 9 大类别 / 搜索过滤 / 一键连接                                                                                                                                                   |
| Per-Agent MCP | 全局共享           | 每个 Agent 独立 mcp\_ids + tool\_selections                                                                                                                                           |
| MCP 状态监控      | 无              | 实时连接状态 + 健康检查                                                                                                                                                                     |
| 反向 MCP        | 无              | 暴露记忆系统供外部 IDE 连接（Claude Code / Cursor / Gemini CLI）                                                                                                                               |
| Agent 模板      | 无              | TemplateMarket + 24 个预设 Agent + 10 个 YAML 种子（4 团队 + 6 个体）+ 17 种沟通风格一键切换 + 技能自动绑定 + 原子性团队实例化+事务回滚                                                                                  |
| 团队 Agent      | 无              | 原子创建 + 失败回滚——一键部署多 Agent 团队                                                                                                                                                       |
| 渠道            | 仅终端            | 20+ Provider（Slack / Discord / Telegram / Email / 飞书 / 微信 / 钉钉 / WhatsApp / iMessage / Google Chat / MS Teams / LINE / QQ / Matrix / Mattermost / IRC / Signal / Webhook / Voice） |
| 看板            | 无（依赖外部 Linear） | 内置看板 + Pipeline 模板 + SSE 实时事件                                                                                                                                                     |
| 部署模式          | 仅 CLI          | WebUI + Tauri 桌面端 + SaaS                                                                                                                                                          |

**关键结论**：Codex 的 "Linear MCP" 只是连接了一个外部 MCP 服务器——MyrmAgent 早已支持且有完整 GUI、安全扫描和 27 个预置服务集成。"PM Agent" 工作流无需新的平台功能；MyrmAgent 现有的模板系统 + 渠道监听 + Kanban 管道已可一键实现。

## vs Codex (OpenAI) — Appshots 与 /goal GA

Codex 近期发布两大旗舰功能：**Appshots**（⌘⌘ 窗口捕获 + 文本提取）与 **/goal mode GA**（长时间自主任务）。Myrm 对比如下：

### Appshots（窗口捕获 + 文本提取）

| 维度         | Codex              | Myrm                                                                                                                                                  |
| ---------- | ------------------ | ----------------------------------------------------------------------------------------------------------------------------------------------------- |
| 平台支持       | ⚠️ 仅 macOS         | ✅ **macOS + Windows** 双平台完整实现                                                                                                                         |
| macOS 截屏   | screencapture + 文本 | screencapture + AX API 文本提取（最多 500 元素）                                                                                                                |
| Windows 截屏 | ❌ 不支持              | ✅ PrintWindow/BitBlt + .NET UI Automation 文本提取                                                                                                        |
| 文本提取       | 窗口文本（含屏外）          | macOS: AX API / Windows: UI Automation（Text、Edit、Document 控件）                                                                                         |
| 隐私保护       | ❌ 无                | ✅ 应用级隐私黑名单 + 一键强制绕过（macOS + Windows）                                                                                                                  |
| 截图大小控制     | ❌ 原始大小             | ✅ 1.5MB 阈值自动缩放，节省 LLM token                                                                                                                           |
| DPI 处理     | 未提及                | 二分法降采样防止 Retina 坐标偏移                                                                                                                                  |
| 返回格式       | 截图 + 文本            | `list[ContentBlock]` 结构化多模态（文本 + 图像）                                                                                                                  |
| 安全性        | Computer Use 权限    | 9 个危险键组合(macOS+Windows) + 危险文本正则 + **敏感应用防火墙**（40+ 应用 × 3 检查点）+ **TOCTOU 审批延迟后重验** + GUI BBox 审批卡 + **跨通道统一安全**（桌面控制 ≥ shell 安全级别，零绕过向量，3083 项安全测试验证） |
| 视觉审批       | 纯文本或 iPhone 推送     | **内联 BBox + AttentionBar + Tauri OS 红框**（目标显示器，屏幕绝对坐标，多显示器适配）                                                                                         |

**你将获得**：Agent 要点桌面时，你能看到 **位置** — 不仅是文字「批准？」。Tauri 上 **系统级红框** 在聊天窗口被挡时仍可见。macOS 和 Windows 用户均获得完整 Appshot 能力——所有竞品均无 Windows 窗口截屏 + 文本提取实现。

**诚实限制**：OS 叠加层冒烟需 Tauri 桌面端；仅浏览器 WebUI 有内联 + AttentionBar，无 OS 框。

### /goal 模式

| 维度              | Codex /goal          | Myrm Goal System                                                                                                                                              |
| --------------- | -------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| Planning        | Linear self-planning | Main-agent `todo_write` + sandbox SSOT — opt-in, zero tax when off; CompletionGuard blocks early exit                                                         |
| Execution       | Linear, sequential   | DAG concurrent executor + Swarm Fission                                                                                                                       |
| Budget          | No budget control    | 4D budget (tokens / USD / wall-clock / turns)                                                                                                                 |
| Completion      | User checks          | CompletionGuard — evidence-based TDD-like verification + temporal order enforcement + independent sandbox re-run                                              |
| File protection | ❌ None               | InvariantSnapshot SHA-256 + Protected paths physical block                                                                                                    |
| Continuation    | "Asks if stuck"      | 11-layer dead-loop shield + Semantic Judge                                                                                                                    |
| Multi-goal      | Single goal          | Priority Queue + auto\_approve unattended serial                                                                                                              |
| Runtime adjust  | Not mentioned        | Dynamic Subgoals + Objective Hot-Edit                                                                                                                         |
| Git awareness   | Not mentioned        | Branch-Aware Stash & Migrate                                                                                                                                  |
| Frontend        | Check progress       | GoalControlPlane real-time panel + Execution Summary card                                                                                                     |
| Notification    | Built-in             | `channel_notify_tool` — 动态 running 渠道下拉、pairing 白名单、附件 workspace 边界、send\_tracked 可靠投递、应用内 chat 落库（**102 pytest + live MiniMax E2E + 7 vitest + Chrome 全流程**） |
| Tests           | Unknown              | **762 tests** verified                                                                                                                                        |

### 锁屏与远程

| 维度             | Codex                           | Myrm                                                                    |
| -------------- | ------------------------------- | ----------------------------------------------------------------------- |
| Background run | Mac lock screen (not lid close) | SaaS: naturally unaffected; Local: GracefulShutdownManager + checkpoint |
| Mobile access  | ChatGPT App                     | Web frontend reconnects anytime + SSE real-time push                    |

### 用户痛点（评论反馈）Myrm 已解决

| Pain Point                      | Codex Status   | Myrm Solution                        |
| ------------------------------- | -------------- | ------------------------------------ |
| Windows not supported           | ❌              | ✅ WindowsBackend with uiautomation   |
| Token consumption too fast      | No budget      | GoalBudget 4D + 6-layer Prompt Cache |
| Context compression disappeared | User complaint | 22+ middleware context pipeline      |
| Ran 30h nonstop, no auto-stop   | No limit       | max\_time / max\_turns auto-pause    |
| Linux partial support           | ⚠️ dmg-based   | ✅ LinuxBackend native implementation |

**结论：Codex 的 Appshots 与 /goal 是 Myrm 现有能力的简化子集。Myrm 覆盖 3 平台（vs 仅 Mac）、DAG 执行（vs 线性），并提供 Codex 完全缺失的企业级预算控制与完成验证。**

### Vibe Canvas — "指哪改哪"工件交互

| 能力       | Codex @Browser               | Myrm                                          |
| -------- | ---------------------------- | --------------------------------------------- |
| 批注方式     | 截图坐标框选                       | ✅ DOM 元素级拾取（精确 outerHTML）                     |
| Token 效率 | ❌ Base64 截图消耗大量 vision token | ✅ 600 字符 HTML 片段，节省 10x+ token                |
| 支持内容类型   | 仅浏览器页面                       | ✅ 10 种：HTML/SVG/Mermaid/React/代码/PDF/视频/音频/表格 |
| 修改闭环     | 批注→Agent修改→刷新页面              | ✅ 拾取元素→输入指令→Agent修改→实时预览                      |
| 离线可用     | 需要 @Browser 沙箱               | ✅ 纯前端实现，离线可用                                  |

**你将获得**：在工件预览中点击任意元素，Myrm 自动捕获精确 HTML 结构并附带你的指令发送给 Agent。无需截图、无需猜坐标——DOM 级精确"指哪改哪"。

### 浏览器扩展桥接 — 带身份认证的会话接管

| 能力     | Codex @Chrome | Myrm                                 |
| ------ | ------------- | ------------------------------------ |
| 连接方式   | Chrome 扩展     | ✅ MV3 Chrome 扩展 + WebSocket + CDP 代理 |
| 域名授权   | 全局访问          | ✅ 按域名白名单控制（支持通配符）                    |
| 安全性    | 扩展权限          | ✅ Token 认证 + 域名级授权 + 每次操作审批卡片        |
| 状态监控   | 无             | ✅ SSE 实时状态广播 + 前端连接指示器               |
| GUI 管理 | 无             | ✅ 完整设置界面（域名/标签页/断开连接）+ 多语言           |
| 标签页管理  | 基础            | ✅ 列表/筛选标签页 + 调试器附加/分离生命周期            |

**你将获得**：让 Agent 使用你真实的 Chrome 会话（Gmail、SaaS 应用、内部工具），精细的域名级控制，每个操作需要你的审批。实时状态显示扩展正在做什么。Myrm **不会**批量读取 OS 级 Chrome/Edge `History.db` 或书签数据库——已登录访问仅通过 Extension Bridge + 加密 Session Vault。

**为什么 Myrm 不需要 Chrome Cookie 导入**：OpenClaw 导入 Chrome 系统 cookie 是因为它没有持久化会话存储——每次启动浏览器都是全新的上下文。Myrm 的 **SessionVault**（AES-256-GCM）+ **auto\_restore\_domains** 从架构层面解决了这个问题：通过 takeover 认证一次 → 会话加密保存 → 之后每次访问自动恢复。支持所有认证方式（密码/2FA/扫码/OAuth），保存 cookies + localStorage（不仅仅是 cookies），全平台全部署模式可用（包括云托管），Chrome 更新 cookie 格式也无需维护。196 项相关测试通过。

## vs 360 LobsterAI — 消费级 Agent 平台

360 LobsterAI 是消费级 Agent 产品（周鸿祎背书），主打手动模型档位、100+ 预设「专家龙虾」与「教练式」上手流程。

### 成本智能

| 维度                 | 360 LobsterAI                   | Myrm                                                  | 用户收益                                      |
| ------------------ | ------------------------------- | ----------------------------------------------------- | ----------------------------------------- |
| Model selection    | Manual 3 tiers (Lite/Save/Full) | **Auto ComplexityRouter** (SIMPLE/STANDARD/REASONING) | No guesswork — system picks optimal model |
| Routing algorithm  | None (human judgment)           | **2-phase (rule matching + LLM Judge)**               | Accurate even for ambiguous tasks         |
| Session continuity | Context lost on tier switch     | **Session Momentum** prevents downgrades              | Multi-turn complex tasks stay on-tier     |
| Accuracy feedback  | None                            | **PenaltyTracker** — learns from misroutes            | Gets smarter over time                    |
| Privacy routing    | None                            | **PrivacyRouter** — sensitive data stays local        | Data sovereignty built-in                 |
| Budget control     | None                            | **3D×3-level auto budgeting + SSE alerts**            | Never overspend                           |
| Cost visibility    | Basic stats                     | **15+ dimension dashboard + cache economics**         | Full cost transparency per message        |

### Agent 模板

| 维度             | 360 LobsterAI          | Myrm                                                                                                                                        |
| -------------- | ---------------------- | ------------------------------------------------------------------------------------------------------------------------------------------- |
| Preset agents  | 100+ (quantity)        | 27 high-quality presets + 10 YAML templates (individual + team atomic creation with rollback) + unlimited custom + Org Marketplace          |
| Template depth | System prompt only     | System prompt + tools + skills + model + security overrides + MCP + subagent bundling                                                       |
| Customization  | Limited editing        | Full GUI editor + 1-click clone + import/export (HMAC + SHA-256 integrity) + Profile Time Machine (10-version rollback, industry-exclusive) |
| Onboarding     | Q\&A "coaching" wizard | PresetAgent Gallery + conversational creation + per-agent suggestion prompts                                                                |
| Anti-confusion | None                   | 5-layer anti-interference (Profile → Conditional Activation → Progressive Disclosure → Noise Gauge → Hybrid Retrieval)                      |

### 多渠道接入

| 维度                  | 360 LobsterAI               | Myrm                                                                            |
| ------------------- | --------------------------- | ------------------------------------------------------------------------------- |
| Channels            | 3-4 (Feishu, DingTalk, App) | **35+ providers** (Telegram, Slack, Discord, WeChat, WhatsApp, email, and more) |
| Per-channel binding | Not mentioned               | Each channel/topic can bind a different agent                                   |

### 从 360 LobsterAI 迁移到 Myrm

从 360 LobsterAI 迁移的用户获得：

* **Automatic cost optimization** — no need to manually select "lite" vs "full" mode
* **Smarter routing** — system learns preferences and improves over time
* **35+ channels** vs 3-4, with per-channel agent binding
* **Enterprise security** — 6-layer defense vs consumer-grade
* **Unlimited extensibility** — Skill Marketplace + custom agents vs fixed presets
* **Full data ownership** — self-hosted option, no vendor lock-in

## 智能多平台分发与桌面下载（vs Hermes / OpenClaw / Cursor）

分发桌面 Agent 时，竞品常让用户去 **GitHub Releases 自助找包**，或逼用户分辨 CPU 架构；CI 竞态还会导致更新清单损坏。

Myrm（**v0.1.39 生产验证**）提供 **消费级下载 + 生产 OTA + 诚实发版契约**：

| 领域                  | 典型竞品                                     | Myrm                                                                  | 用户收益                                 |
| ------------------- | ---------------------------------------- | --------------------------------------------------------------------- | ------------------------------------ |
| **官网首屏**            | 链到 GitHub / 源码，非技术用户懵                    | Hero **「下载桌面版」** → `/download` 或直链安装包                                 | 像装普通软件，不用懂 GitHub                    |
| **Win 安装包选择**       | Release 混 `.msi` 与 OTA `setup.exe`，顺序靠运气 | **安装包 SSOT** 官网永远选 `.msi`                                             | Windows 新用户不会误下 OTA 专用包              |
| **Mac M 系列 Safari** | 手动选 ARM/Intel 或误下 Intel 包                | **WebGL GPU 嗅探** + 下载页兜底                                              | 多数 Mac 零选择拿到 ARM64 原生包               |
| **iPad 伪装 Mac**     | 下发打不开的 `.dmg`                            | **触控点检测** → 引导 SaaS WebUI                                             | 不浪费下载，直接用浏览器版                        |
| **版本与完整性**          | 文件名与版本混乱、无校验                             | tag 同步 + **SHA256** + OTA **minisign `.sig`** + `latest.json`         | 可核对版本，可验证安装包                         |
| **发版节奏**            | 四平台齐等，用户久等                               | **macOS 先发**（约 10 分钟可下），Win/Linux 异步追加                                | 不必等最慢平台                              |
| **官网上线**            | 发版后手动改站                                  | **`website-v*` tag** bake + 部署 + **post-deploy curl 验收**              | 下载页与 Release 自动同步                    |
| **开源 macOS 未签名**    | 用户以为「坏了」                                 | 下载页 **右键打开** 说明                                                       | Gatekeeper 有预期，安装不劝退                 |
| **应用内自动更新**         | 多数无 GUI OTA 或仅 git pull                  | **生产 OTA**（minisign + 四平台 `latest.json`）+ 应用内 8 阶段 UI；启动期 pubkey 安全校验 | 已装用户静默升级；首次安装走 myrmagent.ai/download |

**结论：迁移用户首日安装从「懂 GitHub」变成「点下载」——这是普通用户愿不愿意试用的分水岭。**

## 本地迁移向导（v1.4）

Myrm 在 Local 与 Tauri 部署提供 **GUI 优先竞品迁移向导**，支持 **14 种竞品适配器（12 种 ready）**，自动发现 + MCP 配置自动转换 + 模型自动映射 + 完整 dry-run/confirm/rollback 生命周期。

### 八个发现源（Local / Tauri）

| Source          | What imports automatically                                       | What you configure manually    |
| --------------- | ---------------------------------------------------------------- | ------------------------------ |
| **Hermes**      | Persona, global memory, skills (review queue)                    | Some MCP/channel extensions    |
| **OpenClaw**    | Memory MD, multi-workspace merge, `sessions.json` episodic       | Channels, gateway keys         |
| **Claude Code** | Skills, persona; instruction-only dry-run when memory lane empty | MCP servers in Settings        |
| **Cursor**      | Rules, skills, memory fragments                                  | IDE-specific paths vary by OS  |
| **Codex**       | Config and memory exports where present                          | Plus subscription not migrated |

### 四条预览通道

1. **Persona → Agent** — SOUL-style instructions attach to a target agent profile.
2. **事实 → 全局记忆** — 结构化记忆行，支持批量 **回滚**。
3. **Skills → Review queue** — imported skills require approval before activation; optional **Agent binding**.
4. **API keys → Opt-in** — never silently copied; user confirms each secret.

### 工作流

`Scan → Preview (dry-run) → Confirm → Result` in Settings → Migration. Server-side `resolve_competitor_import_source()` forces the correct adapter (fixes OpenClaw `source=auto` mis-routing to Hermes).

### GUI 优先无缝技能迁移与原子持久化

用户导入第三方生态技能包（如 Hermes ZIP）时，竞品常依赖基础文件覆盖（`os.replace`）与顺序数据库写入。SaaS 高并发下会导致灾难性「分裂脑」（DB 有记录但文件缺失）或 API 冻结。

Myrm 提供 **零成本热迁移与原子持久化引擎**：

| 领域                        | Hermes (Competitor)             | Myrm                                                              | 用户收益                                                                                                |
| ------------------------- | ------------------------------- | ----------------------------------------------------------------- | --------------------------------------------------------------------------------------------------- |
| **Import Security**       | Basic guard checks              | **Pre-emptive AST interception + Persistent Claim-Check Staging** | Completely prevents Zip Bomb, Zip Slip, and Memory OOM attacks during drag-and-drop.                |
| **Metadata Fidelity**     | Brutal overwrite                | **YAML Deep Merge Engine**                                        | 100% losslessly preserves `version`, `author`, and custom extensions in third-party Frontmatter.    |
| **Database Transactions** | Sequential loop writes          | **SQLite Executemany Bulk Transaction** (BEGIN...COMMIT)          | All-or-Nothing atomicity — zero risk of phantom skill records.                                      |
| **Directory Split-Brain** | In-place file replacement       | **Blue-Green Swap + Atomic Rename**                               | Skills update atomically via `.tmp` → `.old` swapping, ensuring directories are never half-written. |
| **UI Freezing**           | Synchronous GC blocks main loop | **FastAPI BackgroundTasks Asynchronous GC**                       | Deletes expired staging files and old directories in the background, keeping API latency at 0ms.    |

**结论：50 用户同时上传技能 ZIP 时竞品服务易崩溃或泄漏线程。Myrm 大规模并发导入 0ms 阻塞主线程、零脏写风险。**

### vs Hermes `claw migrate`

| 维度               | Hermes CLI migrate     | Myrm Wizard                                         |
| ---------------- | ---------------------- | --------------------------------------------------- |
| Interface        | Terminal               | GUI with lane-level preview                         |
| Rollback         | Limited                | Memory import batches rollback                      |
| Skill governance | Copy folders           | Review queue + Agent binding                        |
| Breadth          | Broader MCP auto hints | Narrower but explicit manual lanes for MCP/channels |

**诚实评分**：本地八源 GUI 迁移 **9.7/10** — 非「覆盖每个竞品工件」。**SaaS 云沙箱不可用**（无法访问用户主机文件系统）；请用 Local WebUI 或 Tauri 桌面端。

### 实跑验证（2026-06-08）

开发机最小批量回归（合计约 7 秒）：

| 套件                                                | 结果         |
| ------------------------------------------------- | ---------- |
| 迁移系统（架构守门 + 发现 + 加载器 + 拆分 + 预览 + E2E + API）pytest | **125 通过** |
| 架构 `_ARCH.md` 占位门禁                                | **277 通过** |
| OSS 脚本架构测试                                        | **5 通过**   |
| `check_fractal_docs --no-stub` + 行数预算 CI          | **OK**     |

**迁移系统专项测试合计：276 项全部通过**（2026-07-25，含 14 种竞品适配器/dry-run 会话/导入适配器/MCP 配置转换器/模型迁移/架构守门/多竞品发现/E2E/API/技能批量导入全链路）。竞品（OpenClaw、Hermes、DeerFlow、CodePilot、LobsterAI、CoPaw、jiuwenclaw、PilotDeck、Grok Build）：**无 GUI 14 源迁移向导 + MCP 自动转换**；Hermes 仅有 CLI `claw migrate`；Grok Build 仅支持 2 种源（Claude + Cursor）的 TUI modal。

### 迁移后你将获得（面向用户）

* **保留人格与习惯** — SOUL 式指令落在你选的 Agent 配置，非一刀切默认。
* **保留结构化记忆** — 事实与会话导入支持批量回滚。
* **技能可控** — 导入技能进审核队列，你批准并绑定到正确 Agent。
* **保留技能使用历史** — 调用次数、最后使用时间、Pin 状态、生命周期状态自动从 Hermes `.usage.json` 导入。常用技能保持高优先级，Pin 技能保持固定，无冷启动重新积累期。
* **迁移前看清账单** — 预览阶段自动展示 Token 经济学对比卡：竞品全量注入 vs Myrm 按需加载，典型节省 **94%**（如 15 个技能：7,500 → 450 tokens/轮）。
* **无静默偷 Key** — API Key 仅在你逐通道 opt-in 时导入。
* **诚实后续** — MCP 与消息渠道在设置中引导（不宣称与 Hermes CLI 提示一键渠道对等）。

**产品分层**：Local/Tauri 上开源 **myrm-agent-frontend**（向导 UI）+ **myrm-agent-server**（发现/预演/确认 API）；闭源 **harness** 仅提供导入类型契约 — 无独立迁移 UI。

## 选择 Myrm 你将获得

<CardGroup cols={2}>
  <Card title="永不丢上下文" icon="brain">
    42+ 模块记忆系统 — 业内最完整的 AMO 实现。8 类记忆、7 信号检索融合、7 层陈旧防御、跨会话整合与一键回滚。Anthropic Dreaming 与 Mem0 部分覆盖的能力，Myrm 端到端交付。
  </Card>

  <Card title="随处工作" icon="mobile">
    通过 35+ 消息渠道，在任何设备上审批任务、引导 Agent、监控进度。
  </Card>

  <Card title="智能工具使用" icon="wand-magic-sparkles">
    三层工具分层 + 按需加载 + 三维健康监控 + 14 类错误诊断与专家修复建议。工具精准选用、高效执行、失败自愈。
  </Card>

  <Card title="企业级安全" icon="shield-check">
    六层纵深防御：预算控制、PII 保护、污点追踪与审计追踪。
  </Card>

  <Card title="零厂商锁定" icon="unlock">
    100+ 模型，自托管或云端。数据始终归你。
  </Card>
</CardGroup>

## vs WeSight — 桌面 AI Agent 控制台

WeSight 是一款近期开源的桌面端 Agent 管理台，主打聚合本地不同的 Agent 引擎（Claude Code, Codex, Hermes 等）及飞书集成。但由于其强依赖 macOS 终端特性和较重的可视化噱头（如 3D 办公室宠物），在实际重度生产环境下面临极大的瓶颈。

Myrm 从底层架构上彻底碾压了这些痛点，让用户能毫无顾虑地迁移：

### Myrm 的领先之处

| 维度             | WeSight              | Myrm                                                                           | 用户收益                                                     |
| -------------- | -------------------- | ------------------------------------------------------------------------------ | -------------------------------------------------------- |
| **跨平台原生部署**    | 仅支持 Mac，Win/Linux 缺失 | **Tauri 原生编译 + SaaS/Local 三端**                                                 | 告别“不支持 Windows”的烦恼，全平台一致体验。                              |
| **工具生态集成**     | 需配置繁琐的环境变量           | **自有 Agent 引擎 + MCP 行业标准（安全扫描+Schema容错+动态发现）+ 5层安全审批 + 技能自动进化 + 8种SubAgent编排** | 内置完整 Agent 引擎覆盖 95%+ 场景，MCP 标准生态无缝对接任何外部工具，10,838 项测试验证。 |
| **团队协作上下文**    | 智能体间上下文强制隔离          | **Global Context Mesh + 隔离双切**                                                 | 共享底层向量库，不仅能无缝继承历史记录省 Token，还提供严格防污染模式开关。                 |
| **多 Agent 通信** | 依赖系统作为中心化指挥器         | **P2P 对等智能体通信协议**                                                              | Agent 间可直接“@”互相交流，效率与协同度成倍提升。                            |
| **全息工作流监控**    | “桌面宠物”等非工作流强相关的展示    | **Swarm DAG (多节点动态连线图) + 差异大盘**                                                | 剔除低幼向功能，以极客级的可视化图表直观展示算力去向、实时 TPS 与文件 Diff。              |
| **飞书集成持久化**    | 依赖前台程序或由用户自行接管       | **独立后台 Daemon 服务防掉线**                                                          | 关掉桌面主界面，Agent 依然作为系统常驻服务秒回你的飞书/微信信息。                     |
| **本地网络算力集群**   | 无法自动发现远程机器的算力        | **mDNS/ZeroConf 局域网广播**                                                        | 一台旧 Mac Mini 作为后端服务器，主力工作本秒级发现并直接接管。                     |

**一句话总结**：从 WeSight 迁移，你将获得一个全平台支持的专业级 AI 工作站，同时所有历史 Agent 的配置文件、设定的模型 API Key，均可通过 Myrm 的“八源导入向导”秒级恢复，真正的“带资入驻”。

## vs OpenClaw 2026.6.1 — 跨越"能用"到"好用"的终极形态

OpenClaw 2026.6.1 是其重磅更新，主打 Windows 原生节点、技能工坊、工作看板以及稳定性修复。然而，从其官方发布和大量用户社区反馈来看，其依然面临着"更新即崩"（如飞书/QQ断连）、任务缺乏直观可视化干预、以及"缝合感"较强的痛点。

Myrm 在架构和体验设计上实现了降维打击：

### Myrm 的领先之处

| 维度                      | OpenClaw 2026.6.1                                               | Myrm                                                                                                                                          | 用户收益 (Migration Win)                                                      |
| ----------------------- | --------------------------------------------------------------- | --------------------------------------------------------------------------------------------------------------------------------------------- | ------------------------------------------------------------------------- |
| **桌面原生体验**              | 仅提供 `Windows Companion` 节点环境                                    | **Tauri 桌面端 + macOS 刘海屏状态胶囊**                                                                                                                 | 提供系统级沉淀。当任务后台运行时，无需打开窗口，直接看菜单栏胶囊即可了解进度。                                   |
| **任务可视化干预**             | Workboard 纯展示层                                                  | **动态看板 + 实时断路器可视化 (Circuit Breaker)**                                                                                                         | 不仅能看，当子任务死循环时，系统自动熔断标红，或在手机端推送交互卡片，用户点击【Unblock】瞬间接管。                     |
| **渠道通信自愈**              | "修复"但评论区频发飞书/QQ掉线                                               | **断点续传 + SQLite 离线消息队列 + 指数退避重连 + Typing Ticket 主动刷新（monotonic clock 防漂移）**                                                                   | 即便网络波动或 Token 过期，长文本也能断点续传，不丢消息不卡死。微信长任务不再出现「正在输入...」冻结。                  |
| **技能安全演进**              | 基础 Proposal 流程                                                  | **GUI 审批流 + Quarantine 检疫隔离 + 静态扫描**                                                                                                          | AI 学习的新技能必须经过防投毒扫描，用户在前端审批后才能上线，杜绝大模型恶搞。                                  |
| **系统稳定性基建**             | `openclaw doctor` 命令行诊断                                         | **前端一键体检 + OOM 静默防护 (Cgroup-Aware) + mtime 状态存储 + 一键诊断导出 (Markdown/JSON)**                                                                    | 在 Docker 或 SaaS 下不再无故消失，通过前端即可了解所有网络、端口和 API 健康度，一键导出诊断报告反馈给开发者。          |
| **交互 UX 细节**            | 命令行打字感                                                          | **长文自动目录 (TOC) + IME 候选词保护 + Quick/Reasoning 模型秒切 + 消息队列 DnD 拖拽排序（排队中可调整发送顺序，竞品均无）+ 专业字体系统（Inter + JetBrains Mono 自托管 + 3套预设 + 无障碍字体 + 零闪烁）** | 极具质感的现代聊天界面。报告自动生成目录并跟随滚动，排队消息可拖拽调整优先级，聊天流畅度比肩原生 App，专业字体排版让长时间阅读更舒适。     |
| **Obsidian Vault 迁移闭环** | 仅 CLI `workspaceDir` JSON 手配                                    | **迁移向导 Result 卡片 + Onboarding 预填 bind → Start Chat 首条消息写 project SSOT**（5 pytest 2026-07-28）                                                  | 迁完 Obsidian vault 后无需再手动建 Project/绑路径，Files 面板与 Agent 首句即可读写 vault `.md`。 |
| **Obsidian 图片检索**       | 无 wiki asset caption 索引                                         | **Vision caption + FTS5/Qdrant · Chat Sources 缩略图 · 融合 wiki\_query/knowledge\_recall**（56 pytest 2026-07-29）                                  | 笔记里的 `![[img]]` 导入后可自然语言找图；诚实边界：文字找图，非 OpenViking 式以图搜图。                  |
| **第二大脑日常双闹钟**           | Article 8 需手配 Claude Schedule；OpenClaw/Hermes 仅通用 morning-brief | **Settings Wiki 一键 preset：06:00 稍后读 + 07:00 知识库晨间摘要（≤3 行 · `[SILENT]`）**（51 pytest 2026-07-29）                                                | 迁完 Obsidian 后不用自己拼 Cron；早上知道「昨天 vault 变了啥」。                               |

**一句话总结**：从 OpenClaw 迁移到 Myrm，你将告别"修一天跑一小时"的极客折腾期，获得一个拥有全天候健壮队列、极致 UI/UX 细节以及跨端原生体验的企业级 AI 工作站。

### 实时语音对讲（Realtime Voice & Multimodal Talk）

OpenClaw 拥有成熟的语音架构（多传输层、插件化提供商、电话集成），但 Myrm 在**用户实际体验和成本**维度实现了超越：

| 维度                    | OpenClaw                | Myrm                                       | 用户收益                                                              |
| --------------------- | ----------------------- | ------------------------------------------ | ----------------------------------------------------------------- |
| **零成本开箱**             | 所有 STT/TTS 均需付费 API key | **Edge TTS 免费 + Local Whisper 免费**         | 无需任何 API key 即可开始语音对话，零成本体验完整语音功能。                                |
| **隐私优先 STT**          | 语音必须上传到云端识别             | **Local Whisper 本地运行**                     | 语音数据不离开设备，适合企业和隐私敏感用户。                                            |
| **语音+视觉融合**           | 无                       | **摄像头视觉理解 + 语音交互**                         | 语音对话中说"看看这个是什么"，AI 直接通过摄像头理解画面内容。                                 |
| **Agent 全能力闭环**       | Agent Consult（简单工具调用）   | **VoiceAgentBridge（全能力 Agent）**            | 语音问"帮我搜一下今天的新闻"，Agent 直接调用搜索/记忆/MCP 全套工具链。                        |
| **TTS 智能摘要**          | 长文本原样播报                 | **自动摘要后播报**                                | 避免 AI 朗读 3000 字论文，自动精炼后播报，节省用户时间。                                 |
| **延迟观测**              | 基础指标                    | **三段延迟拆分（params/agent/tts）**               | 精准定位语音响应慢在哪个环节，便于优化。                                              |
| **内联 A2UI（Web / 桌面）** | GPT-Live 固定预设卡片（仅语音）    | **Web 对话与 Tauri 桌面 Surface 门禁 render\_ui** | 在 GUI 会话聊天气泡内渲染表单、图表与 live 面板 — 纯语音 Realtime / Gemini Live 会话不暴露。 |

**关键数据**：**1,176 项**语音相关测试全部通过（语音核心 632 + Discord Voice 全栈 485 + Channel Security 59），覆盖 Realtime API / TTS 5 提供商 / STT 5 提供商 / WebSocket 全双工 / Barge-in / Agent Bridge / Vision 融合 / Discord Wake Word / VoiceReceiver DAVE 加密 / VoiceFollowManager 自动跟随。

## vs DeerFlow — 彻底告别大模型崩溃死循环

DeerFlow 作为一个优秀的开源智能体框架，在健壮性处理上遇到了典型的业界难题：大模型极易因为长日志和异常输出引发死循环崩溃。Myrm 将 DeerFlow 暴露出的核心痛点转化为**原生中间件级别的降维打击解决方案**。

### 工具调用安全网（Tool Calling Safety Net）

无论是使用 LangChain 还是原生 API，执行长线任务时极易遭遇致命的崩溃死循环。Myrm 实现了免人工干预的 **100% 自动容错**：

| 能力           | Myrm Agent                          | DeerFlow / 普通 LangChain Agent | 优势                                   |
| ------------ | ----------------------------------- | ----------------------------- | ------------------------------------ |
| **工具输出预算控制** | ✅ **自动截断与落盘 (Spillover)**           | ❌ 仅配置最大字符数，超长直接丢失             | **永远不会 OOM，且数据不丢**                   |
| **超长数据处理**   | ✅ **预览摘要 + 本地持久化引用**                | ❌ 粗暴截断，无法查阅全文                 | **大模型既知道结果超长，又知道去哪里读完整日志**           |
| **悬空工具调用自愈** | ✅ **Dangling Tool Call Healer 中间件** | ❌ 报错崩溃死循环                     | **自动补齐合成的错误回执，使得消息序列合法，让模型自行修复残缺调用** |

**用户感知收益**：当别的 Agent 跑到一半因为“日志太长”或“JSON 残缺”而崩溃挂起时，Myrm 会自动截取超长日志存入本地文件，并用一段礼貌的提示语告诉大模型：“输出过长已落盘，请使用读文件工具查看某某路径”。它永远能优雅地处理各种边界崩溃。

### 智能记忆检索（Context-Aware TF-IDF Memory Retrieval）

在注入长期记忆时，普通框架会盲目按时间或事实置信度排序，导致上下文被大量“高置信度但与当前任务完全无关”的噪音记忆占满，反而忘记了核心指令。

Myrm 引入了 **TF-IDF 与置信度双重加权检索**：在注水前，先利用 `tiktoken` 提取当前对话最近几轮作为 `current_context`，计算所有记忆与该上下文的余弦相似度，并结合事实的置信度进行双端加权评分（`similarity*0.6 + confidence*0.4`）。

**用户感知收益**：如果你积累了数百条记忆，迁移到 Myrm 后绝不会体验到因为“记得太多而变笨”的痛点。我们在极低的 Token 预算内提供“最精准”的记忆召回。

### 智能防泄漏与零卡顿的标题生成 (O(1) Anti-Blocking Title Generation)

当用户粘贴超大日志或代码块时，后台生成标题的正则清洗往往会卡死整个服务器（Event Loop Blocking）；此外，廉价模型生成的标题经常带有 `Title:` 等废话前缀，且容易暴露 API Key 等敏感信息。

Myrm 在底层实现了 **O(1) 早期截断**与军工级脱敏管线：

| 能力         | Myrm Agent                         | DeerFlow / 传统框架 | 优势                          |
| ---------- | ---------------------------------- | --------------- | --------------------------- |
| **防阻塞性能**  | ✅ **O(1) 早期截断**                    | ❌ O(N) 全文正则，易卡死 | **无论粘贴多大文件，前端 UI 永远丝滑零卡顿**  |
| **凭证脱敏**   | ✅ **调用 `redact_leaks` 抹除 API Key** | ❌ 原样发送给 LLM     | **彻底封堵隐式 Token 泄漏与提示词注入漏洞** |
| **深度降噪**   | ✅ **正则剥离代码块、URL、HTML**             | ❌ 原始文本直接生成      | **避免大模型被无关代码迷惑，标题更精准**      |
| **智能容错**   | ✅ **空文本 0 Token 拦截，统一英文兜底**        | ❌ 仍调用 LLM 或报错   | **极端输入下不浪费 Token，UI 保持整洁**  |
| **多语言自适应** | ✅ **`<user_input>` XML 隔离强制语种跟随**  | ❌ 易出现中英混杂       | **全球化体验更佳**                 |

**用户感知收益**：哪怕你粘贴了 1MB 的错误日志，Myrm 也能瞬间为你生成一个安全、精准、无废话前缀的标题，且整个过程对服务器性能零冲击。细节体验 100% 碾压竞品。

### 深度研究与长程任务挂机（Deep Research & Offline Guardian）

DeerFlow 1.x 作为专业 Deep Research 框架广受好评，但 2.0 已完全重写为通用 Agent Harness（README 明确说"shares no code with v1"），原深度研究能力仅在 1.x 分支维护。Myrm 提供了**完整的深度研究引擎与军工级长任务挂机保障**：

| 能力                    | Myrm Agent                                                                                     | DeerFlow 2.0              | 优势                              |
| --------------------- | ---------------------------------------------------------------------------------------------- | ------------------------- | ------------------------------- |
| **五阶段研究编排**           | ✅ CLARIFY→PLAN→EXPLORE→RESEARCH→REPORT                                                         | ❌ 2.0 无专用研究编排             | **结构化五阶段编排，开箱即用**               |
| **本地知识预查询 (EXPLORE)** | ✅ Wiki FTS5 零 LLM 成本自动检索本地知识                                                                   | ❌ 无                       | **已有知识不重复搜索，节省 token 和时间**      |
| **研究计划确认闸门**          | ✅ PhaseWaiter + PlanConfirmationCard（批准/编辑/跳过）                                                 | ❌ 无                       | **执行前审阅计划，避免跑偏浪费 token**        |
| **双模型成本优化**           | ✅ 研究用轻量模型 + 主模型规划/报告                                                                           | ❌ 无                       | **研究任务 API 费用大幅降低**             |
| **自适应思维链**            | ✅ 非推理模型自动注入 think 工具，推理模型自动省略                                                                  | ❌ 无                       | **模型切换零配置，始终保持最佳推理质量**          |
| **断线自动后台守护**          | ✅ OfflineDurableTask DB 持久化 + Power Lock 防休眠                                                   | ⚠️ 仅内存级 DisconnectMode    | **关掉浏览器、电脑休眠，任务照跑不误**           |
| **Server 崩溃自动恢复**     | ✅ 重启后从 DB 恢复 + 成功/失败精确分流通知（SSE error chunk 检测 + Durable Resume 失败主动告警 + 通知中心一键跳转对话）            | ❌ 进程内 RunManager 全部丢失     | **服务器意外重启？Myrm 自动接力，成功或失败一目了然** |
| **交互式研究确认**           | ✅ ClarificationWaiter（暂停等用户确认方向）                                                               | ✅ ClarificationMiddleware | **研究过程可纠偏，避免跑偏浪费 Token**        |
| **前端透明重连**            | ✅ StreamInterruptedError → attachToChat 自动恢复                                                   | ⚠️ 需手动处理                  | **网络波动？用户完全无感**                 |
| **实时成本透传**            | ✅ 每轮研究实时推送 cost\_usd + 预算警告/超支                                                                 | ❌ 无                       | **花了多少钱一目了然，超支立刻预警**            |
| **四重编排确定性**           | ✅ THINK 工具 + FINALIZE 条件 + max\_cycles + cycle reminder                                        | ⚠️ 依赖模型原生能力               | **研究不会跑偏或死循环**                  |
| **Prompt Cache 友好**   | ✅ 纯文本计划注入 system prompt 前缀，cache 命中率最大化                                                        | ⚠️ 文件落盘模式 cache 不友好       | **重复研究场景成本大幅降低**                |
| **增量研究自动复用**          | ✅ 旧报告 Wiki Vault 自动入库 + EXPLORE FTS5 自动检索旧知识                                                   | ❌ 用户需手动指定旧文件              | **后续研究自动衔接，无需手动切换模式**           |
| **隐式交叉验证**            | ✅ THINK 评估发现 + Information Integrity 标注不一致 + 偏离机制修正旧结论                                         | ❌ 无系统级机制                  | **发现旧报告错误时自动纠正，研究更可靠**          |
| **对比评估维度模板**          | ✅ 对比类查询自动按统一维度规划步骤 + 报告末尾生成汇总对比表                                                               | ❌ 无                       | **框架对比、技术选型场景输出专业对比表**          |
| **知识三层流转**            | ✅ 同会话 chat\_history + 跨会话 Wiki 自动归档+EXPLORE 召回 + 普通对话 `memory_search_tool(corpus=memory)` 语义检索 | ❌ 无跨会话知识流转                | **研究成果永不断裂，跨对话可用**              |

**用户感知收益**：你可以发起一个数小时的深度研究任务后安心关闭浏览器甚至合上笔记本——Myrm 会自动阻止系统休眠、将任务状态持久化到数据库。即使服务器意外重启，Myrm 也会自动恢复中断的任务并在完成后推送系统通知。研究开始前，你的 Wiki 知识库会被自动检索，已有知识不再重复搜索，直接节省 token 费用；旧报告会自动入库并在后续研究中复用和验证，确保知识不断迭代更新。研究成果通过三层机制确保不丢失：同会话内直接可见，跨会话通过 Wiki 自动归档并被后续研究召回，普通对话中 AI 也能通过记忆检索工具访问历史研究。对比类查询（如"React vs Vue"）自动按统一维度规划研究步骤并在报告中生成汇总对比表。研究过程中，每轮研究的实时成本和预算使用情况都在 UI 上清晰可见。这种级别的深度研究能力与长任务可靠性，在所有竞品中独一无二。（9,487 项相关测试全部通过）

## 长文阅读（自动目录）

当 Agent 回复含多个标题时，Myrm 会在消息旁 **自动生成目录** — 点击章节跳转，滚动时高亮跟随。ChatGPT、Hermes、OpenClaw 均无等价的聊天内多章节导航；用户通常需复制到 Notion 或 Word 才能获得大纲。

|                       | Myrm          | Typical chat UIs |
| --------------------- | ------------- | ---------------- |
| Auto TOC              | ✅ ≥2 headings | ❌ scroll only    |
| Scroll sync           | ✅             | ❌                |
| Works while streaming | ✅ (debounced) | N/A              |

## 多 Agent 编排与零信任验证（vs Hermes Agent / Claude Code）

在多 Agent 架构领域，多数框架依赖盲信与非确定性 LLM 即兴发挥。Myrm 打破串行瓶颈，彻底消除 Hermes、Claude Code 等竞品中的「幻觉式成功」与「预算烧穿」痛点。

### Myrm 的领先之处

| 领域                    | Hermes / Claude Code             | Myrm                                      | 用户收益                                                                                                                                                                    |
| --------------------- | -------------------------------- | ----------------------------------------- | ----------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| **Verification**      | Blind trust in LLM summaries     | **Zero-Trust Verification**               | Enforces physical verifiable credentials (e.g., file paths, exit codes). Sub-agents cannot fake success, effectively ending task hallucination.                         |
| **Sandbox Security**  | Background agents can trigger UI | **UI Interaction Blacklisting**           | `LEAF` node sub-agents are physically restricted from accessing UI/Chat interfaces, preventing them from unexpectedly interrupting the user.                            |
| **Language Context**  | Sub-agents default to English    | **Dynamic Spec Injection**                | The parent orchestrator dynamically injects the user's active language and style guidelines, ensuring the final report is completely cohesive (no more "Chinglish").    |
| **Budget Control**    | Timeouts only (burns tokens)     | **Iteration Circuit Breaker & Downgrade** | Introduces a hard limit on iteration steps to stop deadlocks instantly. Automatically downgrades non-core tasks to cheaper models when budgets run low.                 |
| **Human-in-the-Loop** | Simple "Yes/No" approval         | **Seamless Context Injection**            | During a UI breakpoint approval, users can inject corrective text directly into the agent's state machine, steering wandering agents back on track with a single click. |

### 迁移收益

从 Hermes 或 Claude Code Dynamic Workflows 迁移，你将获得：

* **绝对成本可预测**：Agent 死循环不会让你醒来面对巨额 API 账单。
* **真实执行证据**：Myrm 称任务完成时，有 OS 级执行日志支撑，非 LLM 想象。
* **无瑕 UI 体验**：后台 Agent 严格留后台；人工介入可注入纠正语境，非二元是/否。

## 视觉审批、Artifact 全链路与智能模板复用（vs Codex）

Codex 仅提供基础截图审批，无 Artifact 管理。Myrm 提供**跨 Web、桌面、移动端的完整视觉审批系统**，以及从生成到部署的完整 Artifact 生命周期管理——经 **347 项成果物交付专项测试验证**（harness 注册/Vault 137 + server 处理 105 + 前端 Portal 105）。零点击交付链路：Agent 生成文件 → ArtifactRegistry 自动注册去重 → SSE 事件 → Portal 自动弹出预览（竞品仅调用 OS Open 打开文件，无版本管理、无发布、仅限桌面端）。

### Myrm 更强在哪

| 能力维度             | Codex  | Myrm                                                                                                                 | 用户收益                               |
| ---------------- | ------ | -------------------------------------------------------------------------------------------------------------------- | ---------------------------------- |
| **视觉审批**         | 基础截图   | **17 个专用文件**：高亮 + 注意力条 + OS 覆盖层 + 请求渲染器 + 待审批卡片 + 内联区域 + 不可用降级                                                       | 在所有平台上精准看到 Agent 想做什么，一键批准/拒绝/编辑   |
| **桌面端原生覆盖层**     | ❌ 无桌面端 | **Tauri Rust 原生** `visual_approval_overlay.rs` — 主屏幕透明红框                                                             | 即使应用最小化也不会错过待审批操作                  |
| **移动端适配**        | ❌ 无    | **MobileStatusBoard** + 手势关闭 + 响应式布局                                                                                 | 手机上完整控制 Agent                      |
| **优雅降级**         | ❌ 无    | **VisualApprovalUnavailableCard** 自动降级为文本审批                                                                          | 截图失败时仍可正常审批                        |
| **Artifact 渲染器** | 基础     | **13 种**：PDF（文本可选可搜+链接可点）/ 电子表格 / Word / PPTX / React / SVG / Mermaid / 代码 / 文档 / HTML / 视频 / 图片 / 音频                | 不离开聊天窗口即可预览任何文件类型                  |
| **实时代码编辑**       | ❌ 无    | **Sandpack ReactPreview**：预览/代码/分屏三视图 + 控制台 + Tailwind                                                               | 实时编辑 Agent 生成的 React 组件，热重载预览      |
| **代码选中精准编辑**     | ❌ 无    | **SelectionToolbar**：选中代码 → 修改/解释/优化/注释/复制                                                                           | 在代码选择级别与 Agent 精准协作                |
| **一键发布**         | ❌ 无    | **PublishModal + Hosting Targets**：Vercel / CF Pages / Netlify / Webhook，Globe 零 Token 发布 + WebSocket 状态 + preflight | 秒级将 HTML 工件发到多平台，无需 Git 或 Agent 工具 |
| **版本管理**         | ❌ 无    | **ArtifactsCenter**：不可变时间线 + SHA256 完整性验证 + 回滚；**5 语言**企业工件库 UI + i18n 自动化回归守门                                       | 企业级 Artifact 审计追踪                  |
| **技能检测**         | ❌ 无    | **SkillDetectionCard**：自动检测 SKILL.md → 一键打包注册                                                                        | 将 Agent 生成的任何工具转化为可复用技能            |
| **记忆系统**         | ❌ 无    | **14 种 DB 模型**：画像/程序性/待审批/共享上下文 + 导入/归档/回滚/审计                                                                        | Agent 记住你的偏好、编码风格和报表格式             |
| **技能进化引擎**       | ❌ 无    | **SkillEvolutionEngine** + 信心度审批流 + A/B 测试                                                                           | Agent 自动从每次交互中学习和改进                |
| **模板复用**         | ❌ 无    | **Procedural Memory** "记住这个格式" + 自动模式提取                                                                              | 比静态模板更智能——自动适应新数据                  |

### 迁移收益

从 Codex 切换到 Myrm Agent 后：

* **多端视觉审批**：从基础截图升级为 Web 内联高亮、Tauri OS 覆盖层和移动端手势交互
* **Artifact 成为永久资产**：完整版本管理 + SHA256 防篡改验证 + 一键 Vercel 部署
* **Agent 学习你的风格**：无需手动保存模板，Agent 自动学习你偏好的报表格式和编码模式
* **精准协作**：在 Artifact Portal 中选中任意代码，直接触发修改/解释/优化/注释与 Agent 协作

## 顶级智能体架构拆解对比（"Agent Harness 解析"）

在最近的业界深度解析中，Agent Harness（包裹 LLM 的完整软件基础设施）被确认为 Agent 性能的决定性因素。通过与前沿理论和竞品实现对比，Myrm 的架构在以下关键领域展现出降维打击的优势：

### Myrm 的领先之处

| 理论架构高地                | 竞品/传统框架现状             | Myrm 对应能力实现                                | 用户收益                                                                       |
| --------------------- | --------------------- | ------------------------------------------ | -------------------------------------------------------------------------- |
| **记忆三层剥离与轻量验证**       | 读写分离管理文件，或全量加载导致 OOM。 | **混合指令分层注入与自动 Search Cues**                | 核心规则（稳定）打入 System，不可靠经验入 Human，AI 自动感知“脑容量”上限。记忆越用越准，无上下文溢出焦虑。             |
| **全局输出掩蔽与驱逐**         | 直接截断或任由无用日志占满上下文窗口。   | **极致懒加载 + 轮次级 Filter Processor**           | 0% 系统 Prompt 冗余，动态按需挂载工具。长文本（如 Bash/Fetch）超限自动落盘并替换为智能预览，彻底消除上下文膨胀导致的能力退化。 |
| **视觉验证与 LLM 评判者**     | 基础测试或单纯依赖 LLM 盲目打分。   | **早期拦截 (Early Handoff) + CompletionGuard** | 不可恢复错误智能中断并弹窗求助，防空转烧钱；强制执行跨端视觉警告与代码运行验证，杜绝 AI 提交半成品。                       |
| **Git Worktree 级别沙箱** | 需强制切换分支，容易搞乱本地代码栈。    | **并发隔离（ISOLATED\_COPY）+ Checkpoint 孤儿恢复**  | 并行模式下自动创建轻量物理克隆；大规模并行无缝合并；中断或断网时，OrphanRecovery 秒级重连，长任务稳如泰山。              |

### 迁移收益

从依赖简单 ReAct 循环和基础记忆的竞品迁移，你将获得：

* **永远不会迷失在长文档中间**：智能预览和按需挂载机制保证了模型始终关注高信号 Token。
* **不再为空转烧钱买单**：一旦 AI 迷路卡死，立即挂起执行，在用户终端弹窗“请求指示或代填参数”。
* **工程级别的可靠交付**：代码没跑过 lint 就不准“声称已完成”，告别“幻觉式成功”。

## 长程任务自动化编排 (vs Codex 等半人工工作流)

许多开发者在使用大模型处理包含数十个文件、需要多天迭代的长程重构任务时，往往求助于类似 Codex 的“人工约束工作流”——手工拆解子任务，手工建 `.codex-work/tasks/*.md` 文件夹，甚至手写交接文档 `handoff.md`。

这种半人工模式虽然能在一定程度上防止大模型的上下文污染（Context Pollution），但这**绝不应该**是终端用户的负担。Myrm 将这种“极客的手工作坊”彻底升级为了自动化的基础设施：

### Myrm 的领先之处

| 领域             | 传统半人工工作流 (如 Codex 实践)   | Myrm Agent                            | 用户收益                              |
| -------------- | ----------------------- | ------------------------------------- | --------------------------------- |
| **任务拆解与上下文隔离** | 手工新建 Markdown 文件作为隔离屏障  | **主 Agent `todo_write` + Kanban DAG** | 内部节点间状态流转对主会话零污染，**自动且绝对干净**。     |
| **并行执行隔离**     | 需用户手动在不同分支或工作树间切换       | **原生自动 Git Worktree 隔离沙箱**            | 在后端直接支持多工作树并行隔离，互不干涉。             |
| **阶段执行验证**     | 需要人在旁边盯，手动核对后放行         | **内置 3-Strike Protocol**              | 任务执行连续失败自动升级警告，强制要求执行验证命令。        |
| **跨任务交接与恢复**   | 手工维护 `handoff.md` 等状态摘要 | **ArchiveCheckpoint + SessionNotes**  | 记忆系统实现零 Token 成本的无损多层归档，断线重启一键接力。 |

**结论：迁移到 Myrm，你将彻底解放双手，告别为了“防模型变傻”而强加给自己的人为流程。让机器去做机器该做的编排。**

## 准备开始？

<CardGroup cols={2}>
  <Card title="快速开始" icon="rocket" href="/zh/getting-started/quickstart">
    2 分钟内完成上手。
  </Card>

  <Card title="本地部署" icon="server" href="/zh/getting-started/local-deployment">
    在你自己的基础设施上自托管 Myrm。
  </Card>
</CardGroup>

### 记忆系统：告别臃肿与幻觉，真正“懂你”的 AI

许多竞品（如 Mem0、Hermes 或 Supermemory）在记忆系统上存在显著痛点：要么提取过多导致记忆库臃肿、检索准确率下降；要么只存摘要导致精确信息丢失；要么必须依赖云端服务。Myrm 的记忆系统在架构上实现了全面超越：

* **严格精度门控 (No-Op Default)**：我们拒绝像竞品那样“宁滥勿缺”地提取日常闲聊。Myrm 默认静默，仅在检测到高杠杆业务价值（如代码规范、架构偏好）时才提取入库，彻底解决记忆臃肿与 AI 幻觉问题。
* **原文无损保留 (Verbatim Storage)**：采用双轨存储，不仅保留用于语义检索的摘要，更 100% 无损保留原始对话和代码片段。当你需要精确数字或代码时，Myrm 绝不含糊。
* **异步画像投影 (Cognitive Deriver)**：无需你刻意调教，Agent 会在后台静默分析你的沟通风格、决策逻辑，并实时投影到下一次对话中，实现“零延迟”的默契。
* **物理级无痕模式 (Incognito Mode)**：独家支持阅后即焚，底层记忆引擎彻底卸载，确保敏感项目数据绝对零泄漏。
* **全景可视化与零配置**：提供豪华的记忆指挥中心 GUI，打破黑盒；且内置 SQLite+Qdrant，无需配置 Docker 或 API Key，断网 100% 可用。
* **记忆冲突自动裁决 (Conflict Arbitration)**：当 AI 学到的新知识与已有记忆矛盾时，自动检测并路由至用户裁决（保留旧值 / 采用新值 / 自由编辑合并 / 双弃），72h 未处理安全降级保留旧值。竞品 Cognee/Mem0 静默覆盖导致用户无感知——**56 项验证测试确认**

**用户迁移收益**：从竞品迁移过来，你将获得一个不会“越用越笨”、不会丢失关键细节、且完全保护隐私的超级大脑。

***

## 🆚 Tokeny 等「桌面化零配置」Agent 对比

Tokeny 等产品针对 OpenClaw/Hermes 的痛点，主打“免部署、免配置、自备 Key”。但这种“套壳应用”在灵活性与安全性上依然存在明显短板。Myrm 实现了降维打击：

| 体验维度         | Tokeny 等桌面 Agent     | MyrmAgent                                   | Myrm 优势           |
| ------------ | -------------------- | ------------------------------------------- | ----------------- |
| **部署模式**     | 仅限桌面端应用              | **SaaS 零安装秒开 / Tauri 桌面双击安装 / PWA**         | 满足从随时访问到本地私有化全场景  |
| **Token 控制** | 模型自由选择，但需用户手动决策      | **三维智能路由 + GUI 成本大屏 + 86% Token 节省**        | 从被动选模型升级为主动智控     |
| **执行安全**     | 依靠手动拦截高风险命令          | **Shell 终端分段可视化审批 + Firecracker 沙箱物理隔离**    | 真正的安全护城河，放权不怕搞坏电脑 |
| **工作空间**     | 工具串联为主               | **8 类记忆系统 + 知识图谱 + 27+ 预置连接器**              | 全方位数字工作站          |
| **获取门槛**     | 软件免费，但需自备第三方 API Key | **免费版 \$0（内置 Work Units）+ 支持自带 Key (BYOK)** | 零门槛真正开箱即用，免配 Key  |

### 从 Tokeny 迁移的 5 个理由

1. **更极致的开箱即用**：Tokeny 依然要求用户具备申请 API Key 的认知。Myrm 提供开箱即用的 Cloud Work Units 额度，点开即用。
2. **安全与自动化的兼得**：桌面 Agent 缺乏底层沙箱，导致高阶用户不敢放手让 AI 写文件、跑脚本。Myrm 独立的环境隔离让你真正拥有安全的赛博员工。
3. **更智能的防 Token 刺客**：Myrm 的 ComplexityRouter 能根据单次对话复杂度智能分配大小模型，配合六层缓存，成本降低一个数量级。
4. **全端在线的无缝流转**：从家里的 Tauri 桌面端，无缝流转到手机浏览器的 PWA，工作不因离开电脑而中断。
5. **统一生态网关**：内置四合一网关，避免因单个第三方插件不可用而导致整个工作流停滞。

## 🆚 Ryan Agent Work Kit — 文本约束 vs 架构级全栈碾压

《Ryan Agent Work Kit》是一个倡导通过纯文本文件（如 `AGENTS.md`）和 bash 脚本拼接来构建 AI Agent 工作流的“套件”。其本质是为了填补纯文本、无界面（CLI）工具的架构缺陷而打的“补丁”。

MyrmAgent 作为一个拥有完整 GUI、底层支持多层安全/调度协议、采用 Agent-in-Sandbox 架构的现代化工作空间，对其形成了**降维碾压**。

### MyrmAgent 的领先之处

| 领域             | Ryan Agent Work Kit                 | MyrmAgent                                | 用户收益                                                                                             |
| -------------- | ----------------------------------- | ---------------------------------------- | ------------------------------------------------------------------------------------------------ |
| **项目初始化与治理**   | 强依赖一键生成庞大的 `AGENTS.md` 模板目录         | **Zero-Overhead WebUI 治理**               | 告别繁琐的脚手架目录与手动配置，在 WebUI 表单中勾选即可生效配置，真正对小白友好。                                                     |
| **可观测性与数据打点**  | 依赖 Agent 或用户手写 Markdown/TSV 记录返工与耗时 | **14 维统计大屏 + 15+ GUI 仪表盘**               | 耗时、Token 花费、Per-Agent 成本归因、工具 P90/P99 延迟、活动热力图、记忆健康雷达——全自动写入 SQLite 并通过精美 GUI 实时图表呈现。75 项统计测试验证。 |
| **安全隔离与死循环防御** | 在 Prompt 中生硬约束“失败 2 次必须换假设”         | **底层架构级 CircuitBreaker 熔断机制**            | 代码级干预远胜于文本劝导，底层沙箱结合频率守卫自动熔断危险与死循环，防爆防挂死。                                                         |
| **知识共享与长时记忆**  | 使用外挂脚本桥接到 Obsidian 等外部库             | **内置 8 类多模态记忆与知识图谱**                     | 记忆内化于 Agent 平台，并支持自动检索与脱敏导出，跨项目自然流动，无须外挂。                                                        |
| **生态健康与扩展**    | 依赖单一 GitHub 仓库防失联                   | **去中心化 7 大开放源并行聚合（含 ModelScope/Aliyun）** | 真正解决平台单点故障风险，一键离线 ZIP 安装，安全可靠，国内外生态全覆盖。                                                          |
| **技能迭代与积累**    | 要求大模型在末尾打印文本来评估是否沉淀 Skill           | **全自动静默 Background Evolution 引擎**        | 后台 Worker 自动从历史轨迹提取有效 Skill 并放入审批收件箱，无需浪费主对话 Token。                                              |

### 从 Ryan Work Kit 迁移的 5 个理由

1. **从“拼凑脚本”到“开箱即用”**：无需熟悉 Bash 和繁杂的文件结构树，Web/Tauri 桌面双端加持，真正做到安装即用。
2. **从“文本约束”到“代码强制”**：用底层的确定性代码逻辑替代不可靠的大模型 Prompt 文本约束（如危险命令拦截、死循环熔断等），100% 确保资产安全。
3. **从“手动打点”到“全景可视化”**：自动追踪所有 Token、开销与工作流节点（DAG），直接生成数据面板，让 Agent 动作完全透明化。
4. **内置化、内生化的企业级记忆**：抛弃繁琐的外挂 Obsidian 同步脚本，内置的 Qdrant 向量库加上双层智能遗忘（5维保留分 + LLM语义过期审查），让你拥有最流畅的认知记忆体验。
5. **生态开放自由**：不仅不受限于单一 Github 仓库的更新，更能连接包含 ClawHub 在内的多个插件市场，且支持完全无外网离线安装。

## 长程任务极限UX与工程深度 (vs Claude Code / OpenClaw)

在长时间运行的重型任务（重构、数据爬取等）中，竞品往往存在**报告刷屏、卡验证码死锁、虚拟隔离导致写冲突**等痛点。Myrm 提供了碾压级的基础设施：

| 领域          | 典型竞品痛点          | Myrm 独有优势                            | 用户收益                                                 |
| ----------- | --------------- | ------------------------------------ | ---------------------------------------------------- |
| **报告降噪 UI** | 日志刷屏，有用信息被淹没    | **Subagent Report Card**             | 8状态树形折叠，仅透出核心 Findings 和置信度，"老板级"极简审阅。               |
| **挂起死锁防御**  | 缺权限或需验证码时直接报错退出 | **优雅 Blocked 干预**                    | `BackgroundTasksPanel` 挂起任务 + 多类型审批卡，用户提供后无缝 Resume。 |
| **对抗式纠偏**   | 依赖单次 LLM 生成计划   | **静默对抗自省 (run\_with\_verification)** | 内置 Adversarial Verifier，子 Agent 出错时底层静默重试闭环。         |
| **事前权限声明**  | 跑到一半弹危险权限       | **事前静态权限分组声明**                       | `SkillPermissionApprovalDialog` 启动前 7 大组权限披露，合规无忧。   |
| **物理读写隔离**  | 虚拟逻辑隔离，易写冲突     | **底层 COW 工作树物理隔离**                   | `_clone_workspace` + `batch_merge.py` 物理级沙箱，并发写绝对安全。 |

**迁移体验：** 告别对着黑框狂闪日志的担惊受怕。你将获得**所见即所得**的状态大盘与防破产保护，让长程任务安全放在后台运行，体验降维打击。

## vs. DeerFlow 2.0: 从 Framework 到真正的 Industrial Harness

DeerFlow 2.0 提出了 14 层中间件链和 Docker 沙箱，但其架构严重依赖云原生微服务（强制要求独立的 LangGraph Server 集群），在本地和桌面端部署时极为臃肿。

**为什么从 DeerFlow 2.0 迁移到 MyrmAgent？**

1. **17+ 层超细粒度 Middleware 内核**：我们实现了更细粒度的 17+ 层严格有序中间件链，并引入静态依赖注入图（DI Graph）校验，彻底杜绝隐式依赖导致的 Bug，稳定性降维打击。
2. **真正的 Agent-in-Sandbox**：DeerFlow 在 Agent 内部创建沙箱属于架构越界。我们采用多态沙箱驱动，由外部调度层（Server/Tauri）提供隔离。在 Local 和 Tauri 桌面端，你无需启动沉重的 Docker 即可获得极致的安全与性能。
3. **ArtifactVault 零拷贝共享**：面对海量并发的子 Agent 协作，我们独创 `vault://` 指针协议，大文件落盘后仅交换指针，实现“零拷贝”，彻底解决大模型上下文爆炸和数据越权问题。
4. **安全纵深的 Markdown 技能生态**：同样是零代码的 Markdown 技能定义，我们额外内置了三层防御体系（信任衰减 + 安全扫描 + 内容转义），确保你运行任何社区第三方技能时，宿主机和敏感数据绝对安全。

## vs Hermes / DeerFlow / OpenClaw / Cursor — 三平面任务进度（TSM v1.5）

多数 Agent 把 todo/plan 工具**默认挂进 Turn 1**，既膨胀 prompt，又无法在模型想早退时真正拦住。Myrm 将进度收敛为 **Planning（`todo_write`）+ Kanban 两个 opt-in 平面**，且**默认全关**（Turn1 近似零 Token 税）：

| 能力              | Myrm（2026-07-02）                                                                            | Hermes         | DeerFlow                  | OpenClaw / Cursor TodoWrite |
| --------------- | ------------------------------------------------------------------------------------------- | -------------- | ------------------------- | --------------------------- |
| 持久化 SSOT        | ✅ `.myrm/progress/todos.json` in sandbox                                                    | ❌ 内存 TodoStore | thread state              | 仅会话内                        |
| CompletionGuard | ✅ 读 workspace todos 再允许结束                                                                   | ❌              | ❌                         | ❌                           |
| 条件 bind         | ✅ 按需启用 (\~150 tok)                                                                          | 常默认挂载          | prompt 注入 write\_todos    | 常默认挂载                       |
| 单轨 progress     | ✅ Planning opt-in（无第二 checklist 轨）                                                          | 单 `todo`       | plan\_mode + write\_todos | TodoWrite                   |
| 进度 UI           | ✅ ProgressSteps 树 + step\_key merge（重发不重复）+ 移动端 `/mobile/status` 读 plan SSOT（MCP Chrome 已验） |                |                           |                             |

**用户收益**：只在 3+ 步任务时打开 Planning——聊天里实时看 todo 树，Goal 长任务自动启用，断线重连后沙箱与 Guard 仍对齐，且不为没用到的工具每轮多付 Token。

**验证（2026-07-03）**：harness progress + todo 条件加载 **38/38** + server planning 集成 **24/24（1 skipped）** + live LLM E2E **3/3**（含 resume 续聊更新 todo）+ frontend `tasksStepsMerge` **5/5**；修复 `task_workspace_root` 传递与 `workspace_todos_exist` 误判两个生产 Bug。产品 WebUI 已移除 `@playwright/test` 无头 CI，UI 集成走 **真实 Chrome MCP** + API prepare 脚本。

## 2026 最新核心优势总结 (对标 Hermes, OpenClaw, DeerFlow 等)

在众多开源 AI Agent 框架和产品中，Myrm Agent 凭借其**底层架构的鲁棒性**、**极致的用户体验**以及**企业级的安全隔离**脱颖而出：

### 1. 永不崩溃的底层自愈机制

在使用兼容 OpenAI 格式的 API 时，网络抖动或用户频繁取消往往会导致工具调用中断，历史记录残留无效的 `tool_call_id`，进而引发模型严格校验报错崩溃。
**我们的优势**：Myrm Agent 在框架最底层实现了透明的自愈机制（`SafetyWrappedChatModel`）。在每次向大模型发起请求前，系统会自动扫描并清理孤儿/无效的工具调用。无论网络如何抖动，对话历史永远保持纯净。彻底告别因格式错误导致的崩溃，鲁棒性远超竞品。

### 2. 独创的四级渐进式技能加载

为 Agent 配置大量技能通常会导致上下文窗口急剧膨胀，增加 Token 消耗并降低模型遵循指令的能力。
**我们的优势**：独创的四级渐进式加载策略，仅在真正需要时才将技能正文加载到上下文中，实现极低的 Token 消耗。支持 `/slash` 斜杠命令精确激活特定技能，将 Agent 的自主性与用户的精确控制完美结合。

### 3. Serverless 级沙箱休眠与秒级唤醒

传统的云端部署如果为每个用户保持一个常驻的沙箱实例，成本将极其高昂。
**我们的优势**：控制平面原生支持沙箱环境的空闲挂起与按需唤醒。用户离线时，100% 物理隔离的专属沙箱状态会被持久化并休眠；当收到新消息或定时任务触发时，瞬间唤醒。在保证隐私绝对安全的同时，极大降低了云端闲置成本。

### 4. 图表能力不臃肿

多数竞品内置沉重白板或只能手动排版；Myrm 把图表留在对话内，白板走 MCP 扩展。
**我们的优势**：**Mermaid 工件** + **render\_ui（A2UI v3.1）** 覆盖大多数场景。可编辑白板通过 **Excalidraw/tldraw MCP** 接入（与 Goose/Codex 插件同路线），核心零维护。

### 5. 极致的全渠道 IM 覆盖

许多竞品仅支持少数几个主流渠道，且不同渠道间的消息格式、媒体处理能力参差不齐。
**我们的优势**：原生支持 15+ 种渠道（Slack, Discord, Feishu, iMessage, WeChat, Telegram 等），真正做到“无处不在”。底层统一的媒体处理管道，确保无论在哪个平台，都能获得一致的 Markdown 渲染与交互体验。

### 6. 自然语言驱动的无人值守调度

绝大多数 Agent 只能作为“被动响应工具”，必须由用户主动触发才能工作。
**我们的优势**：内置强大的无人值守调度引擎。只需自然语言一句话（如“每天早上8点发简报”），Agent 即可化身主动工作的数字员工。支持 Webhook 推送和全渠道触达，从被动工具进化为主动服务。

### 7. 记忆去重与永远精简的大脑

在长期的多轮对话中，Agent 容易积累大量重复的事实，导致记忆库臃肿，检索精度断崖式下降。
**我们的优势**：底层的 `dedup_semantics` 机制在写入时严格过滤重复事实（相似度 ≥0.95 自动去重）。保持记忆库永远精简高效，确保 Agent “越用越懂你”的同时，绝不臃肿。

### 8. 拒绝静默失败的全链路反馈

批量操作无进度条、网络异常静默失败、文件“零引用”直接删除……这些都是竞品中常见的导致用户极度焦虑的设计。
**我们的优势**：全链路的 UI 进度反馈、明确的异常 Toast 提示与重试机制，任何跳出当前上下文的操作都有强视觉反馈。同时内置文件系统的“回收站”软删除机制，彻底消除数据丢失焦虑，提供真正的企业级安全感。

### 9. 行级并行文件冲突防护

当多个子代理同时编辑同一代码库时，文件冲突可能悄无声息地损坏代码。AWS 使用粗粒度的文件路径级互斥波次；OpenAI Codex 完全没有应用层保护。
**我们的优势**：三层纵深防御——L1 行级冲突检测（`check_conflict_pre_write`）精确阻断重叠行编辑并给出行范围信息；L2 `FileActivityTracker` 记录每个代理的写入行范围；L3 `apply_parallel_write_isolation` 检测到多写者时自动切换 `ISOLATED_COPY` 工作空间 + 延迟合并。同文件非重叠区域可并发写入（吞吐量比 AWS 方案翻倍）。任务完成时自动清理——零内存泄漏。**1,199 项测试验证通过，0 失败。**

### 10. 业界最完整的 HITL 安全审批体系

CopilotKit 等 SDK 框架仅提供简单的 Promise hook 审批（respond 后继续），无风险评估、无回滚、无批量审批。
**我们的优势**：Myrm 拥有完整的工程化 HITL 审批系统——命令逐段风险标注（safe/unknown/dangerous）+ 自然语言影响解释 + 截图 BBox 可视化上下文 + 文件级快照回滚（pre\_rollback 触发器）+ 外部副作用告警 + 批量审批 + 命令编辑二次验证 + 4 级 Allow-always 粒度 + 超时策略 + 跨平台通知 + 断线恢复 + AI 审核员智能拒绝。覆盖桌面、移动、Web 三端。**2,036 项安全测试验证通过（80 审批逻辑 + 42 命令解析 + 16 组件级 + 33 框架审批 + 1865 安全引擎）。**

### 11. 完整的开发者诊断工具链（非简单调试面板）

CopilotKit 提供简单的浮动调试面板 + console.log；Myrm 提供完整的产品级诊断体系。
**我们的优势**：66+ SSE 事件全部可视化渲染 + Browser/Desktop 实时视图与元素检查 + Eval Lab 评测实验室（8 种断言 + 图表历史）+ 分布式追踪（W3C traceparent）+ 会话统计分析 + 记忆健康仪表盘 + 审计日志 + 会话录制回放 + 配额监控 + 上下文健康面板。**84 项诊断测试验证通过。**
