Skip to main content

技能自进化

Myrm 的技能进化引擎自动将成功的交互转化为可复用技能。不同于简单的 prompt 存储,引擎运行完整管线:轨迹分析 → 结构化提取 → 自动筛选 → 沙箱验证 → LLM 评审 → GUI 人工审批。

独创双层感知按需加载与零冗余进化

传统 Agent 框架的技能通常是静态的一坨 Prompt,堆积越多上下文占用越恐怖,导致 LLM “失焦”与降智。而 Myrm Agent 则采用了独创的 安全 XML 摘要与 L1/L2 双层感知按需加载架构
  1. L1 极速感知:Agent 会话开始时,系统仅将全部技能的“名称与摘要”以极低 Token 的安全 XML 结构注入提示词(犹如人的工作技能目录)。
  2. L2 按需调度:当 Agent 判断当前任务需要某项技能时,会通过独家的 skill_select_tool 动态将完整的 SOP 与资源文件调入当前会话上下文。
这使得你即便沉淀了 1000 个复杂的业务技能,Agent 的反应依然轻快敏捷。 此外,Myrm 摒弃了纯文本的手写模式,内置强大的 skill_manage_tool 脚手架,一键帮你进行安全扫描、YAML 校验和防重名处理。当执行过程发现技能有瑕疵时,Agent 拥有 FIX/Patch 实时修正能力,能够当场修补技能文件,实现从“报错 -> 反思 -> 修正 -> 复用”的完美闭环,是真正的零冗余进化。

工作原理

  1. 轨迹分析 — 每次对话后,TraceAnalyzer 以 5 层渐进式披露提取执行轨迹,识别值得固化为技能的模式。
  2. 结构化提取StructuredExtractor 利用 LLM 捕获技能定义并附带置信度评分,确保只有高质量模式被提升。
  3. 两阶段准入过滤EvolutionScreener 结合策略冷却与 LLM FIX 确认,自动过滤低质量或重复提取,阻止盲目自进化。
  4. AST 语法与沙箱隔离执行验证SandboxValidator 在隔离子进程中真实 dry-run 验证候选技能执行,检查语法结构且确保运行无崩溃。
  5. 底层强制安全写入拦截ScanningSkillWriteBackend 对所有候选技能进行高危指令、提权和注入扫描。
  6. 多维度 Rubric LLM 评审BatchEvaluator 自动从准确性、抗碎片化、冗余度等多维度由评测模型独立打分。
  7. 回归门控 — 自动生成的测试用例(EvalCase)对每个候选变体进行回归验证,确保修改不会破坏已有的正确行为。
  8. 进化质量守护 (Improvement Gate) — 原版技能作为 baseline 候选注入评分竞争,与所有进化变体同台 PK。仅当变体真正优于原版时才允许进化——即使所有变体在孤立评估中”看起来不错”,也无法绕过此关卡退化。
  9. 人工审批与 Monaco Diff 终审 — 未经你同意,任何技能都不会上线。在待审进化面板中通过 Monaco DiffEditor 细粒度审阅、修订或审批。

从任意来源学习技能(/learn

把目录、URL 或流程说明交给 Agent,它会在对话中收集素材并生成待审草稿。WebUI、渠道与云沙箱共用同一套 server 创作标准。 设置 → 技能 → 已安装 → 学习技能
  1. 填写目录URL自由文本(可任意组合)。
  2. 点选场景 chip(SDK/API、刚完成的部署、Debug 路径、写作目录、发布 SOP)预填说明。
  3. 开始学习 — 无需先打开对话,会自动创建会话并提交 learn 任务。
  4. 草稿就绪后在待审核草稿中采纳。
  5. 采纳后复制 [use 技能名] 前缀,或在智能体设置中绑定 slash 命令。
也可在对话中用 slash /learn,或点 assistant 消息上的提炼为技能

审核待定技能

  1. 进入 设置 → 技能 → 待审进化
  2. 列表网格视图浏览提案。
  3. 对每个提案:
    • 批准 — 立即部署技能。
    • 拒绝 — 丢弃提案。
    • 修订 — 在 Monaco diff 编辑器中编辑后再批准。
  4. 批准的技能将在未来对话中供 Agent 使用。

变体测试

当 Myrm 检测到技能可改进时,会生成变体并进行 A/B 对比。你可以在 Shadow GUI 面板中查看变体结果,确认后再推广到生产。

版本历史与回滚

每次技能变更都有记录:
  • 历史面板 — 完整进化时间线及 diff。
  • 质量增量徽章 — 每条进化记录标注进化前后的质量得分(如 Before: 62% → After: 78%),一眼看清这次变更是否真的让技能变好——而不只是改了哪里。
  • 版本面板 — 任意两个版本并排对比。
  • 一键回滚 — 瞬间恢复到任何历史版本。
草稿审批通过/拒绝后,变更会通过统一事件通道实时同步到成长中心、进化拒绝看板与导航徽章——所有审核入口保持一致,无需手动刷新。

批量优化

对于大型技能库:
  1. 进入 设置 → 技能 → 批量优化
  2. 点击运行优化 — 引擎评估所有技能的改进机会。
  3. 审核批次快照,逐一批准/拒绝。
  4. 支持批次中途回滚。

后台复盘

Myrm 在空闲时段运行 4 种后台异步任务:
  • 从成功对话中静默提取技能
  • 压缩冗长技能以降低 Token 消耗
  • 挫败感检测 → 自动生成修复变体
  • 清理低价值技能
所有后台变更仍需你批准后才会部署。

会话级 Skill 精选

当你的 Agent Profile 绑定了很多技能时,并非每个技能都与每次对话相关。会话级 Skill 精选让你可视化选择当前对话需要加载的技能,减少 Token 消耗并提高 AI 决策精度。
  1. 打开任意 Agent 模式的对话。
  2. 点击消息输入框旁的星火图标(✦)—— 即 Session Skills 切换按钮。
  3. 弹出面板列出所有全局启用的技能。取消勾选本次对话不需要的技能。
  4. 你的选择会持久化到服务端,页面刷新、上下文压缩甚至对话分叉后都会保留。
  5. 要恢复加载所有技能,点击面板顶部的清除覆盖
切换到其他 Agent 时,会话技能覆盖会自动清空——确保你总是从新 Agent 的完整技能集开始。

内置预置技能

除了自进化技能,Myrm 还内置 53+ 预置技能,开箱即用。重要示例:
  • 数据分析 — 六阶段完整工作流(Ingest → Clean → Explore → Analyze → Visualize → Report),内含自动数据质量校验和风险预警,支持 CSV、JSON、Excel 和数据库查询。
  • 数据分析管线 — 多 Agent 版本:四个专业角色(采集员 → 分析师 → 可视化师 → 报告撰写人)并行协作。可输出 HTML 交互式报告、PDF、Jupyter Notebook、Markdown 或 PPT 大纲。
  • 深度研究 — 多步 Web 研究,带来源验证。
  • 代码审查 — 自动代码审查,含安全与性能检查。
  • 前端开发测试驱动开发系统化调试 — 开发工作流技能。
预置技能在启动时自动同步,可在设置 GUI 中自定义、禁用或恢复默认值。
Matplotlib 图表通过零拷贝 vault:// 指针内联渲染——无需 Jupyter 服务器。在没有基础设施负担的情况下获得 Jupyter 级别的可视化效果。

核心数据

技能市场

Myrm 集成 7 大发现源,在统一 GUI 中搜索、标签过滤、按星数/下载量排序、安全扫描预览、一键安装: 更多市场能力:
  • URL 导入 — 从任意 URL 安装(GitHub 仓库、ZIP 包等)
  • Monorepo 自动发现 — 粘贴一个 GitHub monorepo URL,系统自动发现内部所有可安装技能,无需手动指定子目录
  • 自动更新 — 检测上游更新并通过隔离区安全更新
  • 三方哈希保护 — 用户对预置技能的修改在升级时被保留;仅当用户未自定义时静默应用上游更新
  • 技能同步 — 跨设备 push/pull 同步
  • Curator — 自动生命周期管理(过时检测 → 归档 → 清理)
  • 合并去重 — 自动合并重叠或重复的技能
  • 安全脱敏导出 — 下载 ZIP 时自动剥离密钥

浏览器操作录制与智能脱敏生成

除了对话提取外,Myrm 还支持将你在真实浏览器中的操作一步转化为 Agent 技能(SKILL.md):
  • CDP 结构化 DOM 捕获 — 基于 Patchright/CDP 协议,仅捕获目标标签页内的结构化操作事件(点击、表单输入、下拉选择),天然隔离桌面窗口与外部应用,杜绝录屏泄露隐私。
  • HTML5 敏感属性源头感知 — 自动识别 type="password"current-passwordcredit-card-number 等标准敏感令牌,标记为敏感交互。
  • 序列化层强制掩码脱敏 — 在所有事件流与 LLM 提示词中对敏感字段值执行强制掩码(***),从源头阻断明文外传。
  • 凭证库宏解耦 (fill_credential) — 录制涉及的密码字段自动映射为 fill_credential "<label>" 规范,引导 Agent 运行时通过受控 CredentialVault 安全注入,零明文固化。

对比竞品

为什么 AI 原生技能胜过确定性脚本

传统浏览器自动化工具生成确定性代码,网站改版后脚本就会崩溃,需要”自测循环”来检测并重新生成脚本。 Myrm 采用根本不同的方式: 这种架构意味着:
  • 无需”自测”步骤 — 技能由 AI 解释执行,自动适应当前页面状态。
  • 网站改版无需重建 — SelfHealingLocator 在布局变更后仍能找到元素。
  • 自动修复 — 若技能确实失败,FIX evolution 类型会自动修补,无需用户干预。

桌面跨应用工作流录制与技能生成器

将人类在桌面上的多软件协同操作无感捕获并编译为高鲁棒、可泛化的智能体自动化技能:
  1. 跨应用操作录制 — 进入 设置 → 技能管理 → Curator,点击 录制工作流。在电脑上演示一次跨应用流程(例如:从 Excel 导出报表、浏览器访问政务/ERP 后台查询、并更新系统记录)。
  2. 意图提炼与参数化提取 — 后端自动聚类分析原始事件流(app_switch, click, type, clipboard),过滤无效冗余操作,并将表单输入自动抽象为动态参数插槽({{input_val_*}})。
  3. Native-Tool-First 确定性编译 — 纯算法编译器将 UI 动作优先提升为 Agent 系统级工具(browser_navigate_tool, shell_execute, http_request),生成规范的 SKILL.md,彻底规避脆弱的屏幕坐标回放。
  4. 可视化审查向导与一键入库 — 提供四阶段交互向导,支持自由调整步骤、增删参数、预览编译源码,并一键发布至本地技能库供所有智能体即时调度。