技能自进化
Myrm 的技能进化引擎自动将成功的交互转化为可复用技能。不同于简单的 prompt 存储,引擎运行完整管线:轨迹分析 → 结构化提取 → 自动筛选 → 沙箱验证 → LLM 评审 → GUI 人工审批。独创双层感知按需加载与零冗余进化
传统 Agent 框架的技能通常是静态的一坨 Prompt,堆积越多上下文占用越恐怖,导致 LLM “失焦”与降智。而 Myrm Agent 则采用了独创的 安全 XML 摘要与 L1/L2 双层感知按需加载架构:- L1 极速感知:Agent 会话开始时,系统仅将全部技能的“名称与摘要”以极低 Token 的安全 XML 结构注入提示词(犹如人的工作技能目录)。
- L2 按需调度:当 Agent 判断当前任务需要某项技能时,会通过独家的
skill_select_tool动态将完整的 SOP 与资源文件调入当前会话上下文。
skill_manage_tool 脚手架,一键帮你进行安全扫描、YAML 校验和防重名处理。当执行过程发现技能有瑕疵时,Agent 拥有 FIX/Patch 实时修正能力,能够当场修补技能文件,实现从“报错 -> 反思 -> 修正 -> 复用”的完美闭环,是真正的零冗余进化。
工作原理
- 轨迹分析 — 每次对话后,
TraceAnalyzer以 5 层渐进式披露提取执行轨迹,识别值得固化为技能的模式。 - 结构化提取 —
StructuredExtractor利用 LLM 捕获技能定义并附带置信度评分,确保只有高质量模式被提升。 - 两阶段准入过滤 —
EvolutionScreener结合策略冷却与 LLM FIX 确认,自动过滤低质量或重复提取,阻止盲目自进化。 - AST 语法与沙箱隔离执行验证 —
SandboxValidator在隔离子进程中真实 dry-run 验证候选技能执行,检查语法结构且确保运行无崩溃。 - 底层强制安全写入拦截 —
ScanningSkillWriteBackend对所有候选技能进行高危指令、提权和注入扫描。 - 多维度 Rubric LLM 评审 —
BatchEvaluator自动从准确性、抗碎片化、冗余度等多维度由评测模型独立打分。 - 回归门控 — 自动生成的测试用例(EvalCase)对每个候选变体进行回归验证,确保修改不会破坏已有的正确行为。
- 进化质量守护 (Improvement Gate) — 原版技能作为 baseline 候选注入评分竞争,与所有进化变体同台 PK。仅当变体真正优于原版时才允许进化——即使所有变体在孤立评估中”看起来不错”,也无法绕过此关卡退化。
- 人工审批与 Monaco Diff 终审 — 未经你同意,任何技能都不会上线。在待审进化面板中通过 Monaco DiffEditor 细粒度审阅、修订或审批。
从任意来源学习技能(/learn)
把目录、URL 或流程说明交给 Agent,它会在对话中收集素材并生成待审草稿。WebUI、渠道与云沙箱共用同一套 server 创作标准。
设置 → 技能 → 已安装 → 学习技能
- 填写目录、URL、自由文本(可任意组合)。
- 点选场景 chip(SDK/API、刚完成的部署、Debug 路径、写作目录、发布 SOP)预填说明。
- 点开始学习 — 无需先打开对话,会自动创建会话并提交 learn 任务。
- 草稿就绪后在待审核草稿中采纳。
- 采纳后复制
[use 技能名]前缀,或在智能体设置中绑定 slash 命令。
/learn,或点 assistant 消息上的提炼为技能。
审核待定技能
- 进入 设置 → 技能 → 待审进化。
- 以列表或网格视图浏览提案。
- 对每个提案:
- 批准 — 立即部署技能。
- 拒绝 — 丢弃提案。
- 修订 — 在 Monaco diff 编辑器中编辑后再批准。
- 批准的技能将在未来对话中供 Agent 使用。
变体测试
当 Myrm 检测到技能可改进时,会生成变体并进行 A/B 对比。你可以在 Shadow GUI 面板中查看变体结果,确认后再推广到生产。版本历史与回滚
每次技能变更都有记录:- 历史面板 — 完整进化时间线及 diff。
- 质量增量徽章 — 每条进化记录标注进化前后的质量得分(如
Before: 62% → After: 78%),一眼看清这次变更是否真的让技能变好——而不只是改了哪里。 - 版本面板 — 任意两个版本并排对比。
- 一键回滚 — 瞬间恢复到任何历史版本。
批量优化
对于大型技能库:- 进入 设置 → 技能 → 批量优化。
- 点击运行优化 — 引擎评估所有技能的改进机会。
- 审核批次快照,逐一批准/拒绝。
- 支持批次中途回滚。
后台复盘
Myrm 在空闲时段运行 4 种后台异步任务:- 从成功对话中静默提取技能
- 压缩冗长技能以降低 Token 消耗
- 挫败感检测 → 自动生成修复变体
- 清理低价值技能
会话级 Skill 精选
当你的 Agent Profile 绑定了很多技能时,并非每个技能都与每次对话相关。会话级 Skill 精选让你可视化选择当前对话需要加载的技能,减少 Token 消耗并提高 AI 决策精度。- 打开任意 Agent 模式的对话。
- 点击消息输入框旁的星火图标(✦)—— 即 Session Skills 切换按钮。
- 弹出面板列出所有全局启用的技能。取消勾选本次对话不需要的技能。
- 你的选择会持久化到服务端,页面刷新、上下文压缩甚至对话分叉后都会保留。
- 要恢复加载所有技能,点击面板顶部的清除覆盖。
内置预置技能
除了自进化技能,Myrm 还内置 53+ 预置技能,开箱即用。重要示例:- 数据分析 — 六阶段完整工作流(Ingest → Clean → Explore → Analyze → Visualize → Report),内含自动数据质量校验和风险预警,支持 CSV、JSON、Excel 和数据库查询。
- 数据分析管线 — 多 Agent 版本:四个专业角色(采集员 → 分析师 → 可视化师 → 报告撰写人)并行协作。可输出 HTML 交互式报告、PDF、Jupyter Notebook、Markdown 或 PPT 大纲。
- 深度研究 — 多步 Web 研究,带来源验证。
- 代码审查 — 自动代码审查,含安全与性能检查。
- 前端开发、测试驱动开发、系统化调试 — 开发工作流技能。
Matplotlib 图表通过零拷贝 vault:// 指针内联渲染——无需 Jupyter 服务器。在没有基础设施负担的情况下获得 Jupyter 级别的可视化效果。
核心数据
技能市场
Myrm 集成 7 大发现源,在统一 GUI 中搜索、标签过滤、按星数/下载量排序、安全扫描预览、一键安装:
更多市场能力:
- URL 导入 — 从任意 URL 安装(GitHub 仓库、ZIP 包等)
- Monorepo 自动发现 — 粘贴一个 GitHub monorepo URL,系统自动发现内部所有可安装技能,无需手动指定子目录
- 自动更新 — 检测上游更新并通过隔离区安全更新
- 三方哈希保护 — 用户对预置技能的修改在升级时被保留;仅当用户未自定义时静默应用上游更新
- 技能同步 — 跨设备 push/pull 同步
- Curator — 自动生命周期管理(过时检测 → 归档 → 清理)
- 合并去重 — 自动合并重叠或重复的技能
- 安全脱敏导出 — 下载 ZIP 时自动剥离密钥
浏览器操作录制与智能脱敏生成
除了对话提取外,Myrm 还支持将你在真实浏览器中的操作一步转化为 Agent 技能(SKILL.md):
- CDP 结构化 DOM 捕获 — 基于 Patchright/CDP 协议,仅捕获目标标签页内的结构化操作事件(点击、表单输入、下拉选择),天然隔离桌面窗口与外部应用,杜绝录屏泄露隐私。
- HTML5 敏感属性源头感知 — 自动识别
type="password"及current-password、credit-card-number等标准敏感令牌,标记为敏感交互。 - 序列化层强制掩码脱敏 — 在所有事件流与 LLM 提示词中对敏感字段值执行强制掩码(
***),从源头阻断明文外传。 - 凭证库宏解耦 (
fill_credential) — 录制涉及的密码字段自动映射为fill_credential "<label>"规范,引导 Agent 运行时通过受控CredentialVault安全注入,零明文固化。
对比竞品
为什么 AI 原生技能胜过确定性脚本
传统浏览器自动化工具生成确定性代码,网站改版后脚本就会崩溃,需要”自测循环”来检测并重新生成脚本。 Myrm 采用根本不同的方式:
这种架构意味着:
- 无需”自测”步骤 — 技能由 AI 解释执行,自动适应当前页面状态。
- 网站改版无需重建 — SelfHealingLocator 在布局变更后仍能找到元素。
- 自动修复 — 若技能确实失败,FIX evolution 类型会自动修补,无需用户干预。
桌面跨应用工作流录制与技能生成器
将人类在桌面上的多软件协同操作无感捕获并编译为高鲁棒、可泛化的智能体自动化技能:- 跨应用操作录制 — 进入 设置 → 技能管理 → Curator,点击 录制工作流。在电脑上演示一次跨应用流程(例如:从 Excel 导出报表、浏览器访问政务/ERP 后台查询、并更新系统记录)。
- 意图提炼与参数化提取 — 后端自动聚类分析原始事件流(
app_switch,click,type,clipboard),过滤无效冗余操作,并将表单输入自动抽象为动态参数插槽({{input_val_*}})。 - Native-Tool-First 确定性编译 — 纯算法编译器将 UI 动作优先提升为 Agent 系统级工具(
browser_navigate_tool,shell_execute,http_request),生成规范的SKILL.md,彻底规避脆弱的屏幕坐标回放。 - 可视化审查向导与一键入库 — 提供四阶段交互向导,支持自由调整步骤、增删参数、预览编译源码,并一键发布至本地技能库供所有智能体即时调度。