jevcumber
把 Gherkin 测试步骤映射成浏览器操作
实现思路与验证边界 →JEV GUIDE
Jev 可以参与界面操作中的选择,但浏览器连接、元素读取和点击仍由工具完成。这里比较两个已收录实现,帮助你设计自己的自动化测试或桌面操作流程。
jevcumber 从 Gherkin 步骤和页面控件中构造候选,让 Jev 选择动作、元素及输入值,再由 Playwright 执行。其冻结模式重放锁文件,不调用 Jev;包含语义判断的断言仍有不同限制。
在已核对的 Jev-cu 版本中,传给 Jev 的是界面无障碍树中的文字候选,读取和执行由 Codex Computer Use 完成。不能据此推断 Jev 自身具备截图识别能力,也不能把作者展示的提速直接套用到其他应用。
编辑建议:读取页面版本与可见控件 → 构造有限候选及“无合适目标” → 选择 → 再检查目标仍存在 → 执行一次 → 读取新状态。每步保留目标标识与结果,不让多步动作共用过期页面快照。
合成示例:页面上有“保存草稿”和“发布”。目标是保存草稿时,两者应为不同候选;即使选中了某个按钮,应用仍要检查用户授权和预期页面结果。
分别测试首次解析和锁文件回放。回放通过只说明已记录动作仍可执行,不能证明当前模型会作出正确选择。
编辑建议的边界样本包括:两个同名按钮、目标被弹窗遮挡、页面在请求期间变化、网络超时,以及任务已完成但模型仍建议动作。记录成功完成率、错误操作和拒绝率;低置信度或无合适目标时停止并暴露原因。本站未运行这两个项目。
把 Gherkin 测试步骤映射成浏览器操作
实现思路与验证边界 →让 Jev 为 Codex Computer Use 选择下一步
实现思路与验证边界 →03 / JEV GUIDE
学习 Jev 提示词的任务拆分与题型选择,用原创反馈分流示例区分 Choice、Score、Noul,并设计边界样本。
阅读指南 →04 / JEV GUIDE
了解 Jev MCP 的接入流程、evaluate 工具输入和 API 密钥边界,对比通用判断工具与专项 MCP 项目的使用方式。
阅读指南 →14 / JEV GUIDE
比较 Jev 判断模型与生成式 LLM 的任务边界,用改写评估和脚本审核案例理解混合架构,不把固定输出当成事实正确或性能保证。
阅读指南 →