浏览器的下一步,
交给 Jev 判断。
jev-ultrafast 读取页面中的控件,让 Jev 一次选出操作和目标;需要输入文字时,再交给文本模型。
航班搜索任务中位耗时
同任务 · 优化后 3 次运行
作者报告的单一任务结果,本站未复测;不能外推到所有浏览器任务。
搜索苏黎世到伦敦的航班
读取 DOM 控件
observe选择输入框或按钮
decide执行并检查页面状态
actJEV, IN PRACTICE 从判断,到行动。
浏览 122 个真实项目与公开演示,
找到值得复用的思路,开始自己的实验。
jev-ultrafast 读取页面中的控件,让 Jev 一次选出操作和目标;需要输入文字时,再交给文本模型。
航班搜索任务中位耗时
同任务 · 优化后 3 次运行
作者报告的单一任务结果,本站未复测;不能外推到所有浏览器任务。
搜索苏黎世到伦敦的航班
读取 DOM 控件
observe选择输入框或按钮
decide执行并检查页面状态
actLEARN & BUILD
从 API 入门到检索、自动化与模型选型,18 篇指南连接具体应用案例。
01 / JEV GUIDE
了解 TypeSafe Jev 模型的输入、输出与适用任务,通过浏览器操作、MCP 和上下文筛选案例判断是否适合你的项目。
阅读指南 →02 / JEV GUIDE
用一个合成故障报告了解 Jev API 请求,查看 state、questions、Bearer 鉴权和响应检查步骤,附可下载 JSON 示例。
阅读指南 →05 / JEV GUIDE
比较 Winnow 与 fast-jev-compaction 的介入时机、保留方式和失败检查,了解 Jev 如何用于 Claude Code 上下文管理。
阅读指南 →07 / JEV GUIDE
把 Jev 接在召回之后:定义相关性问题、保留候选来源、区分网页摘要与全文,并用标注查询检查排序是否改善。
阅读指南 →10 / JEV GUIDE
了解 TypeSafe AI 社区节点的自托管前提、State 和 Choice 输出,设计邮件分流、人工复核和有界重试流程。
阅读指南 →14 / JEV GUIDE
比较 Jev 判断模型与生成式 LLM 的任务边界,用改写评估和脚本审核案例理解混合架构,不把固定输出当成事实正确或性能保证。
阅读指南 →EXPLORE THE COLLECTION
122 个公开项目与演示 · 按用途与验证证据筛选
让 Jev 选择浏览器操作
输入 · 任务目标与 DOM 控件
作者在同一航班任务的 3 组对照中记录了优化后 7.092 秒中位耗时;初始导航不计入计时,不能外推为通用浏览器基准。
资料核对 2026-09-19 · 本站未进行运行复测
在桌面应用中选控件与动作
输入 · 原生无障碍树和操作目标
Jev 功能位于 agent-desktop 的独立 skill/scripts 中;快照采集也有成本,不能把推理延迟当作整体耗时。
资料核对 2026-09-19 · 本站未进行运行复测
在 Android 手机上完成界面操作
输入 · 手机状态、可操作控件与任务
作者的 Uber 视频到达付款选择,未展示订车完成;深色模式另有校验演示。本站未跑真机。
资料核对 2026-09-19 · 本站未进行运行复测
为网页元素分类并生成隐藏规则
输入 · 网页候选元素及上下文
隐藏同意弹窗不等于同意或拒绝;模型回答异常时保留旧规则。本站未验收浏览器效果。
资料核对 2026-09-19 · 本站未进行运行复测
边说话,边判断浏览器下一步
输入 · 实时部分转录与网页元素快照
语音转写和浏览器控制由其他组件完成;作者延迟与费用未由本站复测,语音确认不等同安全保证。
资料核对 2026-09-19 · 本站未进行运行复测
让 Jev 为 Codex Computer Use 选择下一步
输入 · 任务目标与界面无障碍树中的文字候选,不向 Jev 传截图
作者展示了 Mac 日历操作对比并描述提速;本站仅核对原帖及固定版本源码,未复测速度、Token 用量或跨 App 成功率。需要 Codex 桌面 cua_repl 与 TypeSafe API 配置;主循环默认 dry-run,实际执行受本地策略约束。
资料核对 2026-09-19 · 本站未进行运行复测
按内容类型整理 X 时间线
输入 · 帖子、回复及其上下文
机器写作概率不能证明作者身份。依赖 X 页面结构和用户 API 配置,内容会发往模型;本站未验证分类准确率。
资料核对 2026-09-19 · 本站未进行运行复测
预测你下一步想切换到哪个 Mac 应用
输入 · 近期应用切换记录、停留时间和候选应用
目前实现的是应用切换;标签页切换仍是计划。需辅助功能权限与 API 配置,切换记录会参与推理;本站未在真实设备上验收。
资料核对 2026-09-19 · 本站未进行运行复测
把 Gherkin 测试步骤映射成浏览器操作
输入 · 测试步骤中的字面值和当前页面真实控件候选
首次解析或页面变化可能调用 Jev,冻结回放则不调用。低置信度会拒绝猜测;不保证跨网站通用,本站未复跑作者的浏览器示例。
资料核对 2026-09-19 · 本站未进行运行复测
把浏览器元素选择记录成可重放的操作轨迹
输入 · 当前网页标题、网址、可见交互元素候选和本步操作意图
判断基于文本候选,不是像素视觉理解;候选截断可能漏掉元素。回放不调用模型但仍需目标网页,启用执行回放会重做动作。“done” 仍需成功条件验证,作者速度和准确率未独立复测。
资料核对 2026-09-21 · 本站未进行运行复测
用 Jev 折叠 Facebook 信息流噪音
输入 · 信息流帖子片段、用户的过滤条件和白名单
帖子片段会发送到 TypeSafe 或用户配置的端点,API 密钥保存在浏览器本地。请求失败时放行帖子;作者的时延和界面效果未由本站复测。
资料核对 2026-09-24 · 本站未进行运行复测
用 Jev 选择 iOS 模拟器与 Android 界面的下一步操作
输入 · 任务目标、屏幕可访问性标签、操作历史和用户提供的命名文本
MIT 开源;要求 macOS 15+ 和 sim-use,不支持真实 iPhone。界面标签和可见值会发往 Jev;动作阈值不等于人工批准或安全保证,测试应使用隔离设备。本站未安装或复测速度。
资料核对 2026-09-25 · 本站未进行运行复测
为每轮 Codex 任务选择模型
输入 · 当前任务与此前对话
约 60% 的节省来自 237 轮历史回放的标价重算;固定 token 用量,未计跨模型缓存失效,不是已付账单下降。
资料核对 2026-09-19 · 本站未进行运行复测
把概率接到明确的应用策略
一轮判断完成客服分流
按邮件意图选择 LangGraph 分支
输入 · 模拟邮件的发件人、主题与正文
使用模拟邮件,处理器只更新图状态,不发邮件、不付款。示例的 10 条数据不是准确率基准;低置信度没有独立人工分支,本站未实测。
资料核对 2026-09-19 · 本站未进行运行复测
把飞书群消息分到个人工作看板
输入 · 选定群的近期文字消息、用户身份和职责描述
只有确认分类后才把选定消息发给 TypeSafe;目前不理解图片、文件或语音,不自动回复或执行任务。默认阈值未按业务数据校准,本站未验证真实飞书和模型运行。
资料核对 2026-09-20 · 本站未进行运行复测
在 n8n 中把不确定判断交给复核分支
输入 · 从工作流数据中选择的字段、文本或 JSON,以及分类、评分和是非问题
社区节点,非 TypeSafe 官方产品;作者说明尚未经 n8n Cloud 验证。API 错误默认使节点失败,启用 Continue On Fail 才转复核。作者的小样本结果不代表业务准确率;本站未运行复测。
资料核对 2026-09-23 · 本站未进行运行复测
用 Jev 选择 Pi 当前模型的思考强度
输入 · 当前任务、筛选后的最近对话和当前模型支持的档位
Jev 是可选后端,项目不会切换模型。启用后会把选取的对话上下文发送给 TypeSafe,默认不自动脱敏;本站未验证实际节省或任务效果。
资料核对 2026-09-24 · 本站未进行运行复测
从已安装的工具与 Skill 中推荐 Codex 下一步可用能力
输入 · 本地识别的任务类别、领域和角色,以及经过筛选的候选能力元数据
Apache-2.0 开源;Jev 排序是可选功能,本地降级不代表模型已选择。远程请求使用粗粒度元数据,建议不会执行工具或授予权限;Hook 是否送达依赖宿主、信任设置和新会话,暂无稳定效率提升证据。本站未运行。
资料核对 2026-09-25 · 本站未进行运行复测
给工具输出做可召回的筛选
输入 · Read、Bash、Grep 输出块
检测到错误时保留原输出;支持其他判断后端。筛选效果依赖任务和阈值,本站未复测。
资料核对 2026-09-19 · 本站未进行运行复测
压缩旧工具记录,保留原文
输入 · 对话、工具调用及结果引用
避免改写不等于完全无损;关键上下文仍可能被误删,需结合实际会话检查。
资料核对 2026-09-19 · 本站未进行运行复测
只加载当前任务相关的技能说明
输入 · 项目上下文与已安装技能
仓库附有作者评测;节省上下文不能以隐藏必需技能为代价,本站未复测。
资料核对 2026-09-19 · 本站未进行运行复测
保留日志,筛选值得深查的信号
输入 · OpenTelemetry 日志记录
项目为 preview;省下大模型分析不等于减少原始归档,本站未测实际业务收益。
资料核对 2026-09-19 · 本站未进行运行复测
探索减少记忆检索的上下文消耗
输入 · 自定义记忆系统;具体输入未公开
作者称 token 减少 94%、检索快 2–3 倍,同时强调只是快速测试。缺少公开实现和可比测试条件。
资料核对 2026-09-19 · 本站未进行运行复测
让新证据触发旧记忆的失效检查
输入 · 已有记忆、来源信息与新发生的事件
这是记忆状态管理层,不是记忆数据库的替代品。不同存储适配器的验证深度不同;作者评测结果未由本站复测。
资料核对 2026-09-19 · 本站未进行运行复测
判断哪个 tmux 窗格需要关注
输入 · 任务目标、选定窗格的元数据与最近终端输出
终端文本会发送到 TypeSafe。判断结果不授予操作权限,也不验证任务完成;匿名成功计数可能被误判为完成,必须另查本次任务证据。本站未运行复测。
资料核对 2026-09-23 · 本站未进行运行复测
沿风险信号展开代码审查
输入 · Git diff 或完整代码库
作者定位为实验;发现是审查线索,不能直接当作缺陷证明,尚未集成编译器和静态分析器。
资料核对 2026-09-19 · 本站未进行运行复测
给编码 Agent 分诊与复核能力
输入 · 任务、代码变更、测试日志或审查意见
提供判断而不接管编程;报告仍需主 Agent 检查,本站未执行测试集。
资料核对 2026-09-19 · 本站未进行运行复测
给编码工人加进度监督
输入 · Codex 工作状态和验证证据
必须通过程序员指定的验收命令;乐观评分或进程成功退出都不能替代验证。
资料核对 2026-09-19 · 本站未进行运行复测
按语义梳理 Git 提交历史
输入 · Git 提交说明与代码差异
分类结果用于筛选候选提交,不等同于安全审计。需要 TypeSafe API;本站未复测分类准确率或运行成本。
资料核对 2026-09-19 · 本站未进行运行复测
按概念影响范围给 GitHub PR 打标签
输入 · 拉取请求的描述、差异和上下文证据
使用固定标签体系,规模判断不是按代码行数。dry-run 不写 GitHub 但仍会调用付费 Jev;标签不应自动授权合并,本站未对真实 PR 运行。
资料核对 2026-09-19 · 本站未进行运行复测
在测试中判断页面或返回结果是否满足语义要求
输入 · 捕获的 JSON 或 Playwright 页面状态,以及自然语言写出的断言
无密钥示例使用 FakeProvider 的脚本化答案,不进行语义理解。捕获状态会发送给配置的服务;精确计数和字符串应保留普通断言,本站未验证真实模型断言准确率。
资料核对 2026-09-20 · 本站未进行运行复测
用语义判断在目录树里找文件
输入 · 自然语言问题与文件、目录名
使用文件树遍历和 walkers,无需向量索引;没有据此验证通用检索准确率或加速倍数。
资料核对 2026-09-19 · 本站未进行运行复测
一步一步选择知识图谱关系
输入 · 当前节点、邻接关系与目标
需有效 TypeSafe key 才能进行真实推理;无 key 的示例会使用注明的替代结果。未验证大规模图谱性能。
资料核对 2026-09-19 · 本站未进行运行复测
在 SQL 里按含义筛选数据库行
输入 · 数据库行与自然语言条件
是调用外部模型的扩展;无索引不等于查询无成本,本站未做规模或吞吐测试。
资料核对 2026-09-19 · 本站未进行运行复测
选择搜索来源,再排序结果
输入 · 用户查询与多个引擎的候选结果
搜索由 Search1API 和各引擎执行;Jev 的选择不代表覆盖全部来源,也不保证每条结果正确。
资料核对 2026-09-19 · 本站未进行运行复测
将大分类目录拆成逐层选择
输入 · JSON 分类树和用户目标
逐层调用解决候选集规模问题,但上游错误可能影响最终分类;本站未测准确率。
资料核对 2026-09-19 · 本站未进行运行复测
改单元格时触发多项检查
输入 · 正在编辑的单元格;具体问题未公开
仅核对到作者演示帖文;未公开检查清单、误报率与完整源码,不能视为已验证的数据校验产品。
资料核对 2026-09-19 · 本站未进行运行复测
从研究报告中定位可核对的原文证据
输入 · 研究报告及补充材料切分出的带编号文本行,以及资料提取问题
原文件在浏览器处理,但推理所需文本仍会发往模型服务。引用原文并不保证选对证据,需人工核对;本站未验证系统综述准确率。
资料核对 2026-09-19 · 本站未进行运行复测
核对论文引用是否支持对应论述
输入 · 稿件中的引用句及所引文献的全文、摘要或已定位片段
部分文献只能获取摘要,不能把摘要未提及当成全文不支持。可结合 Claude 定位证据;模型阈值尚未在标注集上验证,本站未实测。
资料核对 2026-09-19 · 本站未进行运行复测
对 Google 搜索结果重新排序
输入 · 查询词和搜索结果的标题、域名、URL 与摘要
只分析搜索摘要,不读取目标网页全文;交易型搜索采用不同规则。仅匹配所支持的 Google 域名,本站未验证排序质量。
资料核对 2026-09-19 · 本站未进行运行复测
按自然语言匹配规则关联两张数据表
输入 · 两组记录中的候选配对、指定字段和用户定义的同一实体规则
未进入候选的真实匹配无法被模型补回;归一化完全一致的记录可跳过调用。作者报告了特定数据集结果,不代表其他表格表现,本站未复测匹配质量或费用。
资料核对 2026-09-20 · 本站未进行运行复测
结合对话上下文分析 YouTube 评论态度
输入 · 公开视频评论、回复、有限父评论与同一线程提及上下文,以及视频元数据
无模型配置时采用明确标注的局部词规则;配置后的 API 失败不会静默伪装成模型结果。评论会发送给 TypeSafe,采集依赖非官方公开接口;重复发布信号不是机器人证据,本站未运行采集或分类。
资料核对 2026-09-21 · 本站未进行运行复测
逐条判断 Hacker News 评论,拼出有原文出处的讨论概览
输入 · 讨论主题与单条评论文本,每个线程最多评估 400 条,优先包含顶层回复
Jev 不生成摘要正文;概览由模板与统计拼接。评论数量和文本长度有截断,不能代表完整讨论或总体民意;批量与按需判断会产生模型费用,本站未运行数据库或推理。
资料核对 2026-09-21 · 本站未进行运行复测
用 Jev 给开放式回答做定性编码
输入 · 简短问卷或访谈回答,以及研究者定义的编码表
仓库的离线示例使用合成回答和模拟概率,不是真实 Jev 基准。阈值需用自己的人工标注校准;本站未进行付费模型调用。
资料核对 2026-09-24 · 本站未进行运行复测
把自然语言搜索转成已有 API 接受的筛选条件
输入 · 搜索句子、开发者定义的字段和允许值,以及代码解析的日期与数字
MIT 开源;v0.1 主要支持英文,不支持 OR 和排序。搜索文本与字段描述会发送至 TypeSafe;不生成 SQL,租户隔离仍由接入方负责。本站仅核对源码,未运行模型。
资料核对 2026-09-25 · 本站未进行运行复测
核对引用、筛查内容、重排候选
输入 · 主张与证据、网页文本或候选列表
README 给出实际调用示例;screen 只返回建议,执行策略由调用方负责。本站未复测。
资料核对 2026-09-19 · 本站未进行运行复测
在请求转发前检查内容
在工具执行前后观察风险
输入 · 命令、文件修改与工具输出
默认 shadow 模式只观察提示;接入不等于已经强制拦截所有危险动作。
资料核对 2026-09-19 · 本站未进行运行复测
在字段格式之外检查语义
为 AI SDK 工具调用选择处理路径
输入 · 任务、工具定义与待执行调用
模型故障时回到 ask-human;仍需要应用自行设定和验证权限策略。
资料核对 2026-09-19 · 本站未进行运行复测
为 Discord 消息增加语义审核
输入 · 消息内容、成员与频道信息,以及管理员保存的误判先例
启用后可能实际删除消息或限制成员;需要自行设置阈值与权限。本站只核对文档和审核代码,未验证误判率或真实服务器运行效果。
资料核对 2026-09-19 · 本站未进行运行复测
安装 npm 包前检查生命周期脚本
输入 · 包清单中的安装钩子,或直接提供的 Shell 脚本文本
缺少 API 密钥或 API 调用失败时会使用离线模拟器,不能将其输出当作 Jev 实测。只评估提供的脚本,不是完整供应链审计;本站未复测检出率。
资料核对 2026-09-19 · 本站未进行运行复测
把隐私政策整理成可展开原文的标签
输入 · 用户提供或从公开网址提取的隐私政策文本与编号段落
分析的是政策表述,不是公司实际行为;引用片段由模型选择,可能遗漏例外,不能替代阅读原文。输入会发往 TypeSafe,本站未实测结论准确性。
资料核对 2026-09-20 · 本站未进行运行复测
为 Agent 的待执行命令提供风险判断
输入 · Shell 命令文本及可选的执行上下文
这是风险建议,实际拦截和人工确认由调用方实施。mock 是关键词规则,不能代替 Jev 或安全边界;源码的 model 参数未传入 SDK 请求,报告值不能证明实际模型版本。本站未验证 SDK 接入或误报漏报。
资料核对 2026-09-23 · 本站未进行运行复测
把 Jev 接入客服 Agent 的判断关卡
输入 · 客户问题、Agent 回复和拟调用的工具
客服与工具是模拟场景;作者的评测数据未经本站复测。Jev 异常时部分判断返回空值并被跳过,不能当作独立的强制安全边界。
资料核对 2026-09-24 · 本站未进行运行复测
让 Python MCP Agent 核对证据并分流复核任务
输入 · 调用方提供的主张、证据、候选项、补丁或待检查内容
MIT 开源,是 @jkudish/jev-mcp 的 Python 重写,并新增评分工具。仅判断传入材料,不能保证真实性或阻止调用方忽略建议;远程判断有费用,HTTP 模式仍属实验。本站未实测准确率、速度或安全性。
资料核对 2026-09-25 · 本站未进行运行复测
在浏览器里与 Jev 对战
输入 · 结构化对局状态
约 9 Hz 是 README 描述的决策 tick,非本站实测吞吐;API 不可用时有确定性回退。
资料核对 2026-09-19 · 本站未进行运行复测
让模拟车从候选路线中选下一步
输入 · 道路、交通状态和预计算候选轨迹
仅为浏览器驾驶模拟,不能视为真实自动驾驶能力;托管演示需要登录。
资料核对 2026-09-19 · 本站未进行运行复测
替 Flappy Bird 选择飞行路径
输入 · 管道位置与代码模拟出的轨迹
主要是每个管道一次选择;Jev 不读取屏幕,不能描述成逐帧视觉控制。
资料核对 2026-09-19 · 本站未进行运行复测
让判断驱动文字冒险的场景变化
在玩具机场里协调起降
输入 · 飞机燃料、航程、邻近交通与机场状态
玩具航空模拟;作者公布的延迟未由本站复测,不能用于判断真实空管安全。
资料核对 2026-09-19 · 本站未进行运行复测
通过连续选择组合多轨音乐
输入 · 音乐描述、最近小节与和声计划
不是音频生成模型;项目区分真实决策、fixture 与手动编辑,本站未试听验收。
资料核对 2026-09-19 · 本站未进行运行复测
让 Jev 决定 Doom 战术动作
从组件库组合界面
观察模型的和声知识与选音行为
通过模拟器状态选择 Mario 按键
输入 · RAM、遥测、地形、敌人及延迟信息
模型读取结构化 JSON,不是截图;仓库不包含 ROM。视频能展示玩法,但不能单独证明稳定通关。
资料核对 2026-09-19 · 本站未进行运行复测
在无人机模拟中提供战术判断
输入 · 经典视觉转换出的障碍和目标状态
在 MuJoCo 中模拟,非真实无人机飞行;Jev 不是视觉或高频控制层,作者关键演示列为单次运行。
资料核对 2026-09-19 · 本站未进行运行复测
给视频中的每句话叠加多维评分
输入 · 带时间戳的句子、发言人和上下文,以及用户选择的评分规则
评分反映模型对话术的判断,不是事实核查。需另行完成转写;作者的成本、延迟与准确率报告未由本站复测。
资料核对 2026-09-19 · 本站未进行运行复测
发布 X 帖子前检查草稿表达
输入 · 草稿、回复或引用上下文,以及可选的媒体文字描述
分数不能保证传播效果;Jev 不直接看图片,视频仅取首帧描述。扩展依赖 X DOM,API 密钥保存在客户端;本站未运行实测。
资料核对 2026-09-19 · 本站未进行运行复测
给录音中被标记的词加消音提示音
输入 · 音频文件及另行提供的逐词时间戳转写
当前核对到的是离线文件原型,依赖时间戳旁车文件;实时 ASR 和直播缓冲只是文档中的扩展方案。默认阈值未证明适用于不同语言,本站未复测。
资料核对 2026-09-19 · 本站未进行运行复测
输入文字时推荐匹配的 Emoji
输入 · 用户输入文本和预设 Emoji 候选集合
从固定词表中选择,不生成新表情;情绪标签是模型判断。托管演示可用性和作者的速度、成本数字未由本站复测。
资料核对 2026-09-19 · 本站未进行运行复测
为小镇 NPC 和将棋选择合法下一步
输入 · NPC 的局部状态,或将棋局面与引擎提供的合法候选
项目默认可使用本地 Rules 模式;Hundred 需主动启用 Jev。无密钥运行与回放不代表真实模型表现,本站未复测游戏质量或费用。
资料核对 2026-09-19 · 本站未进行运行复测
让潜行游戏中的守卫作出可观察的判断
输入 · 守卫可见的局部线索、可选目标与合法战术动作
Jev 负责战术判断,世界与胜负由确定性代码控制。作者的一次端到端运行记录不是通用基准;本站未独立运行游戏。
资料核对 2026-09-19 · 本站未进行运行复测
在改写循环中检查个人文风与原意
输入 · 用户草稿、个人写作样本和候选改写
Jev 是评估器,文字由另一个模型生成。原稿和参考样本会发往配置的服务;本地开发扩展不自动发布 X 帖子,本站未复测风格效果。
资料核对 2026-09-19 · 本站未进行运行复测
按一句观影需求筛选电影
输入 · 观影需求、筛选条件,以及候选电影的简介和参考影片信息
启发式召回可能漏片,评分只依据提供的简介,不是用户喜欢的概率或剧情核验。项目不提供电影播放;本站未独立运行推荐流程或复测作者验证记录。
资料核对 2026-09-20 · 本站未进行运行复测
按自定义写作规则标记句子并给文档评分
输入 · 带行号的文本,以及 Markdown 或 JSON 定义的行级和文档级规则
这是可配置的文风与质量检查,不是 AI 作者身份检测。改写由人或其他模型完成;离线 check 只验证规则格式,本站未复测语言判断与误报率。
资料核对 2026-09-20 · 本站未进行运行复测
让 Jev 从合法候选中为九路围棋选下一手
输入 · 九路棋盘的文字状态、双方近期落子与带战术信息的合法候选
缺密钥、网络错误、低置信度或非法选择都会使用本地 AI;能下完整局不代表 Jev 全程参与。模型不读取棋盘图像,本站未运行对局或验证棋力。
资料核对 2026-09-20 · 本站未进行运行复测
从 YouTube 转写中定位口播赞助并跳过
输入 · 带行号的字幕,或外部语音识别返回的最近转写片段
Jev 读取的是文本,不直接听音频。字幕获取可能受 YouTube 变动影响,按步跳转可能越过正文;音频模式另需转写服务。本站未验证误跳率或作者的成本报告。
资料核对 2026-09-20 · 本站未进行运行复测
观察 Jev 在 2048 棋盘上的方向选择
输入 · 棋盘数字、合法移动方向及用户配置的提示词和游戏规则
实现会修正非法方向,且概率列表为空时回退到首个合法动作,不能说每一步都完全由模型决定。自备后端与试用代理需区分;默认密钥封存口令公开,不构成保密保护。本站未试玩或验证胜率。
资料核对 2026-09-21 · 本站未进行运行复测
让观众建议影响下一幕视频故事
输入 · 观众评论、当前场景和已有的剧情行动建议
Jev 负责评论判断,视频由 Hedra 生成。无密钥时有明确标记的模拟回退,不能视为真实 Jev。视频生成可能慢于播放,且无自动花费上限;关闭观众页不会停止生成。本站未生成视频或验证实播。
资料核对 2026-09-23 · 本站未进行运行复测
用自然语言筛选宝可梦,把语义搜索变成动态图鉴
输入 · 演示中的英文查询,如 starters in hoenn、legendary birds、cutest 和 confused;底层宝可梦资料结构未公开
依据作者约 18 秒视频整理,适合参考自然语言筛选与动态结果展示的应用方向。原帖未附公开仓库或可试用链接,不能核实底层实现、分类准确率、延迟与成本;画面结果不代表完整评测。
资料核对 2026-09-25 · 本站未进行运行复测
给流动性规则加一组旁路信号
输入 · 池状态、交易流与市场信号
源码明确为 shadow/advisory only,Jev 不驱动 ENTER/EXIT;不能称为由 Jev 自动交易或盈利验证。
资料核对 2026-09-19 · 本站未进行运行复测
把家里的状态变成可用判断
输入 · 家庭实体状态与配置的问题
只提供判断信号,实际设备动作由自动化规则控制;本站未接真实家居设备验证。
资料核对 2026-09-19 · 本站未进行运行复测
将判断题用于机械与电气工作
给简历与职位匹配做结构化检查
在计入成本的模拟器里测试交易判断
把家居语音指令分给合适入口
输入 · 用户的家居控制或聊天语句
当前 fast path 范围是灯光服务;不能外推到所有 Home Assistant 设备。
资料核对 2026-09-19 · 本站未进行运行复测
判断用户是否真的说完了
输入 · 语音转录和对话上下文
源码提供可配置 turn-end gate;没有据此验证所有语言与声学环境下的对话体验。
资料核对 2026-09-19 · 本站未进行运行复测
根据链上盘口选择买卖方向
输入 · Kuru MON-USDC 订单簿与价格状态
默认 MODEL=mock;无私钥时为 dry-run。公开演示部署注明模拟成交,不能将所有运行都称为真实 Jev 交易。
资料核对 2026-09-19 · 本站未进行运行复测
为附近的创作者提供相识推荐
输入 · 附近创作者信息;具体输入结构未公开
作者称推荐准确并展示结果;未核到公开源码,不能据一个匹配示例推断推荐准确率。
资料核对 2026-09-19 · 本站未进行运行复测
尝试批量处理收件箱分类
输入 · 邮件文本;样本与分类标签未公开
原帖声称数秒分类 500 封、花费 3.5 美分;缺少复现实验、准确率与完整输入,本站不背书这些数字。
资料核对 2026-09-19 · 本站未进行运行复测
按自定义过滤器整理私人邮箱
输入 · 邮箱消息及用户设定的过滤条件
作者公开帖文,未找到公开源码;不能核实分类准确率、客户端分发状态或其他 AI 功能的底层模型。
资料核对 2026-09-19 · 本站未进行运行复测
讲话时自动勾选已经讲到的提纲
输入 · 实时语音转写或手动输入,以及尚未完成的讲话要点
这是对作者介绍的提词器思路的独立重做。识别效果受转写和阈值影响;托管页与本地 TypeSafe 接入方式不同,本站未复测成本或漏检率。
资料核对 2026-09-19 · 本站未进行运行复测
按语义过滤 Android 通知噪声
输入 · 通知或短信内容、渠道历史与用户规则
通知会先出现再被撤销;短信仍保留在短信应用中。匹配到的验证码在本地放行,但规则可能有边界;本站未进行 Android 真机测试。
资料核对 2026-09-19 · 本站未进行运行复测
用英文目标组合模拟机械臂的动作
输入 · 自然语言目标、模拟器中的坐标和夹爪状态,以及预设动作候选
仅为 ManiSkill 中的 Franka 机械臂模拟;使用特权坐标而非相机感知,不是真机成果。任务受预设动作库限制,本站未复测成功率。
资料核对 2026-09-19 · 本站未进行运行复测
把语言课里的纠错与词汇整理成复习笔记
输入 · 分角色的课堂转写、前后几轮对话及原文片段候选
Jev 不听音频,也不替代教师。转写错误可能导致错误笔记;部分界面支持固定演示数据,不能据此认定真实模型效果。本站未运行课堂流程或复测学习成效。
资料核对 2026-09-20 · 本站未进行运行复测
在开发者门户中辅助运维分诊与变更检查
输入 · 运维文档、告警症状、变更说明,以及模板、团队或目录候选
插件不执行基础设施操作。独立 playground 使用固定结果,不调用 Jev;作者的连接验证不等于质量保证,本站未部署插件或复测运维判断。
资料核对 2026-09-20 · 本站未进行运行复测
把语音指令转成 macOS 的有限操作
输入 · 语音转写、当前前台应用、已安装应用候选及拆分后的命令
常见指令可能由本地规则直接处理,转写在系统支持时使用设备端识别。Jev 不生成参数文本,也不读取音频;需要相应系统权限,本站未安装或验证真实语音控制。
资料核对 2026-09-20 · 本站未进行运行复测
用 Jev 判断市场状态,在 Bybit 模拟账户观察策略
输入 · BTC、ETH、XAUT 的行情指标、订单簿、费用、持仓和组合风险,另有 USDT 作为资金去向
收录为模拟交易与策略观察案例。源码支持显式解锁主网,并非只能模拟;公开看板可显示余额与成交。已核对服务端密钥使用、Cron 认证和执行检查,未连接账户、下单、验证盈利或完成独立实盘安全审计。
资料核对 2026-09-21 · 本站未进行运行复测
把配送异常描述转成有规则依据的处置结果
输入 · 客户备注、包裹价值、签收要求和配送尝试次数等事件字段
这里核对的是判定 API 和控制台,未发现实际发送验证码、执行派送或创建调度工单的集成,不能把状态标签当成动作已完成。规则依赖模型信号,本站未验证真实物流、安全拦截或耗时。
资料核对 2026-09-21 · 本站未进行运行复测
在聊天窗口旁判断沟通意图,提供候选回复
输入 · Android 屏幕上可见的微信、QQ 等聊天文本、关系设定及可选的知识库和历史;通过无障碍节点或 OCR 采集
意图和风险是模型推断,不代表对方真实心理。聊天及所选上下文会发送至配置的模型接口,并非全本地处理;可选历史会保存在本机。依赖无障碍或截屏权限,本站未安装实测,未验证作者的兼容性及约 1 秒响应描述。
资料核对 2026-09-22 · 本站未进行运行复测
用 Jev 辅助 App Store 关键词研究
输入 · 关键词、地区语言、应用说明与公开搜索线索
Jev 通过 OpenRouter 调用并需用户密钥;需求估计不是 Apple 官方搜索量。作者报告的相关性和误差未经本站复测。
资料核对 2026-09-24 · 本站未进行运行复测
让编码助手直接调用判断题
把语义判断接进 Unix 管道
在终端试隐私与语气判断
从终端提交三类结构化问题
输入 · 文本、JSON、文件或标准输入
社区客户端,需有效服务凭据;项目存在不代表所有 provider 都已在本站测试。
资料核对 2026-09-19 · 本站未进行运行复测
把判断封装成有版本的服务
用 AI SDK 接入批量判断
输入 · 共享状态与 Choice、Score、Boolean 问题
源文件显示可选 TypeSafe provider;evaluation 为实验接口,不表示框架所有用户默认采用 Jev。
资料核对 2026-09-19 · 本站未进行运行复测
在 Python 应用中配置 TypeSafe provider
输入 · 应用配置与 TypeSafe SDK 客户端
核对的是可选 provider 源码,不能据此宣称整个 Pydantic AI 都在使用 Jev。
资料核对 2026-09-19 · 本站未进行运行复测
从 zsh 历史中推荐下一条命令
输入 · 当前输入和近期去重后的历史命令候选
历史命令会作为模型输入,使用前需考虑其中的敏感内容。推荐来自已有历史,不生成任意新命令;仍由用户接受,本站未运行终端实测。
资料核对 2026-09-19 · 本站未进行运行复测
把 Jev 判断接入 n8n 工作流
输入 · n8n 节点传入的文本或 JSON 状态及结构化问题
这是社区集成节点,需要 API 密钥。文档说明未通过 n8n 验证时只能用于自托管实例;重试由工作流设置负责,本站未在 n8n 中安装验证。
资料核对 2026-09-19 · 本站未进行运行复测
只读检查目录,给出清理建议与不确定项
输入 · 文件与目录的名称、路径、体积、时间、扩展名和文件名样本
工具不会删除、移动或重命名被扫描文件。模型看不到文件内容,也不知道用户是否还在使用它;建议不等于可安全删除。作者仅报告 Windows 验证,本站未复测扫描或判断效果。
资料核对 2026-09-20 · 本站未进行运行复测
为 WordPress 建议内链和重复新闻分组
输入 · 已发布文章的标题、正文、相近文章候选,以及正文中已有的锚文本选项
作者标明仅在一个站点测试,尚不适合直接用于其他生产站点;规则偏向意大利语,其他语言需另测。公开文章文本发往所选服务,本站未安装 WordPress 插件或复测成本、质量和撤销效果。
资料核对 2026-09-21 · 本站未进行运行复测
像 find 一样按自然语言描述查找文件
输入 · 本地文件过滤后的路径、名称、扩展名、大小与修改时间;启用 --content 时附文本开头最多 8 KiB
元数据或启用后的正文片段会发送给 TypeSafe。语义判断不是确定性匹配,结果依赖过滤范围;它本身查找文件,管道中后续执行的命令仍需另行检查。本站未安装或查询用户文件。
资料核对 2026-09-21 · 本站未进行运行复测
在 GitHub Actions 里调用 Jev 判断仓库事件
输入 · PR、Issue 事件或工作流传入的状态与问题
Action 本身不自动修改 PR;事件状态会发送到 TypeSafe。使用 pull_request_target 时必须只运行受信任的基准分支代码。本站未执行真实工作流。
资料核对 2026-09-24 · 本站未进行运行复测
识别 HTTP 200 中的语义失败
为多 Agent 失败记录归因
输入 · 失败轨迹与候选 Agent、步骤、错误类型
作者使用注入错误的数据集;部分对照是论文结果,Who/When 的受限选择与自由生成任务并不等价。
资料核对 2026-09-19 · 本站未进行运行复测
测试 Jev 能否胜任搜索重排
检验注入识别与漏洞代码判断
输入 · 公开语料中的消息与成对代码
作者记录 662 条注入语料与 200 对代码;加入业务上下文会改变结果,不能外推为生产防护保证。
资料核对 2026-09-19 · 本站未进行运行复测
把规则检查与 Jev 语义判断接入 Agent 测试
输入 · 测试对话、Agent 输出、工具调用和期望行为;语义裁判使用经过选择的状态
CI 回放已有响应不代表重新验证线上模型;录制与真实判断需要服务访问。缺失工具记录会标为未知而非安全,跳过项不计入分母,应检查测试覆盖。作者示例阈值和成本收益不能直接泛化;本站未复测。
资料核对 2026-09-23 · 本站未进行运行复测
没有匹配的项目。试试更短的关键词,或清空筛选条件。
Choice从给定候选中选择,返回概率分布。
Score在你定义的有序刻度上做判断。
Noul用 0 到 1 的数值表达判断。
格式确定,判断仍可能出错。阈值、兜底与实际动作由应用代码控制。
BUILT WITH JEV?
做了一个使用 TypeSafe Jev 的项目?请提供公开的 GitHub 开源仓库、项目链接和具体用法。
提交不会立即公开。联系邮箱仅用于发送审核、补资料和收录结果,不在页面展示。请勿提交密钥、个人敏感信息或非公开资料。
ABOUT THE COLLECTION
本期结合公开社区资料、原始仓库与 X / 网页检索,按项目去重、按用途整理。收录 116 个可查看源码的项目与 6 个演示案例。演示案例单独分类,只需可核对的作者公开演示,不要求开源仓库,不代表全网穷尽。
“文档 / 源码核对”只表示读过所链接的资料;作者测试、基准和视频均保留其原始验证范围。本站没有为这些项目运行 API、游戏对局或业务流程。OpenJev 等独立复刻模型不混入 TypeSafe Jev 案例。