行为与策略对照
记录 Agent 声称、策略要求与观察到的执行差异。
扫描命中、模型判断和工具输出只是观察。Fieldwork 将它们与授权快照、来源、反证及重放结果关联,避免把“看起来像漏洞”直接写成正式结论。
研究者始终保留控制权:确认 Scope、审阅执行计划、处理规则歧义,并决定何时交付报告。
研究工作台 / FIELDWORK V5
项目、任务、候选与可信结果分层呈现。界面展示研究的当前状态,也让下一步需要谁确认一目了然。

RESEARCH GRAPH
图谱连接授权边界、研究假设、观察材料、候选与结果;来源关系不等于验证完成。未获独立证明的内容保持待验证状态。

不同目标需要不同验证方法,但都必须经过授权、证据和复验门槛。
把策略、工具调用和可见遥测分开,研究提示注入、工具越权、敏感信息暴露与副作用。
记录 Agent 声称、策略要求与观察到的执行差异。
网页、文档和工具结果不能直接改写执行规则。
有来源的异常先进入调查,不自动生成可信发现。
围绕接口、会话、对象归属和业务流程,在授权范围内比较所有者、非所有者与匿名负对照。
导入目标和规则后仍需人工确认 Scope。
HTTP 成功响应本身不等于权限边界失效。
保留成立条件、证据、局限及后续定向复测路径。
关联源码、编译配置、调用与状态变化;用定向属性测试和反例核对安全断言。
保留权限、调用链和资产流的来源上下文。
区分本地夹具证明与真实协议影响。
没有可靠证据时,不把推测包装成经济损失。
THE LINE WE DO NOT CROSS
工具命中或模型提出一条线索,记录原始来源与适用范围。
形成可证伪的安全假设,列出尚缺的证明、反证和影响材料。
独立验证绑定输入快照、环境与结果;历史回执不自动代表当前仍有效。
只有通过门槛的结论,才进入证明包和报告交付流程。
Fieldwork 正在持续开发。以下区分已实现的本地能力、研发中的 V5 组件和发布前仍需完成的验收;不是对所有环境的可用性承诺。
Scope 确认、任务控制、Candidate 与 Verified 分层、部分专用复验、Proof Capsule 导出预检。
Research Graph、AgentTask / Runner、Runtime 路由、持续研究与漏洞情报正分阶段接入并验收。
完整桌面安装/升级、隔离与权限验证、更多真实授权场景和全量可访问性验收。