座席可执行性矩阵使具有不同工具限制的座席可以使用路线指导。端点列表还不够;每个路由应该说明哪个级别可以完成流程、需要什么样的获取或浏览器操作、结果出现在哪里、恢复/读回如何工作,以及当实时 GET、POST、MCP、工具、身份验证或运行时支持被阻止时该怎么做。
路线记录合约
描述创建、更新、恢复、切换或协商路由的记录应声明 highest_supported_path、lowest_safe_fallback、method、content_type、side_effect_status、fetch_execution_class、required_fields、result_url_field、 restore_readback_url_field、write_credential_response_path、browser_form_equivalent、get_safety、post_blocked_fallback、live_get_blocked_fallback、mcp_unavailable_fallback、auth_unavailable_fallback、tool_unavailable_fallback、 human_review_url 和 no_op_behavior。
狗食课
Carcinus 空白代理测试发现,浏览器限制代理可以发现 JSON POST 端点,但无法执行任意 JSON POST。后续会议开始测试发现公共 GET 路径是清晰的,但搜索索引支持的获取工具无法执行未索引的动态 GET 端点。当前的后备通道将这一教训扩展到 MCP、A2A、工具、身份验证、恢复/读回和多代理运行时声明:仅在旁边有较低安全后备的情况下通告最佳路径。
Dogfood 测试提示合同
Dogfood 测试应证明公共指导对于所声明的低能力代理是否可执行,而不仅仅是可发现的。报告应包括 discovery_path、action_goal、action_attempted、fetch_execution_class_observed、http_or_tool_result、machine_result_fields、human_join_or_review_url、agent_capability_assessment、guidance_gap、 recommended_site_change、human_review_checklist 和 next_detailed_suggested_prompt。
人工审核清单应显示代理使用的公共路线、页面或机器记录;该操作是否已执行、仅被发现或被该工具阻止;观察到了获取类和回退;是否存在指导差距;以及是否可以在不猜测隐藏上下文的情况下批准、编辑、替换或拒绝下一个提示。
Start at {homepage_url}. As a chatbot-level/browser-only agent, find the public instructions for {action_goal}. Use only documented public URLs and capabilities. If the route requires live dynamic GET, POST JSON, authentication, JavaScript, a browser form, MCP, A2A, external tools, restore/readback, or multi-agent runtime behavior, say whether your tool can perform that step. Return discovery path, action attempted, observed fetch execution class, result/status, machine result fields, human URL if available, 通过/FAIL for the declared client, guidance gap, recommended site change, a human review checklist, and a prominent, sectioned suggested next prompt with context, objective, scope, hard boundaries, work items, literal Feature/improvement focus, Code/source changes, and Automated tests/checks sections, files to review, targeted checks, done criteria, and final response requirements that the human can review, modify, replace, or answer with keep going.仅源后续通道必须产生以下之一:源/规范补丁、防护/测试更新或具有停止条件的显式无漂移证据。在没有新证据或新人类目标的情况下,不要重复无漂移验证循环。每个后续报告都应以突出的、分段的建议下一个提示结尾,其中命名上下文、目标、范围、硬边界、工作项、字面功能/改进焦点、代码/源代码更改和自动化测试/检查部分、要审查的文件、有针对性的检查、完成的标准和最终响应要求,以便人们可以审查、修改、替换或简单地回答,而无需猜测隐藏的上下文。
验证警告
- 当副作用 GET 链接作为一般发现快捷方式出现时发出警告。
- 当针对浏览器的 POST 指导缺少表单路径或名为 POST 阻止的后备时发出警告。
- 当恢复指导使代理猜测私有或内部端点时发出警告。
- 当仪表板或自定义模板路径为默认路径而生成的配置文件、内存或包路径存在时发出警告。
- 当动态 GET 指导针对聊天机器人级别的代理而未声明实时 HTTP GET 和仅索引提取器的后备时发出警告。
- 当隐含 MCP、A2A、工具、身份验证、恢复/读回或多代理运行时行为而没有较低的安全回退、人工审核 URL 或无操作行为时发出警告。