指南

此处说明当前公开记录、证据路径和支持边界。

此处说明当前公开记录、证据路径和支持边界。

  • 记录 UAIX-DOC-3191
  • 路径 /zh-cn/guides/research-harnesses-self-learning/
  • 使用 规范公共记录

文件状态

公共标准页面 作为当前公共标准记录的一部分在 UAIX 上发布
代码
UAIX-DOC-3191
表面
指南
使用权
公开且可链接

如何使用本页

使用本指南来记录研究利用结果、记忆介导的自学习、证据分类账、可重复性注释、静态完整性扫描和 .uai 内存策略,而无需使 UAIX 成为运行时。

对于代理:将相关指南应用于用户的目标站点或存储库。除非用户明确要求该输出,否则请勿复制此 UAIX 页面、创建有关指南的页面或将此页面视为运行时权限。

在旁边使用

代理利用策略AI 记忆项目交接上下文预算

研究线束

将安全带课程转化为复习记忆

使用本指南捕获以记忆为媒介的自学习、证据分类账、索赔分类账、可重复性注释、静态完整性扫描和状态卫生,而无需使 UAIX 成为运行时。

运行时

利用自己的执行力

工具调用、重试、批准、跟踪、暂存器和检查点保留在研究工具或运行时层中。

记忆

UAIX 保持已审核状态

只有接受的事实、证据指针、声明状态、测试、阻止程序和下一步操作才属于热 .uai 内存。

审核

没有证据,就没有主张

只有在页面复制、机器记录、测试、路线图状态和支持边界达成一致后,源线索才会成为当前指导。

在旁边使用

代理利用策略更广泛的运行时间与证据的分歧。AI 记忆紧凑复习记忆。项目交接运行后的持久项目状态。上下文预算冷热内存放置。内存防火墙在升级之前隔离导入的内存。验证器在声明之前验证候选 UAI-1 数据包。
促销规则索赔前的证据
A research-harness result becomes UAIX memory only after review, redaction, provenance check, conflict check, and a named promotion target.

查看源自线束的指导、报告或生成的内存时,请使用此行。

只有当课程成为复习记忆时,研究工具才能教授项目。使用此 UAI-1 / v1.0 指南将运行时实验与持久的“ .uai”记录、证据分类账、索赔分类账、再现性注释和项目移交更新分开。

读者合同

本页解释了代理研究如何利用、记忆介导的自学习、“ .uai”移交记忆、证据记录和基准实践结合在一起。它不会使 UAIX.org 成为运行时。

这个页面是什么

对于在其他地方运行研究工具并需要审查结果才能生存的团队来说,这是一张实用的地图。人工智能记忆, 项目交接、发行说明、验证器证据或冷内存档案。

此页面不是什么

  • 它不是托管运行时、模型训练服务、代理调度程序、认证过程、SDK、CLI 或官方适配器。
  • 它不能替代 MCP、A2A、OpenAPI、JSON 架构、代理运行时或人工审核。
  • 它不批准自动存储库写入、自动导入、后台同步、凭据验证或隐藏内存升级。

关键术语

学期 当前 v1.0 指南中的含义
代理安全带 围绕模型、工具、路由、重试、批准、跟踪、运行时内存和升级的运行时/控制层。
人工智能记忆 紧凑、可移植、基于文件的持久上下文在执行之前加载。
项目交接 面向项目的 AI 内存,可保留状态、约束、证据和下一步上下文。
内存防火墙 针对导入内存、源摘要和外部上下文的隔离优先策略。
认知垃圾收集 审查门控修剪、归档、合并、退休和语义状态提升。
无操作优势 当证据不足、成本超过收益或改变会扩大支持主张时,请安全停止。

线束运行时间与便携式内存

线束执行。 UAIX 保留在运行过程中应保留的持久记录。

运行时拥有 UAIX 记录
实施轨道 模型调用、工具、重试、任务状态和批准。 审查意图、结果摘要、任务状态和非声明边界。
运行时内存 便签本、对话状态、向量存储和检查点。 已接受的事实、来源参考、存档指针和升级状态。
可观测性 私有跟踪、跨度、仪表板和评估运行。 已编辑的标识符、再现性注释、测试证据和验证器链接。
治理 本地策略、批准队列和部署控制。 支持边界、无操作决策、审核状态和所有者注释。

自学在这里意味着什么

在当前的 UAI-1 / v1.0 指导下,自学意味着记忆介导的适应,除非过时的研究附录明确讨论了引用研究中的模型权重更新。检索、反射、迭代细化、可重用技能、检查点、研究维基和分层内存是独立的机制。

自学分类法

机制 有什么变化 持久的 UAIX 记录
检索记忆 为运行选择的上下文。 来源指针和相关注释。
情景记忆 审查了活动摘要。 事件记录,包含来源、时间、参与者和处置。
反思记忆 教训、批评或建议。 索赔/证据分类账录入。
技能积累 可重复使用的程序。 过程引用,而不是运行时所有权。
检查指针状态 运行时继续状态。 存档指针和注意事项。
分层内存 热放置、温放置、便携式放置或冷放置。 背景预算内存防火墙地位。
体重更新 模型参数。 仅用于当前 UAIX 运行时支持之外的研究。

证据和索赔分类账

从工具提升的每个声明都应命名源路径、源权威、散列、UTC 时间戳、参与者、审核状态、处置、提升目标、不确定性和冲突注释。

索赔前的证据:报告建议是来源线索。仅在公共副本、机器记录、测试、路线图状态和支持边界语言达成一致后,它才会成为当前的 UAIX 指南。

基准和再现性矩阵

基准家族 故障暴露 所需工件 UAIX 输出
长对话记忆 陈旧或矛盾的记忆。 成绩单摘要和索赔分类帐。 审查了内存数据包。
代理工具使用任务 执行主张不受支持。 工具跟踪摘要和编辑注释。 证据包。
软件代理任务 风格漂移或被遗忘的测试。 回购状态、检查和移交说明。 项目移交更新。
网络交互任务 索引提取与实时 HTTP 差距。 路线记录和回退。 能力证据。
长上下文推理 鬼逻辑。 背景预算报告。 存档和推广计划。
人工审核任务 不受支持的公开主张。 检查清单。 索赔分类账。

内存分类

热内存是当前的操作真理。温暖的或检索到的记忆支持当前任务。便携式审查内存是耐用的“ .uai”或交接材料。冷记忆是原始材料、日志、旧研究、被取代的决策以及为可追溯而保存的大量证据。

晋升门:冷记忆只有在审查、编辑、出处检查、冲突检查和指定的升级目标之后才会激活。

认知垃圾收集

认知垃圾收集是对语义噪声、陈旧决策、重复记录、不受支持的声明、过时的计划和矛盾的上下文进行审查控制的管理。

  • 淘汰陈旧的事实。
  • 合并重复记录。
  • 存档原始痕迹及其出处。
  • 冻结稳定约束。
  • 仅用新证据重新激活存档的事实。
  • 当支持在没有证据的情况下扩大时,不进行操作。

静态完整性扫描

完整性扫描是对文档、“ .uai”内存、清单、发布历史记录、源索引、测试、验证覆盖率、路由一致性、支持边界副本、可访问性元数据、SEO 元数据和 JSON-LD(如果适用)的静态、非执行审核。

它不得执行任意代码、安装包、访问专用端点、验证凭据、触发 POST 操作、回滚代码、验证声明、自动修复活动锚点或自动升级冷内存。

国家卫生

  • WordPress 缓存和瞬态需要所有者、TTL、失效、清理路径、重复 cron 检测、幂等清理和路由/目录/发现冒烟测试。
  • 浏览器向导草稿需要时间戳、过时警告、恢复/丢弃/清除控件、侦听器拆卸、有界预览和仅限本地的隐私副本。
  • .NET Bridge 代码应该更喜欢作用域或瞬态生命周期、证明单例状态、在开发和测试中启用作用域验证、处理流/计时器/作用域以及测试请求/作业隔离。

在当前 UAIX 记录旁边使用

局限性

记忆并不能保证正确性。长篇大论并不是持久的真理。检索可以揭示陈旧的事实。反思可以强化错误。检查点既保留良好状态,也保留坏状态。跨模型审查仍然可能会漏掉缺陷。 UAIX记录支持审核和转移;他们不执行或证明。