指南

自学习代理的研究工具

UAI-1 / v1.0 研究利用、记忆介导的自学习、 .uai 记忆策略、证据分类帐、再现性、静态完整性扫描和支持边界的指导。

  • 记录 UAIX-DOC-2232
  • 路径 /zh-cn/guides/research-harnesses-self-learning/
  • 用途 规范公共记录

文档状态

公共标准页面 作为当前公共标准记录的一部分发布在 UAIX 上
代码
UAIX-DOC-2232
页面类型
指南
访问
公开且可链接

如何使用此页面

将此页面用作 自学习代理的研究工具 及其标准内容的规范公共参考。

对于代理:请将相关指南应用于用户的目标站点或代码库。除非用户明确要求该输出,否则不要复制此 UAIX 页面、创建有关该指南的页面,也不要将此页面视为运行时权限。

只有当课程成为复习记忆时,研究工具才能教授项目。使用此 UAI-1 / v1.0 指南将运行时实验与持久的“ .uai”记录、证据分类账、索赔分类账、再现性注释和项目移交更新分开。

读者合同

本页解释了代理研究如何利用、记忆介导的自学习、“ .uai”移交记忆、证据记录和基准实践结合在一起。它不会使 UAIX.org 成为运行时。

这个页面是什么

对于在其他地方运行研究工具并需要审查结果才能生存的团队来说,这是一张实用的地图。人工智能记忆, 项目交接、发行说明、验证者证据或冷内存档案。

此页面不是什么

  • 它不是托管运行时、模型训练服务、代理调度程序、认证过程、SDK、CLI 或官方适配器。
  • 它不能替代 MCP、A2A、OpenAPI、JSON 架构、代理运行时或人工审核。
  • 它不批准自动存储库写入、自动导入、后台同步、凭据验证或隐藏内存升级。

关键术语

关键术语
学期当前 v1.0 指南中的含义
代理安全带围绕模型、工具、路由、重试、批准、跟踪、运行时内存和升级的运行时/控制层。
人工智能记忆紧凑、可移植、基于文件的持久上下文在执行之前加载。
项目交接面向项目的 AI 内存,可保留状态、约束、证据和下一步上下文。
内存防火墙针对导入内存、源摘要和外部上下文的隔离优先策略。
认知垃圾收集审查门控修剪、归档、合并、退休和语义状态提升。
无操作优势当证据不足、成本超过收益或改变会扩大支持主张时,请安全停止。

线束运行时间与便携式内存

线束执行。 UAIX 保留在运行过程中应保留的持久记录。

线束运行时间与便携式内存
运行时拥有UAIX 记录
执行模型调用、工具、重试、任务状态和批准。审查意图、结果摘要、任务状态和非声明边界。
运行时内存便签本、对话状态、向量存储和检查点。已接受的事实、来源参考、存档指针和升级状态。
可观测性私有跟踪、跨度、仪表板和评估运行。已编辑的标识符、再现性注释、测试证据和验证器链接。
治理本地策略、批准队列和部署控制。支持边界、无操作决策、审核状态和所有者注释。

自学在这里意味着什么

在当前的 UAI-1 / v1.0 指导下,自学意味着记忆介导的适应,除非过时的研究附录明确讨论了引用研究中的模型权重更新。检索、反射、迭代细化、可重用技能、检查点、研究维基和分层内存是独立的机制。

自学分类法

自学分类法
机制有什么变化持久的 UAIX 记录
检索记忆为运行选择的上下文。来源指针和相关注释。
情景记忆审查了活动摘要。事件记录,包含来源、时间、参与者和处置。
反思记忆教训、批评或建议。索赔/证据分类账录入。
技能积累可重复使用的程序。过程引用,而不是运行时所有权。
检查指针状态运行时继续状态。存档指针和注意事项。
分层内存热放置、温放置、便携式放置或冷放置。背景预算内存防火墙地位。
体重更新模型参数。仅用于当前 UAIX 运行时支持之外的研究。

证据和索赔分类账

从工具提升的每个声明都应命名源路径、源权威、散列、UTC 时间戳、参与者、审核状态、处置、提升目标、不确定性和冲突注释。

索赔前的证据:报告建议是来源线索。仅在公共副本、机器记录、测试、路线图状态和支持边界语言达成一致后,它才会成为当前的 UAIX 指南。

基准和再现性矩阵

基准和再现性矩阵
基准家族故障暴露所需工件UAIX 输出
长对话记忆陈旧或矛盾的记忆。成绩单摘要和索赔分类帐。审查了内存数据包。
代理工具使用任务执行主张不受支持。工具跟踪摘要和编辑注释。证据包。
软件代理任务风格漂移或被遗忘的测试。回购状态、检查和移交说明。项目移交更新。
网络交互任务索引提取与实时 HTTP 差距。路线记录和回退。能力证据。
长上下文推理鬼逻辑。背景预算报告。存档和推广计划。
人工审核任务不受支持的公开主张。检查清单。索赔分类账。

内存分类

热内存是当前的操作真理。温暖的或检索到的记忆支持当前任务。便携式审查内存是耐用的“ .uai”或交接材料。冷记忆是原始材料、日志、旧研究、被取代的决策以及为可追溯而保存的大量证据。

晋升门:冷记忆只有在审查、编辑、出处检查、冲突检查和指定的升级目标之后才会激活。

认知垃圾收集

认知垃圾收集是对语义噪声、陈旧决策、重复记录、不受支持的声明、过时的计划和矛盾的上下文进行审查控制的管理。

  • 淘汰陈旧的事实。
  • 合并重复记录。
  • 存档原始痕迹及其出处。
  • 冻结稳定约束。
  • 仅用新证据重新激活存档的事实。
  • 当支持在没有证据的情况下扩大时,不进行操作。

静态完整性扫描

完整性扫描是对文档、“ .uai”内存、清单、发布历史记录、源索引、测试、验证覆盖率、路由一致性、支持边界副本、可访问性元数据、SEO 元数据和 JSON-LD(如果适用)的静态、非执行审核。

它不得执行任意代码、安装包、访问专用端点、验证凭据、触发 POST 操作、回滚代码、验证声明、自动修复活动锚点或自动升级冷内存。

国家卫生

  • WordPress 缓存和瞬态需要所有者、TTL、失效、清理路径、重复 cron 检测、幂等清理和路由/目录/发现冒烟测试。
  • 浏览器向导草稿需要时间戳、过时警告、恢复/丢弃/清除控件、侦听器拆卸、有界预览和仅限本地的隐私副本。
  • .NET Bridge 代码应该更喜欢作用域或瞬态生命周期、证明单例状态、在开发和测试中启用作用域验证、处理流/计时器/作用域以及测试请求/作业隔离。

在当前 UAIX 记录旁边使用

局限性

记忆并不能保证正确性。长篇大论并不是持久的真理。检索可以揭示陈旧的事实。反思可以强化错误。检查点既保留良好状态,也保留坏状态。跨模型审查仍然可能会漏掉缺陷。 UAIX记录支持审核和转移;他们不执行或证明。