🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 全部攻略

让 AI 的研究结论带上证据链:ClearAI 认识论循环的一次完整走法

工具 / 效率类文章2026/10/3 发布4 次阅读

让 AI 的研究结论带上证据链:ClearAI 认识论循环的一次完整走法

大多数 Agent 交付研究结论时,你拿到的是一段话和一个自称的「完成」。你没法知道哪句话有证据、哪句话是模型顺手补的。ClearAI(页面中文名「认识论循环」)试图改掉这件事:它把研究从「任务循环」搬到「认识论循环」上,让每条结论都写明边界、支持度与证据链,最后长成一个可复用的领域本体。

这篇按一次真实走法走一遍:装、重启、切模式、设问题、登记判据、跑一次可能失败的检验、得到带范围的结论、看它长进本体。全程用的是 clearai-dsh@0.3.1。

先装起来:钉版本、重启、切模式

安装本身很轻,只有一条命令:


dsh plugin --profile web add clearai-dsh@0.3.1

前置是先有 dsh CLI 引擎(npm install -g @deepseek-ai/dsh)。包是 npm 上的预构建产物,装的时候不在你机器上编译,所以不会弹 allowBuilds 授权。它让你的研究长成的是本体,而不是一段更长的聊天记录。

装完必须重启 dsh web,然后才是关键一步:新建会话后,点顶部当前模式名(默认 Standard mode)打开预设列表,选 ClearAI。它的卡片写着「利用认识论循环构建可信本体」。不切模式,等于装了个没人用的插件——这是最常见的「装了没生效」。

一次完整走法:循环的六个站点

认识论循环的骨架是六步:问题 → 判断(写明怎样算错)→ 一次可能失败的检验 → 证据 → 带范围的结论 → 长进本体。README 里有一句话把这套机制和别的图谱分开了:别的知识图谱靠抽取与断言堆边,这里每一条边都要通过循环挣得。

问题与判断:先写下「怎样算错」

你要先把问题摆出来,再登记一个判断。判断的关键不是「我觉得它对」,而是预先写明怎样算它错。README 的图注里把这一步画成一条虚线,叫 pre-registered threshold(预先登记的阈值)。只有阈值先写死,后面的检验才有意义——否则模型总能事后把标准往结论上贴。

检验:一次允许失败的测试

循环里跑的是一次可能失败的检验。它被设计成能给出「没通过」的结果,而不是走走过场。这一点在界面里看得很清楚:图上有一根 L0–L4 轴,五个观测点带误差棒——越过阈值的那一个被填实,不确定的画成虚线圆圈,被证伪的留在原地、划一道斜杠,什么都不删除。

证据、结论与本体

检验产出证据,证据支撑一条带范围的结论——不是一句放之四海的话,而是写清边界、支持度和证据链,因此可以安全引用。只有越过阈值的那一条,才会落成本体里的一个事实点,成为下一轮的起点。

界面长什么样:Ontology 面板与 World Tree

中间是一个 Ontology 面板,一页装下你关心的四件事。顶部是问题、一行计数、需要你处理的项("to handle"),以及一条进度轨:判断 → 检验 → 已验证 → 入本体。中间是图,本体图(领域长什么样)与实体图(你实际验证了什么)一键切换,点某个节点可按节点过滤。下方是结论列表,按状态分组:已验证 / 待检查 / 检验中 / 不确定 / 已证伪 / 已替代。

两条互相矛盾的结论会自动亮起(README 的示例里把它们染成琥珀色),系统只报冲突,撤回还是维持由人来决定。

右侧是 World Tree,把计划的步骤与关卡一行行列出来,打开一步能看到它检验了哪些判断、结果如何。研究收尾时,每一步被接受的产物以 DSH 原生交付卡片出现,每一轮改了什么则走 DSH 原生的变更卡片。

语言上,系统写出的内容跟随你书写所用的语言,面板跟随 UI 语言。

任务循环和认识论循环,差在哪五处

README 用一张对照表把两者的差别压在五个维度上:

  • 驱动问题:任务循环问「下一步做什么」;认识论循环问「我们知道什么、凭什么」。
  • 完成判定:任务循环是「模型自称完成」;认识论循环是「系统按已交付证据计算」。模型手里的工具没有任何字段可以声明某步完成,目标只在独立评估之后才算完成。
  • 裁决:任务循环「做的人自己说」;认识论循环要求分离——超过某个层级,执行者不能自评。
  • 失败:任务循环里被删除、重试或遗忘;认识论循环里保留——被证伪的假设是结果,不是噪声。
  • 积累物:任务循环攒下聊天记录;认识论循环攒下本体。

第五点最容易被低估。两个 README 里的真实案例能说明「保留失败」的后果:JEPA 世界模型那次跑完,本体里有 21 个概念、8 条关系、27 个实体;而「Navier–Stokes 被解出来了吗」那次,两个流行断言被证伪并保留在案,一次摄入拒绝被诚实处理,最后是 24 概念、13 关系、59 实体。被证伪不等于被抹掉——它成了下一轮不再重犯的证据。

顺带说清边界:ClearAI 明确不声称递归自我改进,它只提供「一个自改进系统所需要的那种认识论底座」;还没实现、以及没在真实浏览器里验证过的部分,都写在仓库的 docs/known-gaps.md 里。所以别把它当「会自己越变越强的 Agent」。

避坑:三件装之前该知道的事

坑一:pnpm ≥11 会让「最新版」静默变成上一版

现象。 你敲了裸包名或 @latest,装完却可能拿到上一个发行版,而且命令回显是成功。原因。 pnpm ≥11 的 minimumReleaseAge 默认是 1440 分钟,且内置默认是非严格的——裸包名或 @latest 会静默回落到「一天之前的最新版」;发布后 24 小时内,回到的正是前一个发行版。更麻烦的是 DSH 的插件管理器把你的 spec 原样转给 pnpm、不比对实际装到的是不是你要求的,所以这次降级被报成成功;预览卡用 pnpm view 读包、忽略 age 策略,也可能显示最新版而实际装的是前一个。解决。 钉版本号(pnpm 会自己记下例外),或在 profile 的 pnpm-workspace.yaml 里加 minimumReleaseAgeExclude: [clearai-dsh],此后裸名可用。

坑二:版本门槛是硬的,老引擎上装了也不生效

现象。 在低版本 Node 或老 dsh 上装完,插件安静地不工作。原因。 它的 engines 是 node >=22 与 dsh >=0.1.7-alpha.1;README 说明那一代 dsh 才引入该预设所依赖的 composition declaration line。解决。 先把 Node 升到 22 及以上、dsh CLI 升到 0.1.7-alpha.1 以上再装。素材记录里,这个包已在 dsh 0.2.0-rc.2 下真实安装成功一次(L4 · 真实安装),可直接作为参照。

坑三:「完成」由系统按证据算,但门槛只有你能定

现象。 跑着跑着,循环一直卡在「检验中 / 不确定」,迟迟不入本体。原因。 完成判定虽然由系统按已交付证据计算,但判据需要你预先登记;阈值定得太松或太紧,观测就永远越不过那条虚线。解决。 在登记判断那一步就把阈值写成可检验的具体条件,并且允许它被推翻——一直卡住时先回头检查阈值,而不是催模型。

总结

ClearAI 把研究从「模型说完就算完」搬到「证据说了才算完」,一次完整走法就是问题、判断、可能失败的检验、证据、带范围的结论、长进本体这六步;想对照同类插件的中文清单与安装形态,见 DeepSeek Harness Hub 插件清单。

适合与不适合

适合:需要结论可被引用、能回溯到证据的研究型团队;做长期课题、希望知识跨轮次按概念复用的个人研究者;已经用 dsh 且愿意切换工作模式的用户;要把「被证伪的假设」也留档备查的人。

不适合:想要「模型自己说完成就算完成」的团队;不打算预先登记检验判据、只想让 Agent 把话说完的人;只想让 Agent 记笔记、并不需要证据链的场景——那用它属于杀鸡用牛刀。

标签:ClearAI、DeepSeek Harness、认识论循环、应用实践

本文由 DeepSeek Harness Hub 自动整理,数据来源于插件详情页。

订阅周报,不错过新攻略
每周一封 · 插件 + 福利

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群