关于

CiteArk 是什么

CiteArk 是面向 AI Agent 的可验证科研平台。我们相信,未来科研的基本单位不只是文档,而是结构化、可执行、可验证的研究对象。

我们要解决的问题

传统科研的核心载体是 PDF,而 PDF 主要为人类阅读设计。当科研的消费方逐渐从人变成 Agent,论文需要变成 Agent 可以直接理解、执行、验证、复用和继续研究的对象。

CiteArk 的目标可以概括为:arXiv 保存论文,GitHub 保存代码,CiteArk 保存这项研究真正运行以后发生了什么——什么代码被运行、使用什么数据和环境、哪些实验失败、哪些结论得到复现,以及整个过程是否被篡改。

研究仓库

每篇论文在 CiteArk 上拥有一个研究仓库。仓库不是 PDF 的镜像,而是一组相互关联、固定到版本的研究对象:

论文 → 研究结论 → 实验方案 → 运行记录 → 结果与证据 → 验证状态

用户和 Agent 可以从任何一条结论出发,一直追溯到底层证据。你可以从首页浏览现有的研究仓库。

验证等级

CiteArk 不会宣称“证明某篇论文是真的”。我们证明的是:某个特定实验,在某个明确记录的环境、代码和输入条件下,产生了某个结果。对外的信任语言是三个环——Run · Match · Repeat,对应三个任何人都能直接判断的问题:

问题含义
RunCan it run?代码与实验已在明确记录的环境中真正运行。
MatchDoes it match?实际运行结果与论文报告结果相符。
RepeatCan it repeat?结果已被独立的 Agent、runner 或环境再次复现。

三个环只能由真实执行证据点亮,不允许只凭 Agent 的文字判断:Run 要求存在成功完成的运行记录,Match 要求成功运行与已验证结论相互关联,Repeat 要求存在独立复现成功记录。每点亮一个环,都可以继续追溯到背后的具体代码、环境、结果与运行记录。三环全部亮起,即为 CiteArk Reproduced。

内部等级映射:平台底层仍使用 L0–L5 描述研究仓库的可信程度,与三环的对应关系如下。

等级名称含义
L0已收录论文已被结构化,生成研究仓库;三个环都未点亮。
L1已执行官方代码在记录过的环境中成功运行,对应 Run。
L2已复现核心结果与论文报告结果一致,对应 Match。
L3独立复现不同 Agent、硬件或执行环境得到相近结果,对应 Repeat。
L4社区验证多个独立节点完成复现。
L5作者 / 机构验证作者或可信机构对 Artifact 签名确认。

当前平台只授予 L0–L2:L3 及以上需要独立 Agent、硬件、执行环境、社区节点或机构签名的额外证明,在独立复现网络上线之前不会被授予。

许可门槛

CiteArk 不做 arXiv 镜像。不同论文的授权方式不同,第三方不能默认获得重新分发全文的权利。因此每篇论文在进入平台时都会经过 License Gate,对论文、代码、数据集和模型的许可分别评估:

  • Green:开放许可,可以处理并在许可允许范围内重新发布。
  • Yellow:允许分析和执行,但不重新托管原始 PDF,页面链接回原始出处。
  • Red:许可不明确或限制较多,仅保存元数据,或等待作者授权。

CiteArk 自己产生的执行记录、指标、日志、provenance 与验证结论,作为独立产生的研究记录保存。

信任与透明

每次执行都会记录论文、代码、数据集、环境的内容摘要以及执行轨迹,并生成可验证的签名。第三方可以据此检查代码完整性、环境一致性、执行来源与输出完整性。

所有由 Agent 生成的内容都与实际执行证据绑定;平台不会把 Agent 的文字判断当作结论本身。失败与复现不成功的记录同样会被保留——失败也是重要的研究证据。