尊重同意的队列.
Atlas、i2b2 这类队列工具按临床条件选人,同意在工具之外处理。 Forge 的设计是让每次查询都限定在同意范围内,每次访问都经过 HAVEN 审计。参考实现目前在研究入组和价值分配环节做到了这一点,队列导出的同意约束是下一步。开发和测试基于 MIMIC-IV 数据集。
每个临床研究者都懂的三处痛。
队列合规全靠赌
Atlas、i2b2 和 EDW 导出只按条件筛选,完全忽略知情同意语境。你发布的队列可能包含从未同意该用途的患者。直到有人问起,你才会发现问题。
IRB 要审计链,拿不出来
当 IRB 或期刊问起谁同意了什么,你只能从电子表格、邮件和 EHR 审计日志里拼凑。没有一条完整的、签名过的审计链。根本就没有审计链。
多中心队列卡死在文书上
跨机构数据共享需要按机构配对签署 BAA、DUA、IRB 互认。一条查询跑起来之前,要先熬过几个月的法务流程。大多数多中心研究在这里失败,而不是在科学上。
Forge 作为队列构建器。HAVEN 管理知情同意与审计。PSDL 让每个定义在跨机构间可移植、可复现。
Forge
Prometheno
PSDL 系列
同一个场景。两个模拟站点。哈希逐字节一致。
一个 AKI 检测场景,在 psdl-inspector 中编写一次,编译为认证包,分别在 MIMIC-IV(站点 A)和模拟数据集(站点 B)上执行。输出哈希一致。这就是协议层的可复现性。



编写
在 psdl-inspector 中使用 KDIGO 标准编写 AKI 场景。
scenario: AKI_Detection audit: intent: ... rationale: KDIGO 2012 signals: { Cr: ... } trends: { delta_6h: ... } logic: { aki_risk: ... }认证
编译为认证包。由 SHA-256 锁定全部内容。
{ "bundle_version": "1.1", "checksum": "sha256:abc123...", "scenario": { ... }, "terminology_anchors": { "creatinine": { "concept_id": 3016723, "vocabulary_id": "LOINC" } } }运行 · 站点 A
通过 Prometheno 在 MIMIC-IV 上执行。哈希记录在 HAVEN 审计链中。
$ psdl run bundle.json --site mimic-iv Triggered patients: 47 Result IR hash: 0x9799d065d19f...e583 HAVEN audit entry: #1247运行 · 站点 B
同一 bundle,不同数据集。哈希一致。可复现性,已证明。
$ psdl run bundle.json --site sim-b
Triggered patients: 31
Result IR hash:
0x9799d065d19f...e583
HAVEN audit entry: #889
✓ 哈希一致MIMIC-IV Colab notebook,在浏览器里端到端跑完。不用装东西。
图中哈希为示意。输入相同,实际运行的哈希就相同。
问与答。
- Forge 和 Atlas、i2b2 有什么不同?
- Atlas、i2b2 这类队列工具按临床条件选人,同意在工具之外处理。Forge 的设计是让队列查询和导出都限定在 HAVEN 同意范围内,审计链边查边写。目前参考实现已在研究入组和价值分配环节做到这一点,队列导出的同意约束是下一步。
- Prometheno 用什么数据模型?
- 以 OMOP CDM 5.4 为标准模型,带完整的 OHDSI 词表;FHIR R4 用于导入和导出。平台在 1,000 名患者的 MIMIC-IV 数据集上开发和测试,含 42.9 万条检验记录。
- PSDL 是什么?必须用吗?
- 患者场景定义语言。场景或队列定义写一次,编译成带签名、带版本的认证包(Certified Bundle),在任何 OMOP 或 FHIR 数据源上都以同样方式运行。多中心研究推荐使用,不强制。
- 交给伦理委员会的是什么?
- 同意登记记录,加上防篡改的审计日志和每条记录在日志中的证明。两者和执行查询的是同一份来源,不用再从表格里拼。
- 费用怎么算?
- Prometheno 处于试点前期。底下的协议是开放的:HAVEN 采用 CC BY 4.0,PSDL 和 VERITAS 采用 Apache 2.0。平台访问和试点条款请来信。
- 能在我自己的数据上跑吗?
- 能。PSDL 的数据适配器有文档可循,还有一个在 MIMIC-IV 上端到端跑通的 Colab notebook。Prometheno 的后端是 HAVEN 的参考实现,27 项协议测试覆盖同意、审计和价值分配。
规模化以后是什么样。
跨机构队列从几个月缩短到几小时。多中心可复现性成为默认。IRB 文档从执行源自动生成。研究者把时间花在科学上,而不是数据获取上。
底下的协议保持开放:HAVEN 采用 CC BY 4.0,PSDL 和 VERITAS 采用 Apache 2.0。Prometheno 是跑它们的平台。