跳到正文
EVIDENCE-CONSTRAINED NARRATIVE RESEARCH PROTOTYPE

让每一段戏剧,
都有证据来路。

从一页史料到一段文本,中间不应该是黑箱。把来源、证据、推断、历史世界与创作权限分开,让 AI 清楚知道:什么可以写,什么还不能写。

研究原型L2 已达成L3 CONDITIONAL等待第二来源人工核验
SOURCE / CLAIM / EVIDENCE

“允许写什么”与
“我们知道什么”
必须分开记录。

WORLD ≠ DRAMA

先研究,再准入,再创作。

每一步都留下“知道了什么”和“为什么允许这样写”的依据。历史真假等级与戏剧使用权限是两条独立轴。

从材料到可验收文本史料 / 资产命题 / 位置证据 / 推断历史世界创作决策场景蓝图文本单元用户验收Source → Claim → Evidence → World → Dramatic Decision → Scene Blueprint → Scene Text → Acceptance
概念流程,不代表无需人工判断的全自动服务。
01 / PROVENANCE

原文与推断分离

推理命题不能伪造“原文出现”。

02 / EVIDENCE

证据不能静默升级

下游不能抬高上游可信度。

03 / PERMISSION

创作必须有边界

对白、动作、站位等 completion 需要明确授权。

04 / ACCEPTANCE

生成不等于验收

Agent 永不自动接受最终文本。

三个小案例,三个边界。

价值不在“写得像”,而在最容易滑坡的地方仍能克制。

CASE A · WORLD MODALITY

“决定修建”不能写成“已经建成”。

World basis 只允许断言:1876 年 P. Lorenzo Tchan 决定修建小教堂。工程完成状态不能被戏剧顺滑感偷渡进历史层。

“我要在这里建一座小教堂。”
HISTORY决定修建,不等于已建成。
DRAMA对白可作为获批 completion,但不是史料原话。

两个 Source ID,不等于两条证据链。

最重要的一次纠错,是承认 S-0001 与 S-0005 最终共享 Fogolla 底层报告。

Fogolla 原报告S-0005 · 1896/1897S-0001 · 1910 删节同一底层来源链S-0002 · Häring 1934独立来源候选P2 Shadow 已验收等待人工核验 → canonical
来源独立性按 Evidence lineage 判断,而不是按文件编号计数。

把“错误成功”留在开发史里。

不同出版物一度被当成独立 lineage,后来通过来源关系复审撤回 L3 宣称。成熟不是从不犯错,而是错误能够显式回退。

SOURCE_COUNT ↑
≠ EVIDENCE_INDEPENDENCE ↑

L3 → CONDITIONAL
L2 → HELD

Canonical 与 Shadow,永远不是同一条轨道。

两个模型读法一致,不是人类校读。Shadow 的目的,是验证接口与语义边界,而不是绕过正式准入。

CANONICALSHADOW正式证据 / WorldDD / SB5 个正式 STX未人工核验读稿validation-onlyP2 Shadow 已验收禁止 rename/copy 直接升级

从 P1 到 P10:把“能写”变成“为什么能写”。

关键进展常来自回退:World 发现证据 backlog 就回 Evidence;Blueprint 发现权限不足就回 DD;来源独立性判断错误就撤回 L3。

P1
SOURCE

材料与资产

保留来源、页图、扫描、目录与文件哈希。

P2
CLAIM

命题与原文位置

Claim 与 occurrence 分离;推断不伪造原文。

P3
EVIDENCE

证据评估与显式推断

EA / IR 保存支持强度、限制与推理前提。

P4
WORLD

历史世界准入

WRD 决定哪些命题进入 World,而非全量复制 Claim。

P5–7
DRAMA

DD → SB → STX

创作权限可审计,完成真实生成、评价与用户验收。

P8
GENERALIZE

多场景与来源链纠错

扩展到 practice、multi-WP、reported narrative,同时撤回错误的 L3 认定。

P9
SHADOW

Häring 第二来源 walkthrough

验证第二条工程路径,却拒绝在无人类核验时直接 canonicalize。

P10
HUMAN

把阻塞缩小到四行人工核验

已向班贝格档案馆发出 confirm-or-correct 请求;当前等待回复。

现在可以说什么,不能说什么。

公开项目最重要的,是把“已验证路径”与“未完成能力”分开。

已经验证

  • 5 个正式 ACCEPTED STX 样本。
  • EVENT / STATE / PRACTICE / multi-WP / reported voice。
  • 无 completion 权限时可以真的不补写。
  • Shadow 第二来源 E2E 已走到用户验收。
  • 下游缺口能回到正确上游层修复。

仍未验证 / 不应宣称

  • 第二条 canonical 独立证据链尚未完成。
  • L3 仍为 CONDITIONAL,正式成熟度保持 L2。
  • 不是完整剧本、成片或历史真伪自动裁判。
  • 不能承诺“零幻觉”;目标是让风险可见、可拒绝、可追溯。

把过程公开,而不是只公开结果。

公开发行会包含可公开的源码、Schemas、工作流说明、验证样本与开发纪事;不会包含私人邮件、个人地址、未经授权的档案扫描、密钥或未筛选日志。研究 gate 与开源发布是两条任务。

发布状态:中文入口、开发纪事与 sanitized source release 均已公开;研究认证仍与代码发布分轨。

conanxin / research-to-drama-skills

Public release status

Engine 的真实源码已经从原 Hermes 工作树导出为 sanitized public release,公开了 schemas、skills、docs、evals、测试与去隐私化 pilot;私人扫描与往来邮件未进入发行树。

SOURCE REPO · PUBLIC

WAIT_FOR_EXTERNAL_HUMAN_REPLY