scientific-agent-skills:假设生成技能的 Dated Source Ledger 机制——构建可验证、带日期边界的科学证据来源台账

scientific-agent-skills:假设生成技能的 Dated Source Ledger 机制——构建可验证、带日期边界的科学证据来源台账 scientific-agent-skills假设生成技能的 Dated Source Ledger 机制——构建可验证、带日期边界的科学证据来源台账【免费下载链接】scientific-agent-skillsTurn any AI agent into an AI Scientist. The #1 Agent Skills library for science, used by 190,000 scientists worldwide. 165 ready-to-use validated skills plus 100 scientific databases covering biology, chemistry, medicine, and drug discovery. Compatible with Cursor, Claude Code, Codex, Pi, Antigravity, and the open Agent Skills standard.项目地址: https://gitcode.com/GitHub_Trending/cl/scientific-agent-skills本文基于 scientific-agent-skills 仓库中假设生成hypothesis-generation技能包内的 Dated Source Ledger 文档完整解析该技能如何为文献依据设定带日期、可审计、可机器校验的证据边界从搜索边界声明、核心方法论来源分级、预注册与报告规范来源到因果推断、负责任 AI 与伦理监管来源再到 2025 年美国双重用途dual-use政策的过渡期状态记录。读完后你将掌握一套可复用的来源台账方法论并能结合仓库内置的审计脚本audit_evidence_ledger.py与模板文件在自己的研究中建立同样的证据溯源与合规核验流程。一、定位Dated Source Ledger 是什么不是什么该台账verification cutoff2026-07-23是 hypothesis-generation 技能在 2026-07 进行技能刷新skill refresh时对权威来源做的带日期核查记录机器可读版本为 assets/source_ledger.csv人读版本为 references/source_ledger.md。文档对自身的性质做了明确限定这是理解整套机制的前提它是一次定向的技能刷新不是系统性综述systematic review、专利检索也不能作为科学新颖性的证明搜索优先命中官方域与一手出版物primary publications并通过对全文抽取或搜索摘要来核验标题、日期、版本与相关段落台账记录的是这个技能刷新查到了什么不能从台账推断用户研究课题的新颖性——这是文档Source-use rules第 5 条的硬性规定。这一设计对应了 SKILL.md 工作流第 4 步Establish a dated evidence boundary的要求在依赖文献下结论之前必须先搜索并记录搜索日期与截止时间、数据库/索引、查询与筛选边界、纳入排除的来源类型、支持/挑战各论断的来源以及已知的访问、语言、数据库与时间限制。二、搜索边界Search Boundary十个核查方向台账在Search boundary一节完整列出了本次刷新使用parallel-cli搜索所覆盖的十个方向全部限定在官方或一手域、采用聚焦式查询NIH 关于严谨性、可重复性rigor, reproducibility与 2026 年复制计划replication initiative的内容Cochrane PICO 以及构建良好临床问题well-built clinical question的原始文章FINER 助记符的被归属历史来源与当前解读Platt 的 strong-inference强推断原始论文COS/OSF 的预注册preregistration与注册报告Registered ReportsSPIRIT 2025 与 CONSORT 2025 报告规范因果问题、反事实、estimand效应估计目标与偏倚阴性对照、HARKing、多重性multiplicity、可重复性与复制NIST/UNESCO 负责任 AI 规范以及输出同质化output homogenization的一手证据人、动物、生物安全、生物安保、双重用途、数据与监管关口。这十个方向与 references/literature_search_strategies.md 中分离搜索目标的方法一致——现象、机制、竞争解释、测量、设计、反向证据、安全与治理、优先级/新颖性应各用独立查询避免把机制检索误当新颖性检索。三、核心方法论来源Core Methodology Sources台账把方法论来源分成三个子类每个条目都有稳定的SRC-*标识符与 CSV 台账中的source_id一一对应。3.1 问题构建Question formulation标识符来源台账核验说明SRC-COCHRANE-PICOCochrane Handbook 第 2 章现行版本PICO 用于干预-效应类综述问题目标应在预定义阶段确定并在适当时纳入利益相关方意见SRC-PICO-ORIGINALRichardson et al., 1995,The well-built clinical question四段式临床问题的奠基性文章SRC-FINER-1988Hulley and Cummings,Designing Clinical Research第一版1988元数据本次刷新中定位到的、最早的 FINER 归属来源SRC-FINER-CURRENTWerner and Willis, 2023FINER 的当前解读历史局限Historical limitation的诚实声明值得单独强调本次定向搜索只确认了 1988 年书籍的书目元数据与后人的归属说法未能证明 FINER 助记符的确切首次印刷使用或提出coinage。因此该技能不把这一溯源声明当作已证明does not claim that provenance as proven。在 CSV 中这条记录对应的status字段被标记为historical_metadata_limited而不是current_official——台账用状态字段把元数据有限与现行官方明确区分开。FINERFeasible, Interesting, Novel, Ethical, Relevant在 SKILL.md 中同样被定位为问题精炼助记符而非评分系统Novel必须在有文档支撑的、fit-for-purpose 的检索与专家评审支持之前一律视为未解决。3.2 多假设与可证伪性Multiple hypotheses and falsificationSRC-PLATT-1964— John R. Platt, Strong Inference,Science146:347–353DOI10.1126/science.146.3642.347。这是先生成多个候选、再设计关键实验模式的原始出处SRC-NEG-CONTROL— Lipsitch, Tchetgen Tchetgen, and Cohen, 2010用阴性对照检测混杂与偏倚DOI10.1097/EDE.0b013e3181d61eebSRC-HARKING— Kerr, 1998HARKinghypothesizing after the results are known的定义性文章DOI10.1207/s15327957pspr0203_4SRC-ASA-PVALUE— 美国统计学会ASA声明阈值本身不构成科学结论的依据p 值不衡量假设真实性或效应重要性要求完整报告。这四条来源分别支撑了技能工作流的第 5 步先于选择检验方法生成竞争假设、第 7 步阴性对照必须不可能经由目标机制起作用同时共享相关偏倚通路与第 10 步防 HARKing、暴露偏离。3.3 严谨性、可重复性与复制Rigor, reproducibility, replicationSRC-NIH-RIGOR— NIH 关于科学前提、严谨设计、相关生物学变量、资源认证authentication与透明度的指导SRC-NIH-REPLICATION— NIH 全机构范围的复制与可重复性计划页面于 2026-06-22 审阅SRC-NASEM-RR— 美国国家科学院 2019 年共识报告定义了可重复性reproducibility同一数据/代码/条件下获得一致的计算结果与可复现性replicability用新数据收集对同一问题的一致性验证SRC-TOP— Transparency and Openness Promotion 指南SRC-NIH-DMS— NIH 数据管理与共享DMS政策。台账在此节末尾附加了一条保留条款开放实践仍然受制于知情同意、隐私、社区治理、知识产权、出口管制与安全限制。这与 references/literature_search_strategies.md 中权威不等于免于批判性评价的原则呼应。四、预注册与干预试验Preregistration and intervention trials标识符来源台账核验说明SRC-COS-PREREGCenter for Open Science 预注册官方页预注册把计划内工作与计划外工作分离透明的探索性工作仍然有价值SRC-OSF-REGOSF 注册/预注册现行实施指南带时间戳的计划、模板指南、分析细节、预期偏离SRC-COS-RRCenter for Open Science 注册报告结果盲评results-blind protocol review与原则性接收in-principle acceptanceSRC-SPIRIT-2025SPIRIT 2025 声明现行 34 项随机试验方案报告规范取代SPIRIT 2013SRC-CONSORT-2025CONSORT 2025 声明现行 30 项随机试验结果报告规范涵盖开放科学、 harms、结局、干预细节与重要变更报告台账明确给出定性结论SPIRIT 与 CONSORT 是报告规范不是设计质量、伦理、监管或疗效的认证。CSV 中这两条的version_or_date分别记录为Published 2025-04-28与Published 2025-04-14status为current_primary——日期与现行版属性被同时钉死在台账里这正是dated二字的意义所在。五、因果推断与 EstimandSRC-WHATIF— Hernán 与 Robins 的Causal Inference: What If作者页面链接到核验期间找到的最新修订版SRC-ICH-E9R1— ICH E9(R1) 附录把estimand定义为精确的治疗效应目标并对齐计划、设计、分析、敏感性分析与解释五个环节。台账指出这些来源共同支撑了技能中目标因果对比target causal contrast、估计量estimator、估计值estimate三者区分的框架以及对混杂、选择、对撞collider、测量与干预定义等假设的显式处理。在 SKILL.md 的第 6 步中因果目标必须在分析前定义目标总体、干预/暴露与对照、结局与时间窗、总体层面汇总量、治疗版本与间发事件intercurrent-event处理、识别假设与目标试验/设计类比——台账正是这些要求背后的权威出处。六、负责任 AIResponsible AISRC-NIST-GENAI— NIST AI 600-1 生成式 AI 风险框架覆盖编造confabulation、隐私、有害偏倚/同质化、信息完整性、危险建议与人-AI 配置SRC-UNESCO-AI— UNESCO AI 伦理建议书涵盖人权、隐私、问责、透明、多样性与人类监督SRC-DOSHI-HAUSER— Doshi 与 Hauser, 2024DOI10.1126/sciadv.adn5290。对 Doshi Hauser 的结果台账做了极为克制的表述边界其一手同质化结果是任务特定的在该研究的写作任务中AI 辅助产出彼此更相似同时部分个体创造力指标提升。因此技能把想法同质化当作**一种合理风险plausible risk**处理而不是跨科学领域被测量的普遍效应。这种引用一手结果但拒绝过度外推的写法是整份台账的通用风格。七、伦理与监管来源Ethics and oversight7.1 人类受试者SRC-HHS-COMMON-RULE— 美国共同规则45 CFR 46官方门户SRC-BELMONT— 《贝尔蒙特报告》三原则尊重人、行善、公正SRC-HELSINKI— 世界医学协会《赫尔辛基宣言》2024 年 10 月修订版。台账附带的操作性结论是否有适用性必须由有权限的 IRB/REC 或同等机构判定技能不自我声明豁免the skill does not self-declare exemption。7.2 动物SRC-OLAW-PHS— PHS 政策及覆盖工作的 IACUC/Assurance 要求SRC-ARRIVE— ARRIVE 2.0 报告指南注意是报告指南不是伦理批准或设计质量证书。7.3 生物安全与双重用途SRC-NIH-RSNA— NIH 重组/合成核酸分子研究指南SRC-NIH-BIOSEC— NIH 现行生物安全/生物安保门户SRC-BMBL— CDC/NIH《实验室生物安全手册》BMBL第六版SRC-WHO-LIFE— WHO 生命科学负责任使用全球指导框架。八、美国双重用途政策的过渡期状态关键时效记录台账中U.S. dual-use transition status一节是整份文档里时效性最强的部分它精确记录了核验日2026-07-23时三个相互交叉的信号SRC-EO-142922025-05-05 签署要求修订/取代 2024 年 DURC/PEPP 政策并对覆盖范围内危险的基因获得gain-of-function研究采取暂停/终止措施SRC-NIH-NOT-25-112声明该行政令使 NIH 2024 年的实施方案失效并撤销 NOT-OD-25-061SRC-ASPR-DURC页面在核验时仍描述 2024 年政策等待修订或取代并承诺修订版政策可用时更新页面。CSV 中三条记录的状态分别标记为current_official、current_official和current_transition_notice——过渡状态被显式编码而非笼统标为现行。台账由此给出两条硬规则此状态是时间敏感的任何相关工作前必须重新核查现行联邦、资助方、课题、机构与司法管辖区规则不得把本台账当作放行许可clearance。九、机器可读台账source_ledger.csv 的结构人读版 references/source_ledger.md 与机读版 assets/source_ledger.csv 是同一台账的两种形态。CSV 的表头为source_id,organization,title,version_or_date,source_type,url,verified_on,status,notes各字段的实际用法以 CSV 中真实行为例说明source_id稳定标识符如SRC-NIH-RIGOR与人读版条目一一对应供下游工具交叉引用version_or_date记录版本日期双重信息例如Page updated 2024-10-16NIH Rigor 页面、First edition 1988FINER 书籍、Step 4 2019; implemented 2020ICH E9(R1)source_type对来源分级的受控词汇如official guidance、foundational_primary、current reporting guideline、executive order、consensus reportverified_on全部记录统一为2026-07-23即台账的验证截止日status状态机字段取值如current_official现行官方、foundational_primary奠基性一手来源、historical_metadata_limited历史元数据有限、current_transition_notice过渡期通知——FINER 1988 条目是historical_metadata_limitedASPR DURC 条目是current_transition_noticenotes一句话核验说明同时承载关键限定例如 SPIRIT 2025 的 notes 写明34 项最小方案条目取代 SPIRIT 2013Doshi Hauser 条目写明不得在缺乏证据的情况下把该实验的结论外推到所研究任务之外。这种状态备注双字段设计把来源是否现行证据强度限定条件分离开避免了单一可用/不可用标签造成的信息丢失。十、来源使用规则Source-use rules台账末尾给出 6 条使用规则它们是整个机制落地的行为约束发布或注册前逐条对照在线一手来源核验每个引用与标识符在截止日期之后重新核查时间敏感的政策把每一条科学论断都链接到 assets/evidence_ledger_template.csv 中的证据必须包含挑战性、空结果与局限性证据而不仅仅是支持性证据不得从本来源台账推断新颖性——它记录的是技能刷新不是用户的研究课题未经授权不得把敏感研究问题暴露在任何外部搜索查询中。第 3 条直接连接到技能内置的证据审计工具链下面从源码层面看它是如何被执行的。十一、源码级验证审计脚本如何执行台账规则scripts/audit_evidence_ledger.py 是Source-use rules第 3、4 条的机器执行器它离线无网络审计本地证据台账 CSV 与带日期的搜索边界 JSON字段级校验对应 assets/evidence_ledger_template.csv 的 13 列表头source_id必须是形如字母开头的受控标识符url必须是 HTTPSaccessed_on必须是 ISO 日期publication_date允许YYYY、YYYY-MM、YYYY-MM-DD三种部分日期格式source_type限定为 11 种受控值official_guidance、primary_research、systematic_review、consensus_report 等relation限定为supportive、challenging、contextual、method、safety、mixed六种。规则级校验其中两条直接对应台账文档的语义若某来源的accessed_on晚于搜索边界的searched_on发出SOURCE_ACCESSED_AFTER_SEARCH_BOUNDARY警告——即带日期边界在数据结构层面被强制表达若台账中没有任何relationchallenging的来源发出NO_CHALLENGING_SOURCE_DECLARED警告——即第 4 条必须包含挑战性证据被编码为可检查项若novelty_status被声明为supported_by_documented_comprehensive_search则强制发出NOVELTY_STATUS_REQUIRES_QUALIFIED_HUMAN_REVIEW警告——新颖性声明永远需要合格人类复核机器只允许最高档有文档支撑的有边界搜索且仍打警告。交叉核对传入可选--record假设记录后脚本会检查记录引用的search_boundary_id是否一致、记录声明的来源是否都在台账中缺失则报RECORD_SOURCE_MISSING_FROM_LEDGER错误、台账来源是否都出现在记录中缺失则告警、claim_ids是否都是记录中合法的主张 ID未知则报UNKNOWN_CLAIM_ID。边界声明脚本输出的报告自带notice字段明确本本地审计不访问 URL、不验证来源存在性或内容、不评价证据、不确立新颖性、不判定来源是否支持论断请人工逐条核验来源与链接。这与台账文档的自限定完全一致。运行边界共享工具模块 scripts/_common.py 对所有 CLI 施加统一安全约束——拒绝 URL 型路径与符号链接输入输入上限 2 MiB、CSV 数据 1,000 行、单元格 8,000 字符拒绝重复 JSON 键要求 CSV 表头精确匹配且有序输出使用0600私有权限与原子替换写入且默认拒绝覆盖已存在文件需--force。退出码约定为0结构有效、1完成校验但存在一致性错误、2输入格式非法或不安全。完整的 CLI 参数与推荐执行序列见 references/tool_reference.md。审计命令形态python3 skills/hypothesis-generation/scripts/audit_evidence_ledger.py \ local-evidence.csv local-search-boundary.json \ --record local-record.json其中local-search-boundary.json应基于 assets/search_boundary_template.json 填写——模板固定了schema_version、search_boundary_id、searched_on、searched_by、purpose、databases_or_indexes、queries、date_limits、language_limits、inclusion_scope、exclusion_scope、known_limitations、last_result_screened_or_stop_rule与三值枚举novelty_statusnot_assessed/requires_specialist_review/supported_by_documented_comprehensive_search。十二、方法论要点总结Dated Source Ledger 机制的核心可以归纳为四条可迁移原则证据必须带日期每个来源都有version_or_date与verified_on时间敏感政策如美国 dual-use 过渡状态用专门章节与current_transition_notice状态显式标记并要求截止日期后重新核查状态分级而非布尔判定current_official/foundational_primary/historical_metadata_limited/current_transition_notice等状态区分了现行官方奠基一手元数据有限过渡期FINER 1988 的溯源局限就是靠这一机制被如实表达的人读版与机读版双轨一致Markdown 台账与 CSV 台账共享同一套SRC-*标识符CSV 可被审计脚本消费规则挑战性证据、新颖性状态、日期一致性从文档条款变成可执行的检查项工具只验结构、人类核验内容审计脚本的notice与台账第 1 条规则同向——机器确认链接、格式、一致性来源是否真的支持论断、新颖性是否成立最终由合格人类对照在线一手来源完成。这套机制的适用前提是研究或技能维护场景需要向读者/评审证明文献依据何时、在什么边界下、按什么标准被核查过它的边界同样明确——它不构成系统性综述、不证明新颖性、不替代任何伦理、生物安全或双重用途审查。十三、相关资源导航技能主文档12 步工作流、不可协商边界、本地工具索引SKILL.md来源台账人读版references/source_ledger.md来源台账机读版assets/source_ledger.csv证据台账模板assets/evidence_ledger_template.csv搜索边界模板assets/search_boundary_template.json文献检索策略与来源追溯references/literature_search_strategies.mdCLI 完整参考与安全模型references/tool_reference.md证据审计脚本scripts/audit_evidence_ledger.py共享校验工具输入边界、退出码、原子写scripts/_common.py因果推断与论断类型references/causal_inference_and_claims.md预注册与开放科学references/preregistration_and_open_science.md【免费下载链接】scientific-agent-skillsTurn any AI agent into an AI Scientist. The #1 Agent Skills library for science, used by 190,000 scientists worldwide. 165 ready-to-use validated skills plus 100 scientific databases covering biology, chemistry, medicine, and drug discovery. Compatible with Cursor, Claude Code, Codex, Pi, Antigravity, and the open Agent Skills standard.项目地址: https://gitcode.com/GitHub_Trending/cl/scientific-agent-skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考