Grounded claims reviewer
Skill Nightflight6/open-agent-skills/skills/zh-CN/grounded-claims-reviewer
从文章、报告、研究结果或其他内容中提取、分类、排序、核验和审查重要论断,保留不确定性、来源、适用范围与证据质量。适用于文章或报告的事实审核、论断提取、事实与证据核查、技术参数或数字验证、市场或竞争对手说法审查、无依据确定性与论断膨胀识别,以及论断台账或引用支持关系审计。不应作为普通文字编辑、无事实审核的改写、从零写作、SEO/GEO 策划、深度搜索意图或通用主题研究、简单单一事实查询、翻译、单纯总结、关键词研究或标题生成的主要 Skill。From its SKILL.md
npx -y skills add Nightflight6/open-agent-skills --skill grounded-claims-reviewerAssembled from the repository path, not quoted from the project. Check it against their README if it does not work.
One thing to look at
- 1 stars1 stars. Stars are a popularity signal and not a quality one, but at this level it is likely that nobody has read this closely except its author, and you would be relying on your own review.
SKILL.md
8.4 KB, ~2.7k tokens by cl100k_base, as published. Nobody here has run it
可追溯论断核验器
<!-- parity: purpose -->目的
从文章、报告、研究结果或其他内容中识别、分类、排序、核验和审查重要论断,保留不确定性、来源、适用范围、时间和证据质量,防止无依据断言、伪造证据或引用、引用洗白、确认偏误和论断膨胀。
**黄金规则:**事实核验的目标是判断论断是否成立,而不是为既定结论寻找背书。
<!-- parity: guardrails -->不可违反的边界
- 不得编造来源、网址、引用、引语、统计数据或任何证据。
- 不得把来源真实存在误当成它支持准确论断的证明。
- 不得只搜索支持用户既定结论的材料,也不得隐藏重要反证。
- 不得把
attributed、inferred或unverified静默升级为verified。 - 不强制为每个低风险句子添加引用,不进行强制逐句核验,也不创建数值型置信度或通用可信度评分。
- 保留有意义的不确定性,不为了让结论显得明确而夸大论断。
- 除非核验任务确实需要局部修正,否则不重写全文。
选择工作模式
只使用满足请求所需的最小模式:
- **scan(扫描):**快速识别重要和高风险论断、明显无依据的确定表达,以及下一步应核验的项目。除非必要,不进行穷尽式外部核验。
- **verify(核验):**执行实质性论断核验:提取、排序、研究、比较证据、指定状态并建议修正。
- **audit(审计):**审查已有论断台账、证据集、GEO 论断台账、核验表或结构化研究结果,不无必要地重建。
用户明确指定的模式或输出要求优先。只有歧义会实质改变允许范围时才提问。
<!-- parity: inputs-interoperability -->明确输入并保持互操作
确定要审查的内容或台账、论断位置、可用证据、受众、市场、相关时间和模式。接收上游证据表、SERP 观察表、论断台账、答案地图、GEO 内容简报、SEO 内容简报、用户提供的文档和官方参考资料。
阅读 references/output-schema.md。处理 GEO 论断台账时,尽量保留 claim_id,将 claim 映射为 claim_text、evidence_ref 映射为 evidence_refs,保留来源字段,再补充核验专用字段。不得把上游记录自动视为已核实。
选择重要论断
先识别候选论断,再区分可验证命题与纯观点、修辞、建议和风格表达。观点本身不一定是事实论断,但观点中的事实前提可能需要核验。
根据错误后果确定优先级,包括对读者理解、技术正确性、业务或产品决策、品牌可信度、法律或合规风险、市场或财务判断、安全和发布可靠性的影响。不得把所有句子视为同等重要。
<!-- parity: taxonomy-materiality -->分类论断、重要性和时效性
阅读 references/claim-taxonomy.md,选择范围最准确的 claim_type。
materiality、evidence_quality 和 time_sensitivity 只使用 High、Medium 或 Low;它们是定性判断,不是数值评分。当前产品能力、价格、软件版本、法规、政策、市场数据、管理层、排名、可用性、平台政策和当前 AI 产品功能通常具有高时效性。稳定事实不应被强加无必要的新近性要求。
评估证据质量
阅读 references/evidence-quality.md。检查来源权威性、第一手或二手属性、直接性、是否支持准确论断、日期、方法、独立性、语境完整度、范围匹配和版本或产品匹配。
知名域名、专业页面外观或多个网站重复同一无依据说法,都不能自动使证据成为 High。社区证据可以核实“用户报告了某现象”,但不能自动证明该现象普遍成立。
<!-- parity: verification-workflow -->避免确认偏误地核验
阅读 references/verification-workflow.md,按风险采用适度工作流。用户要求“寻找证据证明 X”时,应评估可靠证据是否支持 X。适当时检查重要支持证据与反证;若证据明显偏向一方,也不制造虚假平衡。
可以复用合适的已有证据,但指定状态前必须把证据与准确命题逐项比较。
<!-- parity: entailment-provenance -->检查支持关系与来源链
核对准确命题、对象或产品、版本、时间、地域、单位、测量定义、条件和范围。“最高支持 64 GB”不能核实“默认配置为 64 GB”。
重要论断应在可行时追溯到原始证据。引用层级增多不代表证据增强。若来源只能证明另一个来源说过某句话,使用 attributed;支持仍不足时使用 unverified。
指定规范状态与行动
只使用:
verified:可靠证据在指定范围内直接支持论断;attributed:可核实来源确实提出了该说法,但命题本身未被独立证实;inferred:由证据合理推导,但来源没有直接表述;unverified:可靠支持不足;contradicted:可靠证据与论断存在实质冲突。
recommended_action 只使用 keep、attribute、qualify、revise、remove 或 verify。适合限定或纠正时,给出范围最窄且有用的 revised_claim。
识别论断膨胀与来源冲突
阅读 references/claim-inflation.md,识别确定性、范围、因果、趋势、归属、预测和共识膨胀,只建议证据能够支持的表述。
可靠来源不一致时阅读 references/source-conflicts.md。不得平均冲突事实、静默选择偏好的来源、假设最新来源一定正确,或认为官方来源能够解决所有方法问题。重要冲突未解决时必须明确报告。
<!-- parity: high-risk-claim-types -->处理高风险论断类型
- 比较和最高级论断必须明确市场、时间、比较范围、测量标准、来源和方法;缺失时应限定、核验或删除。
- 因果论断要区分相关、机制与因果,不得从相关性直接推导因果。
- 预测必须保留预测来源、日期和预测期限,不得把预期未来值改写成当前事实。
- 归属型论断只核实谁说了什么,不得静默核实其底层命题。
按宿主政策使用外部工具
保持提供方中立并遵守宿主 Agent 或平台的工具、联网、访问、隐私和审批政策。当前或外部事实会实质影响正确性、工具可用且用户未禁止外部访问时,应进行核验。
外部访问被禁止或不可用时不得编造;视情况保留 unverified、attributed 或 inferred 并说明限制。
安全接入后续编辑
存在 revised_claim 时,下游编辑器应直接采用审查后的措辞,不提高确定性,也不删除适用范围。除非避免事实不一致确实需要,否则修正应保持局部。
更广泛的编辑工作交给 publication-ready-article-editor,不得把论断核验扩展成全文重写。
按模式交付
用户明确的输出要求优先;轻量任务不强制使用大型表格。默认返回:
- **scan:**高风险论断、关键问题和建议的下一步核验;
- **verify:**核验摘要、论断台账、关键修正和剩余待核验事项;
- **audit:**审计发现、论断状态变化、证据缺口和建议行动。
保持证据引用可追溯,并让未解决的不确定性清楚可见。
What ships with it: 9 files
23.1 KB alongside SKILL.md
agents/
- openai.yaml264 B
evals/
- evals.json8.6 KB
- trigger_queries.json4.7 KB
references/
- claim-inflation.md947 B
- claim-taxonomy.md1.4 KB
- evidence-quality.md1.9 KB
- output-schema.md2.4 KB
- source-conflicts.md1.1 KB
- verification-workflow.md1.7 KB