Grounded claims reviewer
Skill Nightflight6/open-agent-skills/skills/zh-CN/grounded-claims-reviewer
Bilingual Agent Skills for evidence-driven content, search, and knowledge work.
npx -y skills add Nightflight6/open-agent-skills --skill grounded-claims-reviewerAssembled from the repository path, not quoted from the project. Check it against their README if it does not work.
2 things to look at
- 13 days oldThe repository was created 13 days ago. New is not bad, but a brand new repository carrying a familiar-sounding name is the shape a typosquat arrives in, and there has been no time for anyone else to find a problem with it.
- 1 stars1 stars. Stars are a popularity signal and not a quality one, but at this level it is likely that nobody has read this closely except its author, and you would be relying on your own review.
What its author says it does
Copied from the file, not written here
从文章、报告、研究结果或其他内容中提取、分类、排序、核验和审查重要论断,保留不确定性、来源、适用范围与证据质量。适用于文章或报告的事实审核、论断提取、事实与证据核查、技术参数或数字验证、市场或竞争对手说法审查、无依据确定性与论断膨胀识别,以及论断台账或引用支持关系审计。不应作为普通文字编辑、无事实审核的改写、从零写作、SEO/GEO 策划、深度搜索意图或通用主题研究、简单单一事实查询、翻译、单纯总结、关键词研究或标题生成的主要 Skill。
SKILL.md
8.4 KB, ~2.7k tokens by cl100k_base, as published. Nobody here has run it
可追溯论断核验器
<!-- parity: purpose -->目的
从文章、报告、研究结果或其他内容中识别、分类、排序、核验和审查重要论断,保留不确定性、来源、适用范围、时间和证据质量,防止无依据断言、伪造证据或引用、引用洗白、确认偏误和论断膨胀。
**黄金规则:**事实核验的目标是判断论断是否成立,而不是为既定结论寻找背书。
<!-- parity: guardrails -->不可违反的边界
- 不得编造来源、网址、引用、引语、统计数据或任何证据。
- 不得把来源真实存在误当成它支持准确论断的证明。
- 不得只搜索支持用户既定结论的材料,也不得隐藏重要反证。
- 不得把
attributed、inferred或unverified静默升级为verified。 - 不强制为每个低风险句子添加引用,不进行强制逐句核验,也不创建数值型置信度或通用可信度评分。
- 保留有意义的不确定性,不为了让结论显得明确而夸大论断。
- 除非核验任务确实需要局部修正,否则不重写全文。
选择工作模式
只使用满足请求所需的最小模式:
- **scan(扫描):**快速识别重要和高风险论断、明显无依据的确定表达,以及下一步应核验的项目。除非必要,不进行穷尽式外部核验。
- **verify(核验):**执行实质性论断核验:提取、排序、研究、比较证据、指定状态并建议修正。
- **audit(审计):**审查已有论断台账、证据集、GEO 论断台账、核验表或结构化研究结果,不无必要地重建。
用户明确指定的模式或输出要求优先。只有歧义会实质改变允许范围时才提问。
<!-- parity: inputs-interoperability -->明确输入并保持互操作
确定要审查的内容或台账、论断位置、可用证据、受众、市场、相关时间和模式。接收上游证据表、SERP 观察表、论断台账、答案地图、GEO 内容简报、SEO 内容简报、用户提供的文档和官方参考资料。
阅读 references/output-schema.md。处理 GEO 论断台账时,尽量保留 claim_id,将 claim 映射为 claim_text、evidence_ref 映射为 evidence_refs,保留来源字段,再补充核验专用字段。不得把上游记录自动视为已核实。
选择重要论断
先识别候选论断,再区分可验证命题与纯观点、修辞、建议和风格表达。观点本身不一定是事实论断,但观点中的事实前提可能需要核验。
根据错误后果确定优先级,包括对读者理解、技术正确性、业务或产品决策、品牌可信度、法律或合规风险、市场或财务判断、安全和发布可靠性的影响。不得把所有句子视为同等重要。
<!-- parity: taxonomy-materiality -->分类论断、重要性和时效性
阅读 references/claim-taxonomy.md,选择范围最准确的 claim_type。
materiality、evidence_quality 和 time_sensitivity 只使用 High、Medium 或 Low;它们是定性判断,不是数值评分。当前产品能力、价格、软件版本、法规、政策、市场数据、管理层、排名、可用性、平台政策和当前 AI 产品功能通常具有高时效性。稳定事实不应被强加无必要的新近性要求。
评估证据质量
阅读 references/evidence-quality.md。检查来源权威性、第一手或二手属性、直接性、是否支持准确论断、日期、方法、独立性、语境完整度、范围匹配和版本或产品匹配。
知名域名、专业页面外观或多个网站重复同一无依据说法,都不能自动使证据成为 High。社区证据可以核实“用户报告了某现象”,但不能自动证明该现象普遍成立。
<!-- parity: verification-workflow -->避免确认偏误地核验
阅读 references/verification-workflow.md,按风险采用适度工作流。用户要求“寻找证据证明 X”时,应评估可靠证据是否支持 X。适当时检查重要支持证据与反证;若证据明显偏向一方,也不制造虚假平衡。
可以复用合适的已有证据,但指定状态前必须把证据与准确命题逐项比较。
<!-- parity: entailment-provenance -->检查支持关系与来源链
核对准确命题、对象或产品、版本、时间、地域、单位、测量定义、条件和范围。“最高支持 64 GB”不能核实“默认配置为 64 GB”。
重要论断应在可行时追溯到原始证据。引用层级增多不代表证据增强。若来源只能证明另一个来源说过某句话,使用 attributed;支持仍不足时使用 unverified。
指定规范状态与行动
只使用:
verified:可靠证据在指定范围内直接支持论断;attributed:可核实来源确实提出了该说法,但命题本身未被独立证实;inferred:由证据合理推导,但来源没有直接表述;unverified:可靠支持不足;contradicted:可靠证据与论断存在实质冲突。
recommended_action 只使用 keep、attribute、qualify、revise、remove 或 verify。适合限定或纠正时,给出范围最窄且有用的 revised_claim。
识别论断膨胀与来源冲突
阅读 references/claim-inflation.md,识别确定性、范围、因果、趋势、归属、预测和共识膨胀,只建议证据能够支持的表述。
可靠来源不一致时阅读 references/source-conflicts.md。不得平均冲突事实、静默选择偏好的来源、假设最新来源一定正确,或认为官方来源能够解决所有方法问题。重要冲突未解决时必须明确报告。
<!-- parity: high-risk-claim-types -->处理高风险论断类型
- 比较和最高级论断必须明确市场、时间、比较范围、测量标准、来源和方法;缺失时应限定、核验或删除。
- 因果论断要区分相关、机制与因果,不得从相关性直接推导因果。
- 预测必须保留预测来源、日期和预测期限,不得把预期未来值改写成当前事实。
- 归属型论断只核实谁说了什么,不得静默核实其底层命题。
按宿主政策使用外部工具
保持提供方中立并遵守宿主 Agent 或平台的工具、联网、访问、隐私和审批政策。当前或外部事实会实质影响正确性、工具可用且用户未禁止外部访问时,应进行核验。
外部访问被禁止或不可用时不得编造;视情况保留 unverified、attributed 或 inferred 并说明限制。
安全接入后续编辑
存在 revised_claim 时,下游编辑器应直接采用审查后的措辞,不提高确定性,也不删除适用范围。除非避免事实不一致确实需要,否则修正应保持局部。
更广泛的编辑工作交给 publication-ready-article-editor,不得把论断核验扩展成全文重写。
按模式交付
用户明确的输出要求优先;轻量任务不强制使用大型表格。默认返回:
- **scan:**高风险论断、关键问题和建议的下一步核验;
- **verify:**核验摘要、论断台账、关键修正和剩余待核验事项;
- **audit:**审计发现、论断状态变化、证据缺口和建议行动。
保持证据引用可追溯,并让未解决的不确定性清楚可见。
What ships with it: 9 files
23.1 KB alongside SKILL.md
agents/
- openai.yaml264 B
evals/
- evals.json8.6 KB
- trigger_queries.json4.7 KB
references/
- claim-inflation.md947 B
- claim-taxonomy.md1.4 KB
- evidence-quality.md1.9 KB
- output-schema.md2.4 KB
- source-conflicts.md1.1 KB
- verification-workflow.md1.7 KB