agentsclimarketplace

Grounded claims reviewer

Skill Nightflight6/open-agent-skills/skills/zh-CN/grounded-claims-reviewer

从文章、报告、研究结果或其他内容中提取、分类、排序、核验和审查重要论断,保留不确定性、来源、适用范围与证据质量。适用于文章或报告的事实审核、论断提取、事实与证据核查、技术参数或数字验证、市场或竞争对手说法审查、无依据确定性与论断膨胀识别,以及论断台账或引用支持关系审计。不应作为普通文字编辑、无事实审核的改写、从零写作、SEO/GEO 策划、深度搜索意图或通用主题研究、简单单一事实查询、翻译、单纯总结、关键词研究或标题生成的主要 Skill。From its SKILL.md

Install
npx -y skills add Nightflight6/open-agent-skills --skill grounded-claims-reviewer

Assembled from the repository path, not quoted from the project. Check it against their README if it does not work.

One thing to look at

  • 1 stars1 stars. Stars are a popularity signal and not a quality one, but at this level it is likely that nobody has read this closely except its author, and you would be relying on your own review.

SKILL.md

8.4 KB, ~2.7k tokens by cl100k_base, as published. Nobody here has run it

可追溯论断核验器

<!-- parity: purpose -->

目的

从文章、报告、研究结果或其他内容中识别、分类、排序、核验和审查重要论断,保留不确定性、来源、适用范围、时间和证据质量,防止无依据断言、伪造证据或引用、引用洗白、确认偏误和论断膨胀。

**黄金规则:**事实核验的目标是判断论断是否成立,而不是为既定结论寻找背书。

<!-- parity: guardrails -->

不可违反的边界

  • 不得编造来源、网址、引用、引语、统计数据或任何证据。
  • 不得把来源真实存在误当成它支持准确论断的证明。
  • 不得只搜索支持用户既定结论的材料,也不得隐藏重要反证。
  • 不得把 attributedinferredunverified 静默升级为 verified
  • 不强制为每个低风险句子添加引用,不进行强制逐句核验,也不创建数值型置信度或通用可信度评分。
  • 保留有意义的不确定性,不为了让结论显得明确而夸大论断。
  • 除非核验任务确实需要局部修正,否则不重写全文。
<!-- parity: mode-routing -->

选择工作模式

只使用满足请求所需的最小模式:

  1. **scan(扫描):**快速识别重要和高风险论断、明显无依据的确定表达,以及下一步应核验的项目。除非必要,不进行穷尽式外部核验。
  2. **verify(核验):**执行实质性论断核验:提取、排序、研究、比较证据、指定状态并建议修正。
  3. **audit(审计):**审查已有论断台账、证据集、GEO 论断台账、核验表或结构化研究结果,不无必要地重建。

用户明确指定的模式或输出要求优先。只有歧义会实质改变允许范围时才提问。

<!-- parity: inputs-interoperability -->

明确输入并保持互操作

确定要审查的内容或台账、论断位置、可用证据、受众、市场、相关时间和模式。接收上游证据表、SERP 观察表、论断台账、答案地图、GEO 内容简报、SEO 内容简报、用户提供的文档和官方参考资料。

阅读 references/output-schema.md。处理 GEO 论断台账时,尽量保留 claim_id,将 claim 映射为 claim_textevidence_ref 映射为 evidence_refs,保留来源字段,再补充核验专用字段。不得把上游记录自动视为已核实。

<!-- parity: claim-selection -->

选择重要论断

先识别候选论断,再区分可验证命题与纯观点、修辞、建议和风格表达。观点本身不一定是事实论断,但观点中的事实前提可能需要核验。

根据错误后果确定优先级,包括对读者理解、技术正确性、业务或产品决策、品牌可信度、法律或合规风险、市场或财务判断、安全和发布可靠性的影响。不得把所有句子视为同等重要。

<!-- parity: taxonomy-materiality -->

分类论断、重要性和时效性

阅读 references/claim-taxonomy.md,选择范围最准确的 claim_type

materialityevidence_qualitytime_sensitivity 只使用 HighMediumLow;它们是定性判断,不是数值评分。当前产品能力、价格、软件版本、法规、政策、市场数据、管理层、排名、可用性、平台政策和当前 AI 产品功能通常具有高时效性。稳定事实不应被强加无必要的新近性要求。

<!-- parity: evidence-quality -->

评估证据质量

阅读 references/evidence-quality.md。检查来源权威性、第一手或二手属性、直接性、是否支持准确论断、日期、方法、独立性、语境完整度、范围匹配和版本或产品匹配。

知名域名、专业页面外观或多个网站重复同一无依据说法,都不能自动使证据成为 High。社区证据可以核实“用户报告了某现象”,但不能自动证明该现象普遍成立。

<!-- parity: verification-workflow -->

避免确认偏误地核验

阅读 references/verification-workflow.md,按风险采用适度工作流。用户要求“寻找证据证明 X”时,应评估可靠证据是否支持 X。适当时检查重要支持证据与反证;若证据明显偏向一方,也不制造虚假平衡。

可以复用合适的已有证据,但指定状态前必须把证据与准确命题逐项比较。

<!-- parity: entailment-provenance -->

检查支持关系与来源链

核对准确命题、对象或产品、版本、时间、地域、单位、测量定义、条件和范围。“最高支持 64 GB”不能核实“默认配置为 64 GB”。

重要论断应在可行时追溯到原始证据。引用层级增多不代表证据增强。若来源只能证明另一个来源说过某句话,使用 attributed;支持仍不足时使用 unverified

<!-- parity: status-actions -->

指定规范状态与行动

只使用:

  • verified:可靠证据在指定范围内直接支持论断;
  • attributed:可核实来源确实提出了该说法,但命题本身未被独立证实;
  • inferred:由证据合理推导,但来源没有直接表述;
  • unverified:可靠支持不足;
  • contradicted:可靠证据与论断存在实质冲突。

recommended_action 只使用 keepattributequalifyreviseremoveverify。适合限定或纠正时,给出范围最窄且有用的 revised_claim

<!-- parity: inflation-conflicts -->

识别论断膨胀与来源冲突

阅读 references/claim-inflation.md,识别确定性、范围、因果、趋势、归属、预测和共识膨胀,只建议证据能够支持的表述。

可靠来源不一致时阅读 references/source-conflicts.md。不得平均冲突事实、静默选择偏好的来源、假设最新来源一定正确,或认为官方来源能够解决所有方法问题。重要冲突未解决时必须明确报告。

<!-- parity: high-risk-claim-types -->

处理高风险论断类型

  • 比较和最高级论断必须明确市场、时间、比较范围、测量标准、来源和方法;缺失时应限定、核验或删除。
  • 因果论断要区分相关、机制与因果,不得从相关性直接推导因果。
  • 预测必须保留预测来源、日期和预测期限,不得把预期未来值改写成当前事实。
  • 归属型论断只核实谁说了什么,不得静默核实其底层命题。
<!-- parity: external-tools -->

按宿主政策使用外部工具

保持提供方中立并遵守宿主 Agent 或平台的工具、联网、访问、隐私和审批政策。当前或外部事实会实质影响正确性、工具可用且用户未禁止外部访问时,应进行核验。

外部访问被禁止或不可用时不得编造;视情况保留 unverifiedattributedinferred 并说明限制。

<!-- parity: publication-integration -->

安全接入后续编辑

存在 revised_claim 时,下游编辑器应直接采用审查后的措辞,不提高确定性,也不删除适用范围。除非避免事实不一致确实需要,否则修正应保持局部。

更广泛的编辑工作交给 publication-ready-article-editor,不得把论断核验扩展成全文重写。

<!-- parity: delivery -->

按模式交付

用户明确的输出要求优先;轻量任务不强制使用大型表格。默认返回:

  • **scan:**高风险论断、关键问题和建议的下一步核验;
  • **verify:**核验摘要、论断台账、关键修正和剩余待核验事项;
  • **audit:**审计发现、论断状态变化、证据缺口和建议行动。

保持证据引用可追溯,并让未解决的不确定性清楚可见。

What ships with it: 9 files

23.1 KB alongside SKILL.md

agents/

Keep looking

Skills are one crate of 325,949. Ordering is by how many stacks a row turns up in, so the top of any crate is what has actually been picked rather than what has the most stars.