--- name: fact-check version: 1.0.0 description: "事实核查(Cartesian Fact-Check):按笛卡尔式怀疑底色,把一个说法拆成「事实 / 结论 / 价值判断」三层,联网核查事实并评级(已证实 / 需收窄 / 有争议 / 证据不足 / 明显错误),再审查推理链(隐含假设、因果混淆、遗漏解释、成立条件),最后输出可信度结论。触发词:事实核查 / 我要核查的说法是:【…】模板 / 帮我核查 / 这个说法靠谱吗 / 笛卡尔式怀疑 / 怀疑一切 / 帮我验证这段内容。适用:需要严谨核查一段观点、结论、数据或方案;不适用:简单事实查询(用 byted-web-search)、不需要批判性拆解的快速问答。" --- # 事实核查(Cartesian Fact-Check) **核心信念**:无论是人类还是 AI 的内容,都要尽可能怀疑一切。一个说法 = 事实 + 推理 + 价值判断,三者必须分开审。先核查事实,再审查推理,最后才谈可信度。 ## 何时使用 - **显式触发**:用户粘贴「我要核查的说法是:【…】」模板;或说「事实核查」「帮我核查」「这个说法靠谱吗」「怀疑一切」「帮我验证这段内容」 - **隐式触发**:一段观点/结论/数据/方案将被作为决策依据,值得先批判性核查 - 不适用:简单事实查询(用 byted-web-search 直接查)、用户要求直接给结论的小问题 ## 阶段一:拆解(三层结构) 把要核查的说法拆成三部分,缺一不可: 1. **可以被外部验证的事实**——可查证的主张(来源、样本、时间、数字、事件) 2. **从事实推出的结论**——推理层,可能包含多个步骤 3. **其中包含的价值判断**——好坏、应当与否、重要与否(不可外部验证,只能审视其立场) 输出拆解时明确标注:哪句是事实陈述、哪句是推理、哪句是价值判断。若用户原话混杂,逐句归类。 ## 阶段二:事实核查(联网 + 评级) 对每个事实部分,联网核查(优先用 byted-web-search 技能,必要时 web_search)以下维度: - **来源**:原始出处是谁?是一手还是二手? - **样本**:样本量、代表性、是否以偏概全 - **时间**:信息是否过时?时效是否影响结论? - **完整上下文**:是否断章取义?被省略的部分是否改变含义? 然后给每个事实标记评级: 1. **已证实**——多个独立可信来源一致支持 2. **基本成立,但需要收窄**——方向对,但范围/精度/边界需修正 3. **存在争议**——可靠来源间意见不一 4. **证据不足**——查不到充分证据,或只有孤证/传闻 5. **明显错误**——与可靠证据直接矛盾 ## 阶段三:推理审查(假设事实成立) 即使事实全部成立,继续检查推理链: 1. **事实能否推出当前结论**——推理步骤是否每一步都站得住 2. **是否藏着未经验证的假设**——结论依赖但没被证明的前提 3. **是否混淆相关性和因果关系**——相关 ≠ 因果,方向是否搞反 4. **是否遗漏了其他解释或关键信息**——有没有更简单的解释被跳过 5. **结论在什么条件下成立或失效**——边界条件、反例、适用域 ## 阶段四:输出(4 项结论) 1. **哪些事实可信,哪些需要修正**——逐条列出评级结果 2. **推理链中最关键的漏洞**——找出导致结论可能不成立的那一环 3. **补强后的最合理版本**——修正事实、补足假设后的重述 4. **我目前可以相信到什么程度**——给出明确的置信度结论(如「核心结论可信,数字需以官方为准」「证据不足,仅可作参考」) ## 行为纪律 - **先拆解后核查**:不拆解就核查会把价值判断当事实验证 - **怀疑一切,但不虚无**:怀疑是方法论,不是结论;核查后要给出明确的相信程度 - **区分层级**:事实评级 ≠ 推理审查 ≠ 整体可信度,三者分开呈现 - **标注证据缺口**:查不到的东西明说「证据不足」,不用「大概率」掩盖 - 涉及实时事实时调用联网搜索,不凭记忆作答 - 用户要求快速答案时,可只给阶段四的第 1 和第 4 项,但注明省略了拆解与推理审查 # 完成标准 - 阶段一:三层拆解齐全,逐句归类 - 阶段二:每个事实有来源核查 + 明确评级(5 档之一) - 阶段三:5 个推理检查点逐一过 - 阶段四:4 项输出齐全,含明确的置信度结论