返回逻辑总览

02 / 逻辑发现

遇到新问题
发现新的逻辑

从异常线索提出新问题,形成假设,寻找反例与缺失证据,让新的解释逐步成为可以检验和复用的逻辑。

从这个例子开始
1发现意外的结果2提出新的问题3形成可检验的解释

让 AI 能够继续追问和探索

示例 01 / 智能体可靠性

一个新问题,留下了一条线索

智能体重试工具调用,有些请求写入两次,有些只写入一次。沿着这个异常,看看一个最初的猜想如何变成更准确的检查规则。

通过一个研究流程示例,展示发现、质疑、修正与复核。

交互原理演示 · 合成证据
原始记录告诉了我们什么

对照四次请求的执行记录

请求重试沿用编号写入次数
T-01是否2
T-02是是1
T-03否否1
T-04是否2

“沿用编号”指重试时仍使用同一个请求标识,让工具认出这是同一件事,避免重复执行。

候选逻辑

重试时没有沿用请求编号,可能存在重复写入风险。

展开形式化规则发生重试 ∧ 缺少稳定标识 → 检查重复风险
新的示例轨迹
T-05缺少稳定标识 · 写入 2 次✓
T-06稳定标识 · 写入 1 次✓
  1. 01 / 发现异常

    一个请求,发生两次写入

    T-01 与 T-04 记录了重复写入。它们共同的上下文提供了调查起点。

  2. 02 / 提出新问题

    不同的重试,差别在哪里?

    对照调用轨迹、请求身份以及真正发生的写入结果。

  3. 03 / 形成假设

    初始假设:重试就会重复

    把这个较宽的解释放到全部四条轨迹中检查,包括那些正常完成的请求。

  4. 04 / 寻找反例

    T-02 提供了一个反例

    T-02 重试时沿用了稳定的请求标识,只写入一次。初始解释不能覆盖这个事实。

  5. 05 / 修正逻辑

    更有用的条件浮现了

    重复写入同时伴随“发生重试”和“缺少稳定标识”。这个组合成为下一步需要检验的候选规则。

  6. 06 / 准备复用

    把证据和规则一起留下

    另两条示例轨迹支持这个更细的区分。将候选逻辑、适用范围和例证整理在一起,进入复核与复用。

轨迹 → 问题 → 检验 → 修正
逐步阅读这次发现+
  1. 1

    一个请求,发生两次写入

    T-01 与 T-04 记录了重复写入。它们共同的上下文提供了调查起点。

  2. 2

    不同的重试,差别在哪里?

    对照调用轨迹、请求身份以及真正发生的写入结果。

  3. 3

    初始假设:重试就会重复

    把这个较宽的解释放到全部四条轨迹中检查,包括那些正常完成的请求。

  4. 4

    T-02 提供了一个反例

    T-02 重试时沿用了稳定的请求标识,只写入一次。初始解释不能覆盖这个事实。

  5. 5

    更有用的条件浮现了

    重复写入同时伴随“发生重试”和“缺少稳定标识”。这个组合成为下一步需要检验的候选规则。

  6. 6

    把证据和规则一起留下

    另两条示例轨迹支持这个更细的区分。将候选逻辑、适用范围和例证整理在一起,进入复核与复用。

有价值的产出,是一个有据可查的新问题,以及逐渐清楚的判断条件。

查看原始证据+
S1

工具调用日志 · T-01–T-04

T-01 | retry=true | stable_key=false | writes=2
T-02 | retry=true | stable_key=true | writes=1
T-03 | retry=false | stable_key=false | writes=1
T-04 | retry=true | stable_key=false | writes=2
S2

随候选保留的适用范围

适用情景:示例工具会写入记录,重试应沿用同一个幂等标识。最终保留的是一条重复风险检查规则。

示例 02 / 发现被平均数掩盖的问题

总体变好了,每个渠道呢?

整体转化率从 55% 上升到 78.6%。继续按渠道推导,会发现另一个值得追问的问题。

新的问题:改善来自每个渠道,还是来自访问者结构的变化?

渠道变化前变化后
自然渠道90%90 / 10085%170 / 200
付费渠道20%20 / 10015%3 / 20

每格为转化人数 / 访问人数,两个渠道的转化率都下降了 5 个百分点。

整体转化率

55%
→
78.6%

高转化渠道获得了更大的流量占比,但两个渠道各自的转化率都下降了 5 个百分点。

渠道结构的变化,掩盖了两个渠道各自的下滑。

查看规则+
比较分组转化率 + 比较分组权重 → 检查结构变化的影响

示例 03 / 跨来源逻辑发现

“已发布”,还需要看上下文

发布说明宣布了新功能,测试记录显示它已在测试环境运行。生产配置补上了决定性的区别。

从文档、环境和工具结果之间,发现新的相互核对关系。

S1

发布说明

发布说明已经公告。

release_note = published
S2

测试环境记录

测试环境运行正常。

test_environment = staging
S3

生产环境配置

生产环境尚未启用。

production_enabled = false
派生结论

仅凭公告,还不能推出生产环境已经可用。

查看规则+
生产可用 ← 已启用(生产环境)

把新问题,变成可推进的调查

证据 → 推理 → 可复用知识

01

提出新的解释

结合证据与相关知识,提出此前没有写入检查清单的问题。

02

带着问题补读

沿着假设所需的前提寻找资料,补齐缺失事实,寻找能够区分不同解释的证据。

03

留下更扎实的逻辑

通过反例修正解释,把条件写清楚,再将证据带入复核与知识复用。

CITPROOF

让你的 AI 拥有可核验的推理

带来一个需要更扎实依据的回答、行动或发现流程,一起探索证据链与逻辑核验如何融入你的产品。

与团队交流