# STUDY — 模型注意力懈怠:一次真实观测与对抗工程 > 公开研究笔记(聚合数字+测量方法;不包含任何会话原文)。数据来源与复现方法见文末。 > 相关:docs/DATA.md(原始指标表)· scripts/measure.mjs(开放测量工具) ## 1. 现象:长程任务里,验证会悄悄消失 在 DSH(DeepSeek Harness)的长程多步任务中,我们观测到一类稳定模式:**任务推进到中后段, 模型对"验证/核对"类动作的投入显著衰减**——表现为工具调用稀疏、图像/画面核对归零、出现 "做过即通过"的惯性。我们把它称为**注意力懈怠**(attentional slack):不是能力不足, 而是注意预算在长程里被惯性侵蚀。 这不是理论假设,是分段统计出来的观测(见 §3)。 ## 2. 测量方法(开放可复现) - **度量单元**:一个小类 = 从"焦点注入"到"打卡"(mark_task)之间的事件段。 - **三个指标**:工具调用数 / 图像核对数(read_image)/ 外部检查数(红队裁决等)。 - **分段**:首个十小类(早段)、中间(中段)、末个十小类(晚段)。 - **数据源**:会话导出文件(`session.jsonl`),公开聚合工具 `scripts/measure.mjs` (输入导出文件 → 输出指标行,任何人都能对自己的会话复算)。 ## 3. 观测数据(真实会话) | 会话 | 链 | 早段 | 中段 | 晚段 | 判定 | |---|---|---|---|---|---| | A(基线,无协议 3.0 早期链) | 无分级协议 | 26 工具 / 15 读图 | 7-10 工具 / 10-25 读图 | **1 工具 / 0 读图**(后续多个小类) | **显著衰减**——验证几乎消失 | | B(钩子前 3.0 链) | 三级协议雏形 | 21.7-32.7 工具/项 | **14.0-13.7 工具/项**(洼地) | 20.3-37.0 工具/项(末项红队 78 工具/29 编辑) | 中段洼地+末段最强 | | C(3.2 协议链) | 全协议 | 全链均匀(24/24 打卡、75 张截图) | — | — | **无衰减迹象** | 数字口径见 DATA.md;A 的晚段"1 工具/0 读图"= 验证行为**消失**的基准观测。 ## 4. 对抗工程(插件机制 ↔ 观测对照) | 懈怠表现 | 对抗机制 | 观测对照 | |---|---|---| | 验证稀疏 | **打卡硬门**:每小类都有标记门,无省事路径 | C 链 24/24 打卡(A 链晚段不足 1/3) | | "做过即通过" | **红队裁决门**:verify=redteam 未通过不得打卡;打回必须再审批 | B 链末项红队 78 工具;7abc5cad 2 次裁决 pass | | 注意漂移 | **北极星锚定**:每小类开工前一眼"目的+验收锚" | 焦点注入统一携带星锚(终止"跳步") | | 组级滑过 | **组收官逐条核对**(严苛 > 小类) | 组级标准逐条判定记录 | ## 5. 结论 1. 注意力懈怠在无协议长程任务中**可观测且显著**(A 链晚段验证消失)。 2. 协议链(C)**未出现衰减**——对抗机制在实测中有效(不是口头承诺)。 3. 本观测**方法公开、数据可复算**(measure.mjs + 用户自己的会话)——不做"不可验证"的断言。 ## 6. 复现路径 ``` # 1. 导出任一会话(DSH 会话面板/存档),得到 session.jsonl # 2. 复算指标行: node scripts/measure.mjs 我的会话.jsonl # 3. 输出 = 工具调用数 / 读图数 / 标定数 / 红队数 / 分段衰减行 ``` > 数据合规:只读事件类型聚合,不输出会话内容(任何文本、路径、用户名都不出现在输出中)。