# 开源情报-试验项目采集 技能

## ⛔ 核心铁律

**全篇文档不能有任何编造，必须全部来自于真实报道。**

- 报告中每一个论断、每一条数据、每一个人名/机构名/日期，都必须能在采集源文件中找到对应原文
- 任何无法在采集源中验证的内容，该章节直接**删除**，不保留空章节，绝不编造填充
- 合理推演必须明确标注"以下为基于XX的合理推演"，推演内容不超过该节30%
- 违反此铁律即为失职

---

## 技能概述

针对特定国防/安全/技术项目，系统采集多源公开信息，按固定大纲生成结构化项目报告。

**触发条件：** 用户要求撰写项目采集报告、项目深度分析、项目调研报告、项目评估报告。

---

## 大纲结构（八章）

### 一、项目整体介绍
- （一）项目立项背景与依据
- （二）项目核心定位与研究目标
- （三）项目实施主体与协作部门
- （四）项目实施周期与阶段规划

### 二、项目核心参数与试验范围
- （一）试验对象与核心研究内容
- （二）试验覆盖场景与适用边界
- （三）核心考核指标与效能维度
- （四）项目重难点与攻关方向

### 三、项目组织与实施体系
- （一）组织架构与职责分工
- （二）试验配套资源与保障条件
- （三）试验流程与标准化规范
- （四）项目进度管控机制

### 四、试验方案与开展过程
- （一）试验总体设计方案
- （二）试验环境与场地配置
- （三）试验设备与测试体系
- （四）分阶段试验开展情况

### 五、数据采集与分析处理
- （一）核心试验数据采集维度
- （二）数据采集方法与手段
- （三）数据清洗与校验标准
- （四）数据分析与统计模型

### 六、实战效能综合评估
- （一）任务完成能力评估
- （二）战场适配与对抗效能评估
- （三）可靠性与抗干扰能力评估
- （四）综合优势与短板问题分析

### 七、项目试验结论与结果分析
- （一）项目核心试验结论
- （二）试验过程存在的问题与不足
- （三）问题成因分析与整改建议
- （四）试验方案优化改进方向

### 八、项目成果与后续应用发展
- （一）项目核心成果与技术突破
- （二）现有成果落地应用场景
- （三）后续迭代优化与深化研究计划
- （四）领域推广价值与发展趋势

---

## 采集流程

### Step 1: 项目信息检索（scrapling优先）
1. 使用scrapling fetcher采集项目官方页面（.mil/.gov）
2. 采集DARPA/IARPA/DoD等官方项目页
3. 采集主要媒体报道（Reuters/AP/BBC等优先媒体清单）
4. 采集技术执行方页面（Kitware/SEI/CMU等）
5. 采集学术论文与会议报告

### Step 2: 信息结构化提取
1. 从采集内容中提取项目背景、目标、组织、周期等基础信息
2. 提取技术参数、试验方案、性能指标等技术信息
3. 提取参与方、合同金额、采办信息等管理信息
4. 提取评估结论、问题不足、后续计划等结果信息

### Step 3: 大纲填充
1. 按八章大纲逐节填充
2. 无内容的章节直接**删除**，不保留
3. 有内容的每个论断须标注信息来源
4. 优先使用官方源，其次权威媒体，最后分析推断

### Step 4: 报告生成
1. 生成docx公文格式报告（标题统一为"XXX项目"，不加后缀）
2. 生成md格式存档版本
3. 附参考文献清单（至少13条可验证URL）

---

## 数据真实性核查规范（红线）

### 核心原则：只写有源数据，不编造、不推演、不填充

1. **严禁编造执行方/承包商名称**：除非在官方页面、USAspending、SAM.gov或权威媒体中明确提及，否则不得列出具体公司名。无法确认时写"根据公开信息暂未获取相关内容"。

2. **严禁编造用户方/作战司令部**：除非在官方文档中明确提及，否则不得假定INDOPACOM、EUCOM等具体司令部参与。无法确认时写"根据公开信息暂未获取相关内容"。

3. **严禁编造具体年份/日期**：项目启动年份、结项年份、阶段时间节点必须来自官方源。如果官方页面只写"complete"而无具体年份，不得自行推断年份。

4. **严禁扭曲试验结论**：论文中假设被否定或部分否定时，必须如实反映。不得将"与假设相反"的结果改写为"验证了假设"。

5. **合理推演必须标注**：基于公开信息的逻辑推演（非直接来源的内容），必须用"以下为基于XX的合理推演，非XX直接表述"明确标注。推演内容不得超过该节总内容的30%。

6. **无数据章节直接删除**：无内容的章节直接删除，不保留空章节，保持报告紧凑。

7. **报告生成后必须回溯核查**：生成报告后，逐条对照采集源文件验证关键论断，发现无法验证的内容立即修正。

### 核查清单（报告生成后必做）
- [ ] 所有执行方/承包商名称在采集源文件中有对应原文
- [ ] 所有年份/日期在采集源文件中有对应原文
- [ ] 所有试验结论/数据指标在采集源文件中有对应原文
- [ ] 合理推演内容已明确标注
- [ ] 无数据章节已标注"暂未获取"而非填充推演

---

## 报告标题规范

- 文档标题和正文标题统一使用 **"XXX项目"** 格式
- 不添加"采集分析报告"等后缀
- 示例：`美国DARPA"基础真相"(Ground Truth)社会仿真试验项目`（而非`...项目采集分析报告`）

## 公文格式要求

- **格式：** .docx
- **排版：** A4公文格式（上37mm/下35mm/左28mm/右26mm）
- **字体：** 小标宋标题 + 黑体章标题 + 楷体节标题 + 仿宋正文
- **字号：** 正文三号（16磅），参考文献小四号（14磅）
- **行距：** 固定值28磅
- **首行缩进：** 两字符

---

## 优先信源清单

### 第一优先级（官方源）
- DARPA.mil, IARPA.gov, DoD.mil, AF.mil, Navy.mil, Army.mil
- NATO.int, CCDCOE.org, STO.NATO.int
- SAM.gov, USAspending.gov, GovTribe.com

### 第二优先级（权威媒体）
- Reuters, AP, BBC, Bloomberg, NYT, WSJ, WaPo, CNN, CNBC
- The Guardian, Le Monde, NHK, SCMP, FT

### 第三优先级（技术/行业源）
- Kitware.com, SEI.CMU.edu, NIST.gov
- BiometricUpdate.com, DefenseScoop.com, BreakingDefense.com
- AI/ML学术会议(NeurIPS/CVPR/ICCV等)

### 禁止信源

---

## 质量检查清单

- [ ] 每章内容有至少1个可溯源信息来源
- [ ] 所有URL可验证（200 OK）
- [ ] 参考文献不少于13条
- [ ] 无数据章节已直接删除（不保留空章节）
- [ ] 涉台表述符合规范
- [ ] **执行方/承包商名称在采集源文件中有对应原文**
- [ ] **年份/日期在采集源文件中有对应原文**
- [ ] **试验结论/数据指标在采集源文件中有对应原文**
- [ ] **合理推演内容已明确标注，占比不超过30%**
- [ ] **无数据章节已直接删除（不保留空章节）**

---

## 技能依赖

- scrapling: 网页采集（优先）
- web_fetch: 备用网页采集
- python-docx: docx报告生成
- /root/miniconda3/envs/data-collector/bin/python: Python环境

---

**瞰宇 | 穿越数字国界，瞭望全球局势 · 解构认知域，守护认知安全**
