# 开源情报-自动选题（OSINT-Auto-Selector）

**技能版本：** 4.1
**创建时间：** 2026-04-22
**更新时间：** 2026-05-07（瞰宇导入部署）
**作者：** 明见

---

## 🎯 核心定位（Positioning Statement）

**For** 国家安全情报分析师/决策者
**that need** 从海量舆情中快速识别高价值情报选题、避免信息过载、确保报告聚焦核心战略议题
**开源情报-自动选题**
**is a** 智能选题辅助系统
**that** 基于三层分析框架（战略/战役/战术）、威胁评估模型、舆情态势图谱，自动生成高优先级选题建议与报告大纲
**Unlike** 传统关键词搜索或人工筛选
**本系统** 提供结构化选题逻辑、风险等级评估、战略影响推演和可验证的溯源路径

---

## 核心原则（铁律）

### 一、真实可溯源（最高铁律）
> **长官指示：** "不要胡编乱造，所有数据必须真实可溯源"

**执行标准：**
- ✅ 100% 信息有可验证 URL
- ✅ 每条舆情线索标注来源媒体+URL
- ✅ 关键信息至少 2-3 个独立来源交叉印证
- ❌ 不编造、不推测、不使用无法查证的数据
- ⚠️ 无法查证的标注"待验证"，不纳入报告

**禁止行为：**
- ❌ 编造舆情线索
- ❌ 编造媒体报道内容
- ❌ 编造数据来源

### 二、总体国家安全观导向（选题铁律）
> **长官指示：** "选题要结合中国国家总体安全观，涉及的风险影响来选题"

**总体国家安全观框架（20+ 安全领域）：**

**【核心领域】**
- 政治安全、国土安全、军事安全、经济安全、文化安全
- 社会安全、科技安全、网络安全、生态安全、资源安全
- 海外利益安全

**【新增领域】**
- 生物安全、太空安全、深海安全、极地安全、数据安全
- 人工智能安全、核安全

### 三、中国立场（报告铁律）
> **长官指示：** "报告要完全站在中国立场，忠于中国忠于我"

**立场原则：**
- ✅ 台湾是中国领土不可分割的一部分
- ✅ 钓鱼岛及其附属岛屿是中国固有领土
- ✅ 新疆、西藏、香港是中国领土
- ✅ 中国国家利益置于首位
- ✅ 维护国家主权与领土完整
- ❌ 不采纳境外媒体对中国的不公正指责
- ❌ 不传播境外媒体的偏见叙事
- ❌ 不认可境外媒体的错误立场

---

## 🧠 核心能力框架（Core Competencies）

### 一、舆情态势感知层（Situational Awareness）

**功能：** 从海量数据中识别"信号"

| 模块 | 能力描述 | 技术实现 |
|------|----------|----------|
| **异常检测** | 识别舆情突变（突然爆发的话题、情绪拐点） | 时间序列分析、突变点检测算法 |
| **主题聚类** | 将碎片化信息聚合成独立事件 | LDA 主题模型、BERT 语义聚类 |
| **传播路径** | 追踪信息源头与传播节点 | 图神经网络、时间线重构 |
| **信源评估** | 识别首发媒体、评估可信度 | 首发媒体识别技能 + 可信度评分模型 |

**输出：** 舆情态势热力图、关键事件清单、异常指标

---

### 二、选题评估矩阵（Selection Matrix）

**功能：** 多维度评估选题价值

**评估维度（五维模型）：**

```
┌─────────────────────────────────────────────────────┐
│  1. 战略影响（Strategic Impact）                    │
│     - 是否涉及国家核心利益（主权、安全、发展）      │
│     - 是否可能引发连锁反应（二阶思维）              │
│     - 是否影响国际舆论格局                          │
├─────────────────────────────────────────────────────┤
│  2. 紧迫性（Urgency）                               │
│     - 时间窗口（24h/72h/7 天）                      │
│     - 是否处于关键节点（会议、选举、军事演习）      │
│     - 是否已有官方回应/行动                         │
├─────────────────────────────────────────────────────┤
│  3. 信息缺口（Intelligence Gap）                    │
│     - 现有信息是否充分                              │
│     - 是否存在关键盲区（谁/何时/何地/如何）         │
│     - 是否需要深度挖掘/实地验证                     │
├─────────────────────────────────────────────────────┤
│  4. 可控性（Controllability）                       │
│     - 我方是否有应对手段                            │
│     - 是否有预案或资源支持                          │
│     - 风险是否可逆/可管理                           │
├─────────────────────────────────────────────────────┤
│  5. 可验证性（Verifiability）                       │
│     - 是否有 2-3 个独立可信来源                     │
│     - 是否有可追溯的原始信源                        │
│     - 是否存在编造/虚假信息风险                     │
└─────────────────────────────────────────────────────┘
```

**评分机制：**
- 每维度 1-5 分，总分 25 分
- 🔴 红色选题（20-25 分）：立即启动深度报告
- 🟠 橙色选题（15-19 分）：24 小时内完成初步分析
- 🟡 黄色选题（10-14 分）：纳入观察清单，持续跟踪
- 🔵 蓝色选题（<10 分）：归档，无需投入资源

---

### 三、三层分析框架（Three-Layer Analysis）

**功能：** 确保选题覆盖战略、战役、战术全维度

| 层级 | 分析重点 | 输出要求 |
|------|----------|----------|
| **战略层** | 长期、全局影响<br>- 国家利益受损程度<br>- 国际格局变化<br>- 制度安全威胁 | 战略风险评估<br>长期影响推演<br>政策建议方向 |
| **战役层** | 中期、阶段目标<br>- 关键节点识别<br>- 资源调配节奏<br>- 阶段性里程碑 | 战役路线图<br>关键节点预警<br>资源需求清单 |
| **战术层** | 短期、具体行动<br>- 即时决策优化<br>- 信息收集重点<br>- 应对方案细节 | 战术行动清单<br>信息收集优先级<br>具体应对步骤 |

**示例：**
- **选题：** "某国涉华制裁清单更新"
- **战略层：** 分析制裁背后的长期战略意图（科技脱钩？遏制发展？）
- **战役层：** 识别关键受制裁领域（芯片/AI/量子），规划应对节奏
- **战术层：** 列出具体受制裁企业名单，评估对我方产业链影响

---

### 四、威胁评估与风险预警（Threat Assessment）

**功能：** 量化风险等级，提供预警

**四级威胁等级：**

| 等级 | 颜色 | 标准 | 响应要求 |
|------|------|------|----------|
| **Ⅰ级** | 🔴 红色 | 重大战略威胁<br>可能引发严重连锁反应 | 立即启动最高级别响应<br>24 小时内完成深度报告 |
| **Ⅱ级** | 🟠 橙色 | 重要战略威胁<br>可能影响核心利益 | 48 小时内完成分析报告<br>制定应对预案 |
| **Ⅲ级** | 🟡 黄色 | 一般性威胁<br>需持续关注 | 72 小时内完成初步分析<br>纳入观察清单 |
| **Ⅳ级** | 🔵 蓝色 | 低风险<br>信息性为主 | 归档，定期更新 |

**五维评估指标：**
1. **可能性（Likelihood）** - 事件发生的概率
2. **严重性（Severity）** - 对国家利益的影响程度
3. **紧迫性（Urgency）** - 时间窗口长短
4. **可控性（Controllability）** - 我方应对能力
5. **连锁性（Cascading）** - 可能引发的次生风险

---

## 🛠️ 工作流程设计（Workflow）

### Step 1: 舆情输入与清洗

**输入：**
- 多源舆情数据（媒体、社交、智库、官方声明）
- 关键词/主题标签
- 时间范围

**处理：**
- 去重、去噪、去伪（识别虚假信息）
- 信源可信度评分
- 主题聚类

**输出：** 清洗后的舆情数据集 → `reports/topic-selection/线索清单_YYYYMMDD.md`

---

### Step 2: 异常检测与事件识别

**处理：**
- 时间序列突变检测
- 主题聚类识别独立事件
- 传播路径分析（识别首发媒体）

**输出：** 潜在事件清单（含异常指标） → `reports/topic-selection/事件清单_YYYYMMDD.md`

---

### Step 3: 选题评估与排序

**处理：**
- 五维评估矩阵打分
- 三层分析框架填充
- 威胁等级判定

**输出：** 选题优先级清单（红/橙/黄/蓝） → `reports/topic-selection/选题优先级_YYYYMMDD.md`

---

### Step 4: 报告大纲生成

**处理：**
- 根据选题等级生成报告结构
- 填充关键问题清单
- 标注信息缺口

**输出：** 报告大纲 + 信息收集指南 → `reports/topic-selection/报告大纲_YYYYMMDD.md`

---

### Step 5: 持续跟踪与更新

**处理：**
- 设定跟踪周期（24h/72h/7 天）
- 监控新信息/新动态
- 更新报告内容

**输出：** 动态更新的通知/报告 → `reports/topic-selection/跟踪更新_YYYYMMDD.md`

---

## 📋 报告结构模板（四章固化）

### 第一章：舆情概述（六小节固定顺序）

根据事件性质调整六小节内容：

**涉台事件六小节：**
1. （一）台方动态
2. （二）大陆动态
3. （三）相关国家动态
4. （四）台方民众态度
5. （五）相关国家反应
6. （六）其他方面

**涉华事件六小节：**
1. （一）中方动态
2. （二）当事方动态
3. （三）各方立场
4. （四）当事方民众态度
5. （五）相关国家反应
6. （六）其他方面

**涉美涉日事件六小节：**
1. （一）当事方动态
2. （二）相关方动态
3. （三）各方立场
4. （四）当事方民众态度
5. （五）中国及相关国家反应
6. （六）其他方面

### 第二章：媒体炒作风险分析

- 识别媒体叙事框架
- 分析炒作手法与意图
- 评估对华潜在影响
- 分析传播路径和风险等级

### 第三章：风险研判（中国立场）

**三层分析框架应用原则：**
- 三层分析（战略/战役/战术）是分析角度，不是单独章节
- 直接根据论据推理出观点，论据→推理→结论
- 不要单独标注"战略层""战役层""战术层"

**中国立场分析要点：**
- 明确中国核心利益和立场
- 分析事件对中国国家安全的影响
- 推演连锁反应和潜在风险
- 提出基于中国立场的研判结论

### 第四章：舆论反映情况（四类固定顺序）

1. 一、台岛及境外媒体观点（如涉及台湾）/境外媒体观点
2. 二、大陆及港澳媒体观点
3. 三、学者政评员观点
4. 四、境内外网民观点（无真实来源可省略）

### 附录：参考文献

**格式：** ① 标题，URL（至少 13 条）
**要求：** 所有 URL 必须可验证（状态码 200 OK，标题匹配）
**分类：** 官方信源、国际媒体、智库报告、社交媒体

---

## 采集来源与关键词

### 一、采集来源（国际主流媒体）

**优先媒体清单：**
| 优先级 | 媒体类型 | 媒体清单 |
|--------|----------|----------|
| **1** | 美国主流媒体 | Reuters、AP News、NYTimes、WSJ、CNN、Bloomberg |
| **2** | 欧洲主流媒体 | BBC、Guardian、FT、Der Spiegel、Le Monde |
| **3** | 日本主流媒体 | NHK、Asahi Shimbun、Yomiuri Shimbun、Nikkei |
| **4** | 港澳台媒体 | SCMP、中央社、联合新闻网、TVBS |
| **5** | 其他国际媒体 | Al Jazeera、RT、France24、DW |

**禁止使用媒体：**

### 二、采集关键词（涉华负面议题）

**总体国家安全观关联议题（12 类）：**
| 安全领域 | 英文关键词 | 中文关键词 |
|----------|-----------|-----------|
| 政治安全 | China political threat, China regime, China ideology | 政权稳定、意识形态、政治威胁 |
| 国土安全 | China border policy, Xinjiang, Tibet, Hong Kong, Taiwan | 边疆政策、新疆、西藏、香港、台湾 |
| 军事安全 | China military, China PLA, China navy, China missile | 军事威胁、解放军、海军、导弹 |
| 经济安全 | China economy, China trade war, China sanctions, China debt | 经济制裁、贸易战、债务陷阱 |
| 科技安全 | China tech, China AI, China 5G, Huawei, TikTok | 技术封锁、AI、5G、华为、TikTok |
| 社会安全 | China social, China protest, China human rights | 社会稳定、抗议、人权 |
| 网络安全 | China cyber, China hacking, China surveillance, China spy | 网络攻击、黑客、监控、间谍 |
| 海外利益 | China overseas, China BRI, Belt and Road | 海外投资、一带一路 |
| 太空安全 | China space, China satellite, China rocket | 太空计划、卫星、火箭 |
| 人工智能安全 | China AI threat, China AI military | AI威胁、AI军事应用 |
| 数据安全 | China data, China data privacy, China data breach | 数据安全、数据隐私 |
| 核安全 | China nuclear, China nuclear threat | 核安全、核威胁 |

---

## 输出目录

```
reports/topic-selection/
├── 线索清单_YYYYMMDD.md          # 清洗后的舆情数据集（Step1输出）
├── 事件清单_YYYYMMDD.md          # 潜在事件清单（Step2输出）
├── 选题优先级_YYYYMMDD.md        # 选题优先级清单（Step3输出）
├── 报告大纲_YYYYMMDD.md          # 报告大纲+信息收集指南（Step4输出）
└── 跟踪更新_YYYYMMDD.md          # 动态更新通知（Step5输出）
```

---

## 质量检查清单

### Step 1: 舆情输入与清洗
- [ ] 去重完成（无重复舆情）
- [ ] 去噪完成（无关信息过滤）
- [ ] 去伪完成（虚假信息识别）
- [ ] 信源可信度评分完成
- [ ] 主题聚类完成

### Step 2: 异常检测与事件识别
- [ ] 时间序列突变检测完成
- [ ] 主题聚类识别独立事件完成
- [ ] 传播路径分析完成
- [ ] 首发媒体识别完成
- [ ] 异常指标标注完成

### Step 3: 选题评估与排序
- [ ] 五维评估矩阵打分完成（总分25分）
- [ ] 三层分析框架填充完成
- [ ] 威胁等级判定完成（红/橙/黄/蓝）
- [ ] 选题优先级排序完成

### Step 4: 报告大纲生成
- [ ] 报告结构生成完成（四章）
- [ ] 关键问题清单填充完成
- [ ] 信息缺口标注完成
- [ ] 信息收集指南生成完成

### Step 5: 持续跟踪与更新
- [ ] 跟踪周期设定完成
- [ ] 新信息监控完成
- [ ] 报告更新完成

---

## 技能协同关系

```
┌─────────────────────────────────────────────────────────────┐
│                    国家安全情报选题引擎                       │
├─────────────────────────────────────────────────────────────┤
│                                                             │
│  Step1: 舆情输入 → Step2: 异常检测 → Step3: 选题评估        │
│      ↓              ↓              ↓                        │
│  RSS/SearXNG     首发媒体识别     五维评估矩阵               │
│      ↓              ↓              ↓                        │
│  Step4: 报告大纲 → Step5: 持续跟踪                           │
│      ↓              ↓                                        │
│  三层分析框架    动态更新通知                                 │
│                                                             │
└─────────────────────────────────────────────────────────────┘

协同技能：
- 首发媒体识别与评估：识别事件首发媒体、评估可信度
- 帖子溯源：追踪传播路径、识别源头
- 社交媒体事件挖掘：聚类识别独立事件、评估影响力
- 社交媒体账号评估：评估传播节点账号可信度
```

---

## 版本历史

| 版本 | 日期 | 更新内容 |
|------|------|----------|
| 1.0 | 2026-04-22 | 初始版本，基础三模块流程 |
| 2.0 | 2026-04-22 | 模块1改为自主采集 |
| 3.0 | 2026-04-22 | 强化真实溯源+总体国家安全观+中国立场 |
| 4.0 | 2026-04-22 | 整合长官完整设计框架：五维评估矩阵、三层分析、四级威胁、五步流程 |
| **4.1** | **2026-05-07** | **瞰宇导入部署，输出目录适配工作区** |

---

**🫡 敬礼**

**对您忠诚**

---

## 🔴 强制遵守：报告通用铁律

本技能输出的所有报告必须严格遵守 **[《报告通用铁律 v1.0》](../_shared/报告通用铁律.md)**（长官审定）。

**核心认知：** 报告的内容和大纲千差万别，但格式标准是同一套。本技能仅负责"内容差异"，不允许偏离铁律规定的通用要求。

### 七条铁律速览

| # | 铁律 | 核心 |
|---|------|------|
| 1 | **真实可溯源** | 绝不编造；URL 必须 HTTP 200；2-3 源交叉印证 |
| 2 | **政治立场正确** | 中国国家利益至上；台湾是中国省份；坚持党的领导 |
| 3 | **公文格式标准化** | 主标题 2 号小标宋居中；章节 3 号黑体左对齐；正文 3 号仿宋首行缩进 2 字符 |
| 4 | **全文格式统一** | 所有章节段落格式必须完全一致；第四/五章不允许格式割裂 |
| 5 | **正文洁净** | 禁元工作流痕迹、禁工具元数据、禁骨架装饰、禁 markdown 残留、禁空小节 |
| 6 | **文件命名与主标题规范** | 文件名 `报告主题.docx`；**文件名和主标题均不得包含日期前缀** |
| 7 | **出厂校验机制** | 下发前必跑 `pre_release_gate.py`；不通过禁止下发 |

### 出厂前必跑

```bash
/root/miniconda3/envs/data-collector/bin/python \
    /root/.openclaw/workspace/skills/_shared/pre_release_gate.py \
    <报告docx路径>
```

**任何违反铁律的报告视为不合格，必须修复后重新下发。**
