---
name: 开源情报-军事人物目标采集
description: |
  开源情报人物深度采集技能。对目标人物进行系统化多源公开信息采集，生成标准化深度人物画像报告（Word/Markdown）。
  触发条件：
  - 用户要求采集/调查/分析某个人的信息（军事人物、政府官员、企业高管、学者等）
  - 用户要求生成人物画像/人物档案/背景调查报告
  - 用户提到OSINT人物采集、人物溯源、账号关联分析
  - 用户给出姓名+背景线索要求深度挖掘
  - 用户要求对某军事/政商人物进行六维度分析
---

# 开源情报人物深度采集

## 工作流程

### 阶段一：目标识别与扩展

1. **接收目标**：获取目标人物姓名、已知背景线索（国籍、职业、机构等）
2. **姓名变体生成**：
   - 汉字变体：简体→繁体→异体字（如 渡辺/渡邉/渡邊）
   - 罗马字变体：姓+名排列组合（如 watanabe taishiro / taishiro watanabe）
   - 常见缩写/昵称
3. **Maigret账号扫描**：对每个变体执行 `maigret <username> --html --csv --json ndjson`
4. **搜索引擎多语言检索**：DuckDuckGo + Google（如被反爬则用Scrapling突破），使用目标语言+英语组合查询

### 阶段二：六维度深度采集

按以下六个维度系统性采集，每个维度至少使用2个独立信息源交叉验证：

#### 维度一：基本情况
- 姓名、性别、军衔/职级、出生地、出生年月日
- 晋升现军衔/职级时间、任现职务时间
- 关联事件清单
- 教育经历（早→晚，不少于2条）
- 任职经历：海上/军事任职、陆上/行政任职、其他任职
- 个人荣誉
- 家庭情况（妻子、子女、父母、兄弟姐妹等）
- 人际关系评估（同期、上级、同僚、社交网络）
- 兴趣爱好

#### 维度二：政策倾向
- 对华立场主张及坚持的政策
- 公开发言/文章/社交媒体言论分析
- 所属机构/派系的政策倾向背景

#### 维度三：性格特点
- 基于公开行为、发言、社交痕迹的性格画像
- 需附具体证据

#### 维度四：能力特点
- 人物能力需辅证具体事例
- 重点关注：专业能力、领导能力、技术能力、外交能力

#### 维度五：指挥管理风格
- 战备训练风格
- 带兵管理风格
- 操舰/指挥技战术表现
- 均需辅证具体事例

#### 维度六：近年周边活动
- 近年带队在目标区域（如我周边海域）的活动情况
- 训练、演习、巡航记录
- 公开航迹/部署信息

### 阶段三：信息源策略

#### 优先级1（政府公文级）
- 防衛省/国防部人事发令公告
- 官方引渡式/就役式PDF
- 政府公开资料库

#### 优先级2（新闻级）
- J-Defense News、NHK、共同社、路透社等
- 防务专业媒体（《世界の艦船》《丸》等）
- 地方新闻（目标人物驻地媒体）

#### 优先级3（社交/自述级）
- Facebook公开档案
- Instagram/Twitter公开帖文
- YouTube频道内容
- 博客/个人网站

#### 优先级4（交叉验证源）
- Wikipedia（需与源1-3交叉验证）
- 军事爱好者博客/论坛
- AIS/船舶追踪数据

### 阶段四：报告生成

#### Word报告排版规范

| 元素 | 字体 | 字号 |
|------|------|------|
| 大标题 | 方正小标宋简体 | 二号（22pt） |
| 一级标题 | 黑体 | 三号（16pt） |
| 二级标题 | 楷体_GB2312 | 三号（16pt） |
| 正文 | 仿宋_GB2312 | 三号（16pt） |

**页面参数**：上3.7cm、下2.8cm、左2.8cm、右2.6cm、A4纸

**照片排版**：6cm×4.5cm、四周环绕型、居右

**实现方式**：使用python-docx生成Word文档，字体名直接写入（目标机器渲染时调用本机字体）

#### 报告结构

```
标题：[姓名]深度人物画像
一、基本情况
  1. 基本信息表
  2. 教育经历
  3. 任职经历（海上/陆上/其他）
  4. 个人荣誉
  5. 家庭情况
  6. 人际关系评估及社交情况
  7. 兴趣爱好
二、政策倾向
三、性格特点
四、能力特点
五、指挥管理风格
六、近年带队位我周边活动情况
数据护照（合规性、采集范围、数据质量、信息空白、建议补充）
```

#### 数据护照

每份报告末尾必须附带数据护照：
- **合规性**：全部信息来源声明
- **采集范围**：列出具体使用的信息源
- **数据质量**：A级（公文级）、B级（新闻级）、C级（社交/自述级）
- **信息空白**：明确标注未能采集到的维度
- **建议补充**：下一步可深挖的方向

## 工具使用

### Maigret
```bash
# 激活环境并执行
source /root/miniconda3/bin/activate && conda activate data-collector
maigret <USERNAME> --html --csv --json ndjson

# 全站扫描
maigret <USERNAME> -a --html --pdf

# 按标签过滤
maigret <USERNAME> --tags jp,us

# 通过Tor代理
maigret <USERNAME> --tor-proxy socks5://127.0.0.1:9050
```

### 多语言搜索查询模板

```
# 日籍军事人物
"{姓名漢字}" 人事 発令 {軍種}
"{姓名漢字}" {艦名} 艦長
"{姓名変体}" 海上自衛隊
"{姓名ローマ字}" JMSDF navy

# 中籍人物
"{姓名}" 简历 任职
"{姓名拼音}" profile

# 英语系人物
"{Full Name}" military biography
"{Full Name}" appointment promotion
```

### 搜索引擎轮换策略

1. **首选**：DuckDuckGo HTML（`html.duckduckgo.com/html/`）——稳定、反爬弱
2. **次选**：Google（可能被反爬，用Scrapling突破）
3. **备选**：Bing、Yandex（针对俄语目标）

## 质量控制

- **多源验证**：重要信息至少2个独立来源交叉印证
- **事实标注**：推定信息必须标注"推定"并说明依据
- **空白声明**：未能采集的维度必须明确标注，不得编造
- **来源溯源**：每条关键信息标注具体来源URL
- **时效标注**：标注采集时间，信息可能随时间过时

## 注意事项

- 仅采集公开渠道信息，严格遵守目标地区法律法规
- 不触碰任何非公开/涉密信息
- 日籍自卫官的人事发令是高质量公开情报源（J-Defense News系统收录）
- 日文汉字变体是关键——同一个人可能在不同来源使用不同汉字写法
- 社交媒体账号需验证是否为本人，Maigret的"Claimed"状态仅表示用户名被占用

---

## 🔴 强制遵守：报告通用铁律

本技能输出的所有报告必须严格遵守 **[《报告通用铁律 v1.0》](../_shared/报告通用铁律.md)**（长官审定）。

**核心认知：** 报告的内容和大纲千差万别，但格式标准是同一套。本技能仅负责"内容差异"，不允许偏离铁律规定的通用要求。

### 七条铁律速览

| # | 铁律 | 核心 |
|---|------|------|
| 1 | **真实可溯源** | 绝不编造；URL 必须 HTTP 200；2-3 源交叉印证 |
| 2 | **政治立场正确** | 中国国家利益至上；台湾是中国省份；坚持党的领导 |
| 3 | **公文格式标准化** | 主标题 2 号小标宋居中；章节 3 号黑体左对齐；正文 3 号仿宋首行缩进 2 字符 |
| 4 | **全文格式统一** | 所有章节段落格式必须完全一致；第四/五章不允许格式割裂 |
| 5 | **正文洁净** | 禁元工作流痕迹、禁工具元数据、禁骨架装饰、禁 markdown 残留、禁空小节 |
| 6 | **文件命名与主标题规范** | 文件名 `报告主题.docx`；**文件名和主标题均不得包含日期前缀** |
| 7 | **出厂校验机制** | 下发前必跑 `pre_release_gate.py`；不通过禁止下发 |

### 出厂前必跑

```bash
/root/miniconda3/envs/data-collector/bin/python \
    /root/.openclaw/workspace/skills/_shared/pre_release_gate.py \
    <报告docx路径>
```

**任何违反铁律的报告视为不合格，必须修复后重新下发。**
