#!/bin/bash
# 正义使命舆情简报 - 每小时采集脚本
# 添加到 crontab: 0 * * * * /home/admin/.openclaw/workspace/skills/justice-mission-briefing/scripts/hourly_collect.sh

set -e

LOG_FILE="/home/admin/.openclaw/workspace/reports/justice-mission/cron.log"
HOURLY_DIR="/home/admin/.openclaw/workspace/reports/justice-mission/hourly"
SEARXNG_DIR="/home/admin/.openclaw/workspace/skills/searxng"

# 创建目录
mkdir -p "$HOURLY_DIR"

log() {
    echo "[$(date '+%Y-%m-%d %H:%M:%S')] $1" | tee -a "$LOG_FILE"
}

log "==========  hourly 采集启动 =========="

# 当前小时标识
HOUR=$(date +%Y%m%d_%H00)
OUTPUT_FILE="${HOURLY_DIR}/${HOUR}.json"

# 搜索关键词（根据最新舆情调整）
QUERIES=(
    "美以伊冲突 最新消息"
    "伊朗 霍尔木兹 海峡"
    "特朗普 伊朗 军事行动"
    "以色列 空袭 伊朗"
    "中东 油价 2026"
    "台湾 美以伊 反应"
)

log "开始采集 ${HOUR} 时段数据..."

# 初始化 JSON
echo '{"timestamp":"'$(date -Iseconds)'","queries":[' > "$OUTPUT_FILE"

# 采集每个关键词
FIRST=true
for query in "${QUERIES[@]}"; do
    if [ "$FIRST" = true ]; then
        FIRST=false
    else
        echo "," >> "$OUTPUT_FILE"
    fi
    
    # 使用 searxng 搜索
    RESULT=$(cd "$SEARXNG_DIR" && uv run scripts/searxng.py search "$query" -n 5 --format json 2>/dev/null || echo '{"results":[]}')
    
    # 提取关键信息（简化处理）
    echo -n "{\"query\":\"$query\",\"data\":$RESULT}" >> "$OUTPUT_FILE"
    
    log "采集完成：$query"
done

# 关闭 JSON
echo ']}' >> "$OUTPUT_FILE"

log "采集完成，保存至：$OUTPUT_FILE"
log "========== hourly 采集完成 =========="
