Alan-Houxj/ai-news-follow

每天自动送达的 AI 日报 Agent Skill:12 源采集 + LLM 筛选摘要,落地飞书表格/机器人推送/云文档归档

Qu'est-ce que ai-news-follow ?

ai-news-follow is a Claude Code agent skill that 每天自动送达的 AI 日报 Agent Skill:12 源采集 + LLM 筛选摘要,落地飞书表格/机器人推送/云文档归档.

Compatible avecClaude CodeCodex CLI~Cursor
npx skills add Alan-Houxj/ai-news-follow

Installed? Explore more Recherche et analyse de données skills: obra/superpowers, affaan-m/quarkus-verification, affaan-m/uspto-database · View all 6 →

Demander à votre IA préférée

Ouvre une nouvelle conversation avec cette compétence d'agent déjà préchargée.

Documentation

AI 每日资讯采集技能

什么时候用这个技能:用户提到"AI 日报 / AI 新闻 / 今天 AI 圈有什么动态 / 推送日报 / 写入飞书表格"等意图时,按本文件流程执行。

用户可能怎么说:"帮我跑一下今天的 AI 日报" / "看看今天 AI 圈有什么大事" / "把日报推到我飞书"。

抓取当日 AI 资讯,筛选摘要成日报;按配置落地到飞书三件套(多维表格 / 机器人推送 / 云文档归档)。每条信息保留原始链接,可溯源

不配置飞书也能用(L0):第 3 步会检测配置并自动跳过,日报直接输出在对话里。

工作流程(Agent 按此执行)

第 0 步:环境准备

cd <skill目录>/scripts
# 依赖自检:报 ModuleNotFoundError 时先执行 pip install feedparser requests
python -c "import feedparser, requests" 2>/dev/null || pip install feedparser requests
# 代理探测:通则启用(海外源需要),不通则直连(中文源本就强制直连,海外源失败自动容错)
curl -s -o /dev/null -m 5 -x http://127.0.0.1:7897 https://openai.com \
  && export HTTPS_PROXY=http://127.0.0.1:7897 \
  || unset HTTPS_PROXY HTTP_PROXY

lark-cli 无需手动指定:脚本会自动探测 PATH 和常见安装位置(含 Windows npm 全局目录);仅非标准安装时才需要 export LARK_CLI=<完整路径>

第 1 步:采集原始条目

python fetch_sources.py --hours 24        # 输出 items.json(每日定时跑建议 --hours 26,覆盖跨日缝隙)
  • 每个源在 sources.json 声明 network: proxy|direct:海外源走代理(环境变量 HTTPS_PROXY),中文源强制直连
  • 个别源失败(如 arXiv 偶发 502)会记入 items.jsonerrors,继续执行,不要中断

第 2 步:筛选与摘要(Agent/LLM 的职责)

读取 items.json 全部条目,然后:

  1. 去噪:剔除与 AI 无关的条目(HN/InfoQ 混入大量非 AI 内容)
  2. 去重合并:同一事件多源报道合并,保留最权威的原文链接
  3. 摘要:每条 2-3 句中文,只陈述事实
  4. 打标category(前沿动态/社区热点/中文资讯/论文速递/产品动态)、importance(高=行业级发布·融资·政策 / 中 / 低)、自由 tags
  5. 当日总评:写一段 2-3 句的 digest,概括今天的爆点与大势,放在 selection.json 顶层——它会成为日报开头

把结果写入 scripts/selection.json,格式如下(idx 引用 items.json 的数组下标;source_override 可选,用于把来源归一为表格选项名如 TechCrunch / The Verge):

{
  "digest": "2-3 句当日总评",
  "items": [
    {"idx": 0, "title": "可覆盖标题", "summary": "摘要", "importance": "高",
     "category": "前沿动态", "tags": ["标签"], "source_override": "OpenAI"}
  ]
}

然后:

python make_curated.py       # 合成 curated.json(10-30 条)

铁律url 只能取自 items.json 原文,不得改写或猜测——可溯源是本技能的核心价值。

第 3 步:飞书落地(按配置分支,必须先判断)

先检查 scripts/config.json:文件不存在、或 base_token/table_id/user_open_id/base_url 任一为空 → 判定为未配置飞书,跳过本步全部命令,直接进入"完成后报告"(日报正文输出给用户);并在报告末尾附一句:配置飞书可获得表格归档与每日推送,见仓库 docs/setup.md

已配置则执行:

python run_daily.py curated.json    # 写表格 + 卡片推送 + 云文档归档
  • 写入前自动合并标签选项池(自由标签不会失配),逐条写入
  • 推送为飞书消息卡片(分栏、标题可点击),三级降级保送达(卡片→markdown→纯文本)
  • 归档插入云文档锚点块后(callout 爆点块 + 分类分节,最新在最上);未配置归档则自动跳过
  • 重复运行会重复写入,勿重跑

完成后:向用户报告

  • 未配置飞书(L0):把 curated.json 整理成日报正文输出(总评 + 每条"标题 / 摘要 / 原文链接"),再附配置提示
  • 已配置飞书:按四项报告——今日条数、分类分布、总评一句话、失败源

若端到端失败:报告具体错误即可,不要重试超过一次。

用户配置(scripts/config.json)

复制 config.example.jsonconfig.json 填写——每项的获取方式都写在模板注释里, lark-cli 的安装与飞书应用配置步骤见仓库 docs/setup.md。全部字段支持环境变量覆盖。 本 skill 目录不含任何密钥,飞书凭据由 lark-cli 全局配置管理。

前置依赖

  1. Python 3.10+:pip install feedparser requests
  2. 飞书落地(第 3 步)需 lark-cli(官方 CLI,npx @larksuite/cli@latest install)已完成 config initauth login;lark-cli 寻址不到时用环境变量 LARK_CLI 指定其完整路径

信息源清单(sources.json,可增删)

方式网络
OpenAI 官方新闻RSS代理
Google DeepMind / Google AI 博客RSS代理
Anthropic 新闻sitemap(官方无 RSS)代理
Hugging Face 博客RSS代理
TechCrunch / The Verge AIRSS代理
MIT Tech Review AIRSS代理
Hacker News AI 热帖Algolia API(时间窗+票数+关键词词边界过滤)直连
InfoQ 中文RSS(AI 相关由第 2 步筛)直连
arXiv cs.AI / cs.CLarXiv API代理

失效处理:RSS 地址变更时先 curl 验证再更新 sources.json;机器之心/量子位的免费接口、xAI 与 Stability 的 sitemap(导航页噪音/反爬)均已不可用,不要浪费时间重试。

定时执行

技能无状态,任意调度器可调。推荐每天 08:00(Asia/Shanghai)。各宿主配置方式见 docs/scheduling.md,prompt 模板见 examples/cron-prompt.txt

Skills associés