Communitygithub.com

xboyzc/short-video-account-analysis

当用户提供自媒体账号链接并要求‘账号分析’、账号内容盘点或完整账号诊断时,采集最近50条作品,统计主题占比与平均点赞,转写点赞前5条,并基于证据分析人设、受众、产品及卖点,保存到本地桌面。

short-video-account-analysis란 무엇인가요?

short-video-account-analysis is a Claude Code agent skill that 当用户提供自媒体账号链接并要求‘账号分析’、账号内容盘点或完整账号诊断时,采集最近50条作品,统计主题占比与平均点赞,转写点赞前5条,并基于证据分析人设、受众、产品及卖点,保存到本地桌面。.

지원 대상~Claude Code~Codex CLI~Cursor
npx skills add xboyzc/short-video-account-analysis

즐겨 사용하는 AI에게 물어보기

이 에이전트 스킬이 미리 로드된 새 채팅을 엽니다.

문서

短视频账号分析

将账号分析一次完成为四组本地文件,覆盖六项任务。默认样本为按实际发布时间倒序的最近 50 条作品,默认语言为中文;用户明确指定数量、范围或输出位置时以用户为准。

交付约定

在桌面新建 账号分析/<账号昵称>_<采集日期时间>/,避免覆盖历史结果。

  1. 01_作品数据与排名/:50 条原始标题、发布文案、发布时间、点赞、链接、作者及主题;点赞排序;Top 5 清单。提供 Markdown 和 CSV。
  2. 02_主题分析.md:主题定义、条数、占比、平均点赞及有效点赞样本数;有必要时增加中位数和极端值影响。
  3. 03_Top5逐字稿/:五篇独立 Markdown,文件名用原标题,正文包含原标题、原链接、发布时间、点赞数和采集时间、作者、转写来源及状态,随后附逐字稿。
  4. 04_人设受众产品卖点分析.md:账号简介、个人 IP 人设、目标受众、产品和产品卖点;每项附证据、推断边界与信息缺口。

另存 source/ 原始证据和机器可读状态,以便断点续做。它们是上述四组的依据,不是额外分析任务。详细数据结构和文档格式见 references/data-contract.md。

主窗口与 Luna 分工

  • 主窗口管理采集范围、任务队列、证据、异常和最终审核。用户偏好 Astra 做监管;只在环境实际支持切换时操作,不能声称已切换当前模型。
  • 普通页面采集、文案录入、主题初分和整理:gpt-6-luna,xhigh。
  • 嘈杂音频、多人重叠、术语密集、字幕与音频冲突、遗漏或数字专名校对:gpt-6-luna,max。
  • 分派时设置工具的实际模型参数:子智能体用 model 与 reasoning_effort,独立聊天用 model 与 thinking;只把模型名写在提示词里不等于完成配置。若工具限制全历史分叉的模型覆盖,使用允许覆盖的上下文模式并显式传入必要材料。
  • 优先使用子智能体,每篇 Top 5 由独立任务负责,按实际可用槽位排队;每个任务使用独立目录。用户明确要求独立聊天时才使用创建聊天工具,并遵循该工具的授权规则。
  • 指定模型不可用时立即说明;不要静默换成别的模型或编造设置成功。
  • Luna 负责提取、整理和校对;音频识别由 ASR 引擎完成。提升推理档位不会解决下载失败或 ASR 服务单队列限制。

执行

1. 建立证据与样本

阅读 references/workflow.md 的采集和分类部分。解析分享链接到真实账号,确认昵称、主页链接、简介及采集时间。优先复用本次可核验的采集材料;旧的 100 条数据需要重新按日期选出最近 50 条,旧 Top 5 不能沿用。

使用当前可用的官方接口、连接器或浏览器能力。用户指定 ego 等浏览器时先确认工具能连接;只能使用页面可见或接口合法返回的数据。遇到登录、验证码、不可访问或样本不完整,及时说明具体缺口,继续不受影响的部分。

作品 ID 去重,保留置顶作品并按实际发布日期参与排序。标题与发布文案分字段;都不等于口播逐字稿。发布日期、精确点赞、标题、简介获取不到时保留空值,不编造。

2. 分类、统计、排名

阅读 references/data-contract.md,规范化数据并为每条作品分配一个主主题。根据账号内容建立分类,不预设固定类别数;低证据条目可标为待分类。先确定最近 50 条集合,再在该集合内排名。

用本技能的确定性脚本生成统计与清单:

python3 /path/to/account-analysis/scripts/analyze_posts.py \
  --input /path/to/collected_posts.json \
  --output-dir /path/to/run --limit 50

将示例路径替换为实际绝对路径。检查 analysis_status.json 后分发 01_作品数据与排名/top5.json。未知点赞不能当作 0;缩写点赞只能标记为近似值,可能影响排名时 Top 5 标为暂定。不要靠心算产生统计结果。

3. Top 5 转写

阅读 references/transcription.md。优先获得可用字幕;需要口播逐字稿时对照音频,已有字幕不保证覆盖全部口播。无可用字幕则获取音频并执行 ASR。OCR 用于补画面信息或处理缺乏音频的片段。

如果 Top 5 含文章或图文,分别保存原文或按页整理画面文字,注明作品类型和来源;没有口播就如实说明。它们仍保留原排名,不为了凑五个视频替换作品。

抖音可使用本机 douyin-video 技能;先读它的说明。将媒体获取、ASR、Luna 校对分开记时。本技能的 scripts/transcribe_local.py 提供本地服务识别、串行队列、准确 job ID 跟踪、错误记录和断点缓存;它不会把单队列服务变成并发服务。

一个采集者操作共享浏览器,一个提交者管理共享 ASR 队列;可并行执行已拿到文本的不同视频校对和分析。不要开多个窗口争抢同一标签页或重复提交同一视频。

每篇独立输出,保留原话、口头重复和不确定处。ASR 完成不代表逐字稿已校对。获取失败的 Top 5 保留原位置和状态,不能悄悄换成第 6 名。正文无法覆盖全片时明确写“部分逐字稿”,不得宣称完整。

4. 账号分析与总审

阅读 references/workflow.md 的证据与报告部分。综合主页、50 条标题及文案、Top 5 逐字稿和可访问的产品页面,完成四个分析章节。产品或实际用户数据不足时,保留章节并列出未知项及缺少的证据。

主窗口检查:

  • 最近 50 条的时间范围、置顶去重、采集覆盖状态和点赞采集时间是否明确。
  • 主主题条数合计是否等于样本量,占比是否以全部样本为分母;未知点赞是否从均值中剔除并披露。
  • Top 5 与排名一致;五份文件均有原标题和五项元数据,原链接与作品 ID 对应;转写状态与覆盖证据匹配。
  • 人设自述、可观察事实、分析推断、未知信息是否分清;没有从内容偏好猜测真实年龄收入、产品销量或转化率。
  • 四组交付是否齐全,所有缺口是否在发现时告知,并最终集中列出。

最后给出桌面目录和关键文件链接,简要总结主题数量、Top 5 转写完成情况及分析限制。部分失败时交付已完成结果和可继续的具体入口,不将整个任务标为完成。

관련 스킬