xhs-batch
批量提取小红书帖子,整理为本地 Markdown 知识库
它会碰到什么
扫了多少1 个文本文件,1 KB
它会碰到什么不碰外部(只输出文字)
命中总数0 处
命中统计严重 0 · 高 0 · 中 0 · 低 0
这一栏是扫描器报的事实,不是结论。命中多不等于有毒(安全工具、规则库、示例脚本本来就会包含危险写法),命中少也不等于干净。它和你手上的凭据、文件、网络有什么关系,需要你自己看。
技能内容
用户希望批量提取多个小红书帖子。请按以下步骤处理:
常量定义
- Cookies 文件:
~/cookies.json - Obsidian 保存目录:
~/Documents/Obsidian Vault/xhs - Whisper 模型:
mlx-community/whisper-large-v3-turbo
输入
用户提供的链接列表: $ARGUMENTS
流程
步骤 1:解析链接
从输入中提取所有小红书链接(支持多行、空格分隔、逗号分隔)。
每个链接提取帖子 ID 和 xsec_token。
步骤 2:检查 Cookies
检查 ~/cookies.json 是否存在。如不存在,按 /xhs 的步骤 0 引导用户导出。
步骤 3:逐个提取
对每个链接,执行 /xhs 的完整提取流程(步骤 2-4):
- 请求页面 → 解析 __INITIAL_STATE__
- 视频帖子做语音转录
- 按 Peter Thiel 风格整理
- 保存为
{YYYY-MM-DD} {短标题}.md
每个帖子之间间隔 3 秒,避免触发反爬。
步骤 4:汇总报告
全部完成后,输出简短汇总:
- 成功/失败数量
- 每个帖子的文件名和一句话摘要
想直接用这个技能?
本站把开放许可(MIT / Apache 等)的技能按仓库打包整理到网盘,点一下转存到你自己的网盘,不用一个个从 GitHub 拉。许可未声明的技能只给原始仓库链接,不打包。