yan-skills

agent
Security Audit
Warn
Health Warn
  • License — License: MIT
  • Description — Repository has a description
  • Active repo — Last push 0 days ago
  • Low visibility — Only 7 GitHub stars
Code Pass
  • Code scan — Scanned 12 files during light audit, no dangerous patterns found
Permissions Pass
  • Permissions — No dangerous permissions requested

No AI report is available for this listing yet.

SUMMARY

Yan's agent skills collection — Google Trends SEO workflows, AI news, autopilot, and more. For Claude Code / Codex / Cursor.

README.md

yan-skills

给做 SEO 和独立开发的人用的 Agent Skills。建站、选词、发外链、查数据、复盘迭代,一整条链路都在这个仓库里,装完就能跑。

作者 Yan,自用打磨,实测可跑。兼容 Claude Code、Codex CLI、Cursor,以及任何读 SKILL.md 的平台。MIT 协议,随便拿去用。

npx skills add yan-labs/yan-skills -g --all

这套东西解决什么问题

做独立站的人,一天里大概是这么过的:

早上想做一个新方向,先去查这个词有没有量、难不难做。工具官网一个月两百刀,买不起,于是开十几个标签页手动比对。中午定了词,开始搭站,脚手架、Cloudflare、域名、GA、GSC,一套流程走完两天,下次做站再走一遍,还是踩同样的坑。下午要发外链,翻出别人分享的「500 个免费外链网站」清单,点开前二十个,十七个打不开、两个要注册审核、一个要求你先给他挂链接。晚上打开 GSC,看到「已抓取但未编入索引」,不知道该改内容还是该再提交一次。

三个月后换个项目,上面这一整套,从头再来一遍。

这个仓库要干掉的就是「从头再来一遍」。 它把上面每一步都固化成脚本、数据文件和判定规则,让 AI Agent 直接照着执行。

两个主力 Skill,分工很清楚:

管什么 一句话
rankup 网站的全生命周期 从「这个词能不能做」到「上线三个月后该改哪一页」
backlink 外链与登录态数据 去哪发、能不能发、发完有没有真的生效

rankup — 网站全生命周期总控

版本 2.28.0。它不重复实现 Wrangler、Stripe 或趋势工具,它负责把这些能力串成一条长期可维护的工作流,并且记住你在每个项目上做过什么。

它覆盖的十一个阶段

0  恢复项目上下文,与线上真实状态对账
1  机会调研:趋势、关键词、竞争、付费空间
2  产品定义:页面、数据模型、架构、实施计划
3  初始化 Monorepo(新站走批准过的 TanStack Start 脚手架)
4  Cloudflare:SSR、API、D1、R2、环境与 bindings
5  小步开发,类型 / 测试 / 构建 / 迁移四道验证
6  按需接入 Stripe、邮件、统计、搜索平台
7  部署并验证真实域名、SSR、API、上传、鉴权、回调
8  技术 SEO、内容、索引、转化优化
9   合规的分发与外链(这一步交给 backlink)
10  监控、实验、复盘、记录,进入下一轮

已经在跑的老站从当前阶段接入即可,不会强制你从阶段 1 重走。

两个命令,覆盖 90% 的日常

rankup init — 把一个项目接进来。新项目适用,做了很久却还没有项目记忆的项目更适用(这才是常态)。

它会读 package.json、路由清单、部署配置、git log,实时去查域名解不解析、Cloudflare 在不在跑、GSC 接没接、有没有支付,一律实时查询,不采信任何文档里的说法。然后建立 .rankup/ 项目记忆目录,已上线的站补一次流量、索引、性能、收入基线,出一份技术体检,最后落成 roadmap 和 P0–P2 计划。绿地项目在脚手架跑通后立刻建仓推远端,远端默认私有,因为未上线项目的仓库里带着选题和竞品调研,公开等于把选题送人。

rankup review — 定期回头看。

先跑只读体检脚本,拿到机械结论:缺哪些文件、哪些记录超期、脚本的已验证日期过没过期、经验库里有没有重复条目。然后做一件别处很少有人做的事情:去挖你自己的对话记录

node scripts/sessions.mjs --project-root . --days 14 --new-only --dump

最有价值的经验往往还留在对话里,从来没进过任何文档。这个脚本把 Claude Code 和 Codex 的会话浓缩成只剩人说的话和结论,按字节偏移记水位线,上次读到哪这次就从哪接着读。你要在里面找四类东西:用户的纠正、验证过的结论、踩过的坑与根因、已经推翻旧记录的事实。

开箱即用的选词与数据能力

scripts/seo-webcafe.mjs — 一个脚本打通哥飞那套 SEO 工具箱里所有带后端的工具:

子命令 回答什么问题
kd 这个词难不难做,前九名是什么盘面
serp 谷歌第一页每个结果凭什么排在那
audit 这个页面 40+ 项体检,扣分扣在哪
backlink 对方开的外链报价值不值
worth 这个站按流量和变现方式值多少钱
history 这个域名前世被谁用过
chat 直接问站内的 SEO Agent

零配置可跑,匿名身份每天 10 次。 接口地图是 2026-08-07 用真实浏览器会话逐个工具点网络面板得到的,每个工具只发了一次请求,没跑循环、没登录、没绕配额,记在 references/seo-webcafe.md

scripts/gt.py — Google Trends。热度对比、地区分布、相关飙升词、每日热搜四个子命令,首次运行自动建 venv 装 pytrends。配套 references/trends.md 里有三套工作流:小语种市场探测、把模糊方向收敛成真能做站的词、新兴趋势捕捉。

references/webcafe-experiences.md — 哥飞经验帖的十五条可执行裁定,已经译成 Agent 能直接照着判断的形式:

  • 别救老站,换域名重开
  • 同一套模板换品牌词上 N 个站,等于把自己重复 N 次
  • 多语言不要一键翻译,每种语言重新找词
  • 网站没做完,不要用正式域名上线
  • 想让谷歌显示品牌名而不是域名,六处一起写
  • KGR 用 intitle 加引号,且自己验一遍
  • 流量全来自品牌词、功能词没量,首页不用改
  • 瞄准大词却只出小词,不代表选词错了
  • 「已抓取但未编入索引」是内容问题,反复提交没用
  • 页面基本盘是下限,不是目标
  • GSC 数据只留 16 个月,滚动删除
  • 域名只要还有外链就续费
  • Bing 比谷歌好做是错觉,成因是 On-Page 门槛
  • GEO:被推荐的入口已经不只是谷歌
  • 工具选型,含价格现实

项目记忆:.rankup/

每个网站在自己仓库里存一份 .rankup/,记项目事实、架构、决策、基线、实验、发布和日志。密钥文件只记名称、用途、环境和 Secret 系统位置,真实值永远不进 Git。

归属分三层,互不混淆:

  • Skill 层只带剥离站点后仍然成立的通用方法。scripts/validate-rankup.mjs 会做机械断言,出现站点名、绝对路径、本机代理或凭据位置就构建失败。
  • 项目层的事实、数字、裁决与可复用脚本,留在各自的 <project>/.rankup/
  • 本机层registry.md 是跨项目资产索引,由 scripts/registry.mjs scan 生成。它含项目路径,所以被 gitignore 排除,并且有断言拦住 git add -f

开工前先查这张表:别的项目已经写好的脚本,直接去那个路径取,不要重写一遍。

默认建站栈

pnpm dlx shadcn@latest init \
  --preset b1D0eCA4 \
  --template start \
  --monorepo \
  --rtl \
  --pointer

Cloudflare-first:SSR 与 API 走 Workers,事务数据走 D1,文件与导出物走 R2,读多写少的配置走 KV,异步多步任务走 Queues / Workflows,强一致协调走 Durable Objects,真实密钥走 Worker Secrets 或 CI Secrets。资源按实际需求启用,不因为「以后可能需要」提前创建。

脚手架的四个坑每一条都实际踩过,写在 references/lifecycle.md 阶段 3。


backlink — 外链与登录态数据

SKILL.md 是 XML 结构的 v3.0。理由写在文件开头:这个 Skill 的主体是法则和路由,而一条容易被略过的法则,就是一条会被违反的法则。打了标签的块,让「我刚才违反了哪一条」这个问题有名字可答。

34 个脚本 + 19 篇方法论 + 4 个机读数据文件。

数据资产:这是这个 Skill 最贵的部分

数据文件是资产,参考文档是「怎么用它,以及怎么不骗自己」。全部机读、可提 PR、有 JSON Schema、有 CI 门禁。

data/submission-targets.json — 492 个可提交入口,按闸位分好类:

闸位 数量 含义
account 162 要注册账号
open-form 131 开放表单,直接填
captcha-interactive 112 交互式验证码,人工过闸
reciprocal 38 要求互链
captcha-passive 19 隐形验证码
personal-contact 18 得找人聊
email-verify 4 邮箱验证
其余 8 人工复审 / 没找到入口 / 未知

这份库的来源之一是社区流传的第三方清单,但每一条都经过实测复核。举个例子:一份第三方清单去重后 235 个目录,三批并行验完,按「免费 + 免注册 + 免验证码」判定,直接能提交的只有 13 个,开放率 5.5%;另有 48 个已经死了(占 20%,其中一部分仍返回 200,内容已被改成加密货币推广页)。 这个比例本身就是最有价值的信息,它能让你不再为一份「743 条免费外链」的清单浪费一整个下午。

data/free-channels.json — 27 个能直接发出链接的渠道,其中 25 个免注册。

data/paid-platforms.json — 141 个实测观察到承载付费投放的平台,按有多少个独立站点在用来排序。竞品在哪买的链接,这份表能给你答案。

data/index-submission.json — 只收 URL、不给链接的收录提交渠道。 它单独成表,因为它永远不该进外链台账。而且写死了一条规则:indexed 必须指名引擎,写 indexed@googleindexed@brave,不许写一个光秃秃的「已收录」。

五条浏览器法则

任何浏览器动作之前先读 references/browser-runtime.md。核心的几条:

  1. 只用用户自己的浏览器。 通过 OpenCLI 复用已授权会话,脚本永远不输入密码。面板处于登出状态时,脚本报错让本人去登,而不是自作主张。
  2. 一律走脚本,不手工点界面。 手点的结果每次形状不一样,不可比,踩过的坑要重踩。
  3. 浏览器不是纯 HTTP 的超集。 隐形验证码只在原始 HTML 里露馅,渲染完就看不见了。
  4. 会话按对话隔离,标签页不许串。
  5. 输出看着正常,数据可能已经错了。 现代数据网格没有 <table><tr>,虚拟滚动会让你静默丢行。所以行数自查分两级,把虚拟滚动和正则盲区分开报。

提交安全:三道闸

inspect-page.mjs 先探这个页面有没有可提交的表单 → safe-fill.mjs 填一份你已经审过的 payload,永不提交release-submit-guard.mjs 只在你对这一次提交明确点头之后才放行。

批量投放另有一条泳道。一百条以上的时候,单目标循环是「每个目标都对、整个战役全错」的典型:正确做法是先只读预检整批、把所有验证码集中成一个人工队列,而不是让整批卡在第一个验证码上。幂等键、队列分片、断点恢复、逐动作授权,全在 references/batch-campaign.md

证据化验证:目录宣传不等于外链

投出去不算数。台账 ledger.mjs 走的是这条链:

candidate → qualified → filled → submitted → public → indexed@<engine> → rel_verified

最终公开页必须逐项核对 URL、重定向和 rel 属性。一个跳转到 /out.php?id=123 的链接,和一个 rel="nofollow ugc" 的链接,都不是你以为的那个东西。

顺带解决的一个通用问题:从没有 API 的后台批量取数

references/harvest.md 加三个 harvest-* 脚本,harvest.browser.js 是个通用虚拟滚动表格提取器,按 Y 坐标聚类重建行,列位自适应。

这套知识跟外链无关,广告平台后台、电商后台、任何没有 API 的 SaaS 报表都能用。做这类任务时照样加载 backlink,只读那一篇。

授权数据源

references/authorized-data-sources.md 记录如何在你自己已登录的浏览器里,用脚本驱动第三方数据面板取数:批量流量筛查(一次登录、N 个域名、单域名 5 秒、可断点续跑)、单关键词的量与难度与分国家拆分、四份不给导出的表格报表。

表格报表会翻页,脚本要么传 --all-pages,要么就明确告警,不会安静地少给你几百行。

仓库里不含任何账号和密钥。 面板入口是公开 URL,账号活在你自己的浏览器会话里,读这个文件的人拿不到任何东西。


另外三个 Skill

autopilot — 一句话到无人值守执行完

扔一句「把 bug 修了」「优化下性能」,它自动调查、分类、拆成 XML 阶段计划、选 Skill、定完成判定,然后无人值守跑到底,包括自动部署、自动 E2E、自动 code review,不跳阶段。调用它等于授权全自动执行,中途不问你。

无依赖。

skill-link-check — Skill 目录审计

检查 .agents/skills.claude/skills 是否遵守「前者存真源、后者用符号链接镜像」的约定,输出孤儿目录、缺失链接、重复目录、断链和错误目标,给出需人工复核的修复命令。支持 JSON 证据输出。它只报告,不动你的目录。

Skill 装多了以后,「为什么这个 Skill 没生效」十次里有八次是链接的问题。

依赖 Python 3.10+。

skillsmp — 在 160 万份 SKILL.md 里搜技能

按关键词、分类、职业、语言过滤,专门挖那些写得好但没人知道的冷门 Skill。动手造轮子之前先搜一下。


使用说明

安装

# 交互式选择要装哪些
npx skills add yan-labs/yan-skills

# 全局装齐全部
npx skills add yan-labs/yan-skills -g --all

# 只要 rankup
npx skills add yan-labs/yan-skills --skill rankup -g -y

# 只要 backlink
npx skills add yan-labs/yan-skills --skill backlink -g -y

# 更新
npx skills update rankup -g -y

装完之后,直接跟你的 Agent 说人话就行,Skill 会自己被触发:

帮我看看 "ai headshot generator" 这个词能不能做
新建一个做生日石含义的内容站
rankup review
找找 example.com 的外链是从哪来的
这个站有哪些地方能提交
把这个后台的表格数据导出来

前置依赖

组件 谁需要 说明
Node.js 18+ 两个 Skill 都要 全部脚本的运行时
Python 3.10+ rankupgt.pyskill-link-check 首次运行 gt.py 自动建 venv
OpenCLI 及其 Chrome 扩展 backlink 全部浏览器动作 复用你自己已登录的 Chrome
Wrangler / Stripe CLI 按任务 只在真正走到那个阶段时才需要

backlink 的任何浏览器任务开始之前,先跑一次健康检查:

node backlink/scripts/health.mjs

令牌配置

令牌只放各 Skill 根目录的 .env,绝不入库。 仓库 .gitignore 已经排除,rankupvalidate-rankup.mjs 会做断言,构建时拦下来。

# rankup/.env
SEO_WEBCAFE_TOKEN=     # 只有 kd 命令需要,wc_mcp_ 开头,去 /kd/docs 自助生成
                       # 旧键名 KD_TOKEN= 同样识别
SEO_WEBCAFE_COOKIE=    # 可选。给了就把配额从访客 10/日 提到登录 100/日、VIP 500/日
                       # chat 命令强制登录,匿名会 401

# backlink/.env
TOOLS_SHARE_DASHBOARD_URL=      # 你自己的数据面板入口
TOOLS_SHARE_APP_ORIGIN=         # 落地 origin,用来校验点开的是哪个产品
TOOLS_SHARE_APP_ORIGIN_SEMRUSH= # 另一张卡的 origin

# skillsmp/.env(见 skillsmp/.env.example)
SKILLSMP_API_KEY=

大部分都不配也能用:rankupkdchat 外的全部子命令匿名即可跑,backlink 的数据库、方法论和填表守卫完全不依赖任何面板。

常用命令速查

rankup

# 关键词难度 + 前九名盘面
node rankup/scripts/seo-webcafe.mjs kd "ai headshot generator"

# 页面体检 / SERP 归因 / 外链估价 / 域名前世
node rankup/scripts/seo-webcafe.mjs audit https://example.com/page
node rankup/scripts/seo-webcafe.mjs serp "keyword"
node rankup/scripts/seo-webcafe.mjs backlink https://example.com
node rankup/scripts/seo-webcafe.mjs history example.com

# Google Trends
python3 rankup/scripts/gt.py compare "keyword a" "keyword b"

# 项目体检(只读)
node rankup/scripts/review.mjs --project-root . --days 30

# 挖会话记录里没沉淀的经验
node rankup/scripts/sessions.mjs --project-root . --days 14 --new-only --dump
node rankup/scripts/sessions.mjs --project-root . --days 14 --mark   # 消化完才落水位线

# 跨项目资产索引
node rankup/scripts/registry.mjs scan --roots ~/Project

# 改完 Skill 必跑
node rankup/scripts/validate-rankup.mjs

backlink

# 任何浏览器动作之前
node backlink/scripts/health.mjs

# 看看 492 条入口库里现在有什么
node backlink/scripts/targets-select.mjs --stats

# 取一个批次(open / captcha / account …)
node backlink/scripts/targets-select.mjs --cohort open

# 探一个页面的表单、登录与验证码状态
node backlink/scripts/inspect-page.mjs --url https://example.com/submit

# 填一份已审过的 payload,永不提交
node backlink/scripts/safe-fill.mjs --session <name> --scan ./scan.json --payload ./payload.json

# 别人发的外链清单,归一化 + 差异对比
node backlink/scripts/third-party-list-ingest.mjs --input ./list.md --out ./leads.json --new-only

# 批量流量筛查:一次登录,N 个域名,可续跑
node backlink/scripts/similarweb-batch.mjs --domains-file domains.txt --out traffic.jsonl

# 台账
node backlink/scripts/ledger.mjs list --state public

# 改数据必跑,CI 跑的就是这条
node backlink/scripts/validate-data.mjs

给这个仓库提 PR

数据文件欢迎补充,这是这个项目最值钱的部分。规则见 backlink/CONTRIBUTING.md,核心只有一条:

证据规则。 每一条渠道的状态都要有实测支撑,不接受「我看别人清单上有」。你说它 open-form,那就是你自己打开过那个表单;你说它 indexed,那就得指名是哪个引擎。

提交前跑通门禁:

node backlink/scripts/validate-data.mjs   # 必须 exit 0

本地开发

要改这些 Skill 本身,把全局技能目录直接链接到本仓库,让全局只存在一份真源:

git clone https://github.com/yan-labs/yan-skills.git
cd yan-skills

# 建立或修复链接(把被替换掉的实体目录先备份,不直接删)
node scripts/link-skills.mjs

# 只检查漂移,有问题退出 1,适合放 CI 或定期巡检
node scripts/link-skills.mjs --check

链接建立之后仓库里的改动即时生效,这时不要再对这些 Skill 跑 npx skills update,那会把符号链接换回实体目录副本,双份维护随之回归。

两道保护:

  • rankup 的自动更新会检测仓库根的 .skill-source 标记,识别出自己正从源码运行时拒绝执行更新(blocked / source-checkout),所以定时检查不会覆盖你的本地改动。这个标记位于仓库根,而 skills add/update 只复制单个 Skill 子目录,所以它永远不会随安装副本分发,也不会误伤项目级安装。
  • 万一链接还是被替换掉了,重跑 node scripts/link-skills.mjs 就能恢复。

常见问题

Q:不装 OpenCLI 能用 backlink 吗?
能。492 条入口库、141 个付费平台、19 篇方法论、外链质量评分与外联模板,全都是纯数据和纯方法,不需要任何浏览器。只有实际驱动浏览器取数和填表才需要。

Q:不给 rankup 配令牌能用吗?
基本能。seo-webcafe.mjskdchat 之外全部匿名可跑,配额访客 10/日。kd 要一个自助生成的公开 API 令牌,chat 要登录态。gt.py 完全不需要令牌。

Q:Skill 装了但没被触发?
skill-link-check。十次里有八次是符号链接的问题。

Q:rankup 会不会把我的项目信息写进 Skill 里?
不会,而且有机械门禁拦着。validate-rankup.mjs 断言 Skill 里不许出现站点名、域名、流量数字、property ID、绝对路径和凭据位置,出现即构建失败。项目侧的事实留在各自的 .rankup/,跨项目索引 registry.md 被 gitignore 排除。

Q:这些数据多久更新一次?
backlink/data/ 每次实测都会回写,updatedAt 字段是权威。方法论文档写的是「已验证日期」,过期的会在 rankup review 里被标出来。


致谢

这些 Skill 吸收了其他开源项目的成果,在此致谢:

  • flaqai/backlink_skills(MIT,Flaq AI)——backlink 的批量投放运维层来自这个项目:幂等键与队列分片、验证优先(先只读预检整批、把验证码集中成一个人工队列,而不是让整批卡在第一个验证码上)、逐动作授权、可断点恢复的状态集、锚文本策略,以及「已发布条目必须与已提交表单分开报」的报告纪律。见 backlink/references/batch-campaign.md。他们公开的 Free-backlink-list.md(743 条渠道)也是本 Skill 迄今测过的最大一份第三方线索清单,归一化与差异对比的结果记在 backlink/references/instant-publish.md。需要说明的是,那份清单和那两个提交 Skill 在他们仓库里是分开的资产,Skill 本身不带渠道,URL 由使用者提供。
  • aaron-he-zhu/seo-geo-claude-skills(Apache-2.0)——backlink/references/ 下的质量评分矩阵、分析模板与外联模板。
  • 哥飞 —— rankup 的选词与体检能力建立在他做的 SEO 工具箱之上,references/webcafe-experiences.md 的十五条裁定也来自他公开的经验帖。

已并入 backlink 的两个 Skill(2026-08-16)

原先的 backlink-analyzerbrowser-harvest 已合并进 backlink 并删除,从三个减到一个:

  • backlink-analyzer(外链质量、毒性与竞争缺口分析)本身是一套纯提示词模板,没有脚本也没有浏览器通道,能描述外链画像却拿不到画像。现为 backlink/references/ 下的 link-quality-rubric.mdanalysis-templates.mdoutreach-templates.md,保留上游 Apache-2.0 许可证与归属。
  • browser-harvest(从登录态后台批量取数)现为 backlink/references/harvest.md 加三个 scripts/harvest-*合并的代价照例说明:这套知识本身是通用的,现在却挂在一个以外链命名的 Skill 下。做与外链无关的后台取数时,仍然要加载 backlink 再读那一篇。

同样,gt(Google Trends 与选词工作流)于 2026-08-16 并入 rankup 并删除,现为 rankup/references/trends.mdscripts/gt.py。合并时发现 gt/scripts/kd.py 和已有的 scripts/seo-webcafe.mjs 打的是同一个接口、用的是同一种令牌,只是两套实现两个变量名,于是删掉重复的那份。代价是 gt 原本的触发面现在要经由 rankup 才能到达,description 已补上那批词。

License

除另有标注的第三方内容外,仓库内容采用 MIT License。backlink/references/ 下三份分析模板来自上游 Apache-2.0 项目,许可证副本与归属说明保留在同目录的 LICENSE-analysis-templates-Apache-2.0

Reviews (0)

No results found