把公开网页、讨论串或视频页面中的主要内容保存为结构清楚的 Markdown,并保留必要元数据。适合需要离线整理网页资料、归档文章或把在线内容转成可检索文本。
安装前请审阅 skill 内容:skill 会影响你的 AI 助手行为,仅安装你信任的来源。
不用安装 Node.js。复制后粘贴到本地 Agent 对话框,它会读取官方指南、安装并验收。
npx -y @huohuahub/cli@0.1.1 install webpage-content-collector --target auto --registry https://huohuahub.com跨平台 CLI 会校验 SHA256,并保护本地修改。旧脚本需要定向安装时,可在下面选择 AI。
旧版脚本仅供人工兼容:它会备份并替换同名目录。请先确认没有需要保留的本地修改;AI 安装协议不会自动调用它。
curl -fsSL "https://huohuahub.com/api/skills/webpage-content-collector/install" | bash自动检测本机已装的 AI 工具:只有一个直接装,检测到多个会列出让你挑(回车 = 全部)。审阅脚本内容 ↗
powershell -c "irm 'https://huohuahub.com/api/skills/webpage-content-collector/install.ps1' | iex"用 DeepSeek App、Kimi、豆包这类聊天 AI(没有 agent 端可装)? 可以把内容直接复制成 Prompt 粘贴使用;附带脚本和资料不会安装:
把公开网页、讨论串或视频页面中的主要内容保存为结构清楚的 Markdown,并保留必要元数据。
完成任务时重点处理:
最终目标不是堆出一份看似完整的内容,而是交付能够直接使用、继续修改并清楚验收的结果。
如果遇到登录或验证码时请求用户完成交互,不尝试绕过访问控制,先处理前置条件,不要直接假装任务已经完成。
优先收集:
1. 目标、输入文件与预期输出 2. 运行环境、依赖、版本和目录约束 3. 已有代码、接口、样例和错误信息 4. 安全、性能、兼容性和测试要求 5. 目标 URL 列表与是否需要登录 6. 是否保留图片、评论、字幕和页面元数据
信息不必一次问完。先检查用户已经提供的材料,只追问会明显改变结果的问题。
判断普通文章、动态页面、讨论串或视频页面。
优先使用稳定读取方式,必要时使用受控浏览器完成加载。
保留标题、正文、列表、代码、引用和必要媒体。
删除导航、广告、重复按钮和无关推荐。
记录原 URL、标题、作者、日期、采集时间和页面状态。
对照页面抽查段落、顺序、链接和缺失内容。
至少交付以下内容:
所有文件使用能说明内容和版本的名称。若任务包含执行动作,还要记录执行状态、验证结果和可继续处理的材料。
用户提供十篇教程链接,希望建立离线资料库;按页面类型提取正文、代码和图片,并为每篇增加统一元数据。
合理处理顺序:
1. 分类目标页面 2. 选择采集方式 3. 提取主要内容 4. 清理结构 5. 补充元数据 6. 验证与保存
交付时应重点展示Markdown 归档、媒体目录、采集日志,并说明尚未验证的部分。
火花 Hub 官方内容库首发版本。
解压后把 webpage-content-collector/ 整个目录放进对应位置即可。
~/.claude/skills/webpage-content-collector/~/.gemini/skills/webpage-content-collector/改动后在会话里执行 /skills reload~/.qwen/skills/webpage-content-collector/重启 CLI 生效~/.iflow/skills/webpage-content-collector/需在 frontmatter 补 license 字段~/.zcode/skills/webpage-content-collector/它们同时也读 ~/.claude/skills/ 或 ~/.agents/skills/,解压到那两个目录就顺带覆盖了。
~/.codex/skills/webpage-content-collector/也读标准目录 ~/.agents/skills/~/.openclaw/skills/webpage-content-collector/~/.cursor/skills/webpage-content-collector/~/.copilot/skills/webpage-content-collector/~/.agents/skills/webpage-content-collector/Deep Code 读标准目录 ~/.agents/skills/~/.kimi-code/skills/webpage-content-collector/也读标准目录 ~/.agents/skills/~/.config/opencode/skills/webpage-content-collector/也读 ~/.claude/skills/ 与 ~/.agents/skills/这两个端只支持项目内目录,家目录探测不到,只能手动放。
.windsurf/skills/webpage-content-collector/在项目根目录执行.trae/skills/webpage-content-collector/点文件名就地展开内容,审阅后再安装 —— skill 会影响你的 AI 助手行为, 只安装你信任的来源。
这个 skill 的用法交流都在它的使用心得笔记里:去参与(0 赞 · 0 条评论)↗
发现违规、恶意或侵权内容?到来源笔记举报此 skill ↗(skill 从笔记涌现,笔记下架即 skill 下架)。
[](https://huohuahub.com/skills/webpage-content-collector)什么时候会用上它:把公开网页、讨论串或视频页面中的主要内容保存为结构清楚的 Markdown,并保留必要元数据。适合需要离线整理网页资料、归档文章或把在线内容转成可检索文本。
怎么用:在 AI 工具里直接描述任务即可自动触发。显式调用的写法各端不同:Claude Code / Cursor 等用 /webpage-content-collector,Codex 用 $webpage-content-collector,Kimi Code 用 /skill:webpage-content-collector,ZCODE 用 $webpage-content-collector,Gemini CLI 以自动激活为主。