登
登录态网页研究
作者:鹿Sir办公效率v1
针对用户已获授权访问的网站,用合规工作流完成信息提取与研究:本地浏览器登录、会话内浏览、处理重 JS 渲染页面、登录后数据提取。仅限用户本人授权的访问,不绕任何访问控制。当直接抓取返回登录页或空壳、页面依赖客户端渲染、内容需登录后可见,或用户要求研究其自身可访问的站点时触发。触发词:登录抓取、登录态研究、网页数据提取、登录后内容获取。
下载量
394
点赞
97
价格
免费
技能文档
--- name: authenticated-web-research title: 登录态网页研究 category: 办公效率 description: 针对用户已获授权访问的网站,用合规工作流完成信息提取与研究:本地浏览器登录、会话内浏览、处理重 JS 渲染页面、登录后数据提取。仅限用户本人授权的访问,不绕任何访问控制。当直接抓取返回登录页或空壳、页面依赖客户端渲染、内容需登录后可见,或用户要求研究其自身可访问的站点时触发。触发词:登录抓取、登录态研究、网页数据提取、登录后内容获取。 --- # 登录态网页研究 当目标站点需要登录、内容动态渲染、或仅在用户用自己的账号登录后才可用时,使用本技能完成合规的信息提取与研究。 ## 硬性规则 不绕过访问控制、付费墙或反爬虫防护。 本技能仅用于用户已授权的访问: - 用户使用自己的账号登录 - 浏览器会话保持在本机 - 仅在访问合法可得后继续提取 ## 适用场景 - 直接抓取返回登录页或残缺的页面骨架 - 搜索结果显示存在内容,但直接抓取被拦截 - 站点依赖客户端渲染(重 JS 页面) - 用户明确希望在其本人可访问的站点上获得帮助 --- ## 技能工作流 ### 步骤1:判断失败模式 先对拦截原因分类: - 需要登录 - 重 JS 渲染 - 地域或语言环境不匹配 - 索引仅覆盖摘要片段 - 抓取工具临时性不兼容 ### 步骤2:改用浏览器加载 在断定「页面不可得」之前: - 在本地浏览器中打开该页面 - 等待客户端内容渲染完成 - 在合适时检查可见文本、链接与网络行为 - 重 JS 页面优先走浏览器路径,而非纯抓取 ### 步骤3:由用户在本地完成登录 如果需要登录且用户已获授权: - 在本地浏览器中打开登录流程 - 只请求完成登录所需的最小操作,例如「请在已打开的页面中完成登录」 - 能用浏览器登录时,不要在对话中索要明文密码或其他敏感凭据 ### 步骤4:在已登录会话内继续 用户登录完成后: - 导航到目标页面 - 在站点内或账户区内检索 - 提取所需的事实、链接或结构化结果 - 记录哪些事实来自登录后视图 ### 步骤5:优先使用登录后的官方出口 如站点提供,优先使用: - 账户仪表盘 - 导出页面 - 官方 API - RSS 或订阅源 - 站内搜索 - Sitemap - 可下载的报告 --- ## 输出格式 返回以下内容: 1. 公开可访问到了什么 2. 哪些内容需要登录后访问 3. 用户是否已在本地完成登录 4. 授权访问后提取到了什么 5. 仍不可获得的内容
使用说明
# 登录态网页研究 面向用户已授权访问的网站,提供合规的登录态信息提取工作流:本地浏览器登录、会话内浏览、重 JS 页面处理与登录后数据提取,明确不绕过任何访问控制。 ## 使用 ```text 这篇报告在 xxx 系统里,需要登录才能看, 帮我在我登录后把关键数据整理成表格。 ``` 技能按「判断拦截原因 → 浏览器加载 → 用户本地登录 → 会话内提取 → 优先官方出口」五步执行,并在结果中区分公开内容与登录后内容。 ## 工作原理 - 直接抓取失败时,先分类失败模式(登录墙 / 重 JS / 地域 / 摘要索引),再改用本地浏览器路径 - 登录始终由用户本人在浏览器中完成,凭据不进入对话 - 提取优先走账户仪表盘、导出、官方 API、订阅源等官方出口
支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手