登录态网页研究

作者:鹿Sir办公效率v1

针对用户已获授权访问的网站,用合规工作流完成信息提取与研究:本地浏览器登录、会话内浏览、处理重 JS 渲染页面、登录后数据提取。仅限用户本人授权的访问,不绕任何访问控制。当直接抓取返回登录页或空壳、页面依赖客户端渲染、内容需登录后可见,或用户要求研究其自身可访问的站点时触发。触发词:登录抓取、登录态研究、网页数据提取、登录后内容获取。

下载量
394
点赞
97
价格
免费

技能文档

---
name: authenticated-web-research
title: 登录态网页研究
category: 办公效率
description: 针对用户已获授权访问的网站,用合规工作流完成信息提取与研究:本地浏览器登录、会话内浏览、处理重 JS 渲染页面、登录后数据提取。仅限用户本人授权的访问,不绕任何访问控制。当直接抓取返回登录页或空壳、页面依赖客户端渲染、内容需登录后可见,或用户要求研究其自身可访问的站点时触发。触发词:登录抓取、登录态研究、网页数据提取、登录后内容获取。
---

# 登录态网页研究

当目标站点需要登录、内容动态渲染、或仅在用户用自己的账号登录后才可用时,使用本技能完成合规的信息提取与研究。

## 硬性规则

不绕过访问控制、付费墙或反爬虫防护。

本技能仅用于用户已授权的访问:

- 用户使用自己的账号登录
- 浏览器会话保持在本机
- 仅在访问合法可得后继续提取

## 适用场景

- 直接抓取返回登录页或残缺的页面骨架
- 搜索结果显示存在内容,但直接抓取被拦截
- 站点依赖客户端渲染(重 JS 页面)
- 用户明确希望在其本人可访问的站点上获得帮助

---

## 技能工作流

### 步骤1:判断失败模式

先对拦截原因分类:

- 需要登录
- 重 JS 渲染
- 地域或语言环境不匹配
- 索引仅覆盖摘要片段
- 抓取工具临时性不兼容

### 步骤2:改用浏览器加载

在断定「页面不可得」之前:

- 在本地浏览器中打开该页面
- 等待客户端内容渲染完成
- 在合适时检查可见文本、链接与网络行为
- 重 JS 页面优先走浏览器路径,而非纯抓取

### 步骤3:由用户在本地完成登录

如果需要登录且用户已获授权:

- 在本地浏览器中打开登录流程
- 只请求完成登录所需的最小操作,例如「请在已打开的页面中完成登录」
- 能用浏览器登录时,不要在对话中索要明文密码或其他敏感凭据

### 步骤4:在已登录会话内继续

用户登录完成后:

- 导航到目标页面
- 在站点内或账户区内检索
- 提取所需的事实、链接或结构化结果
- 记录哪些事实来自登录后视图

### 步骤5:优先使用登录后的官方出口

如站点提供,优先使用:

- 账户仪表盘
- 导出页面
- 官方 API
- RSS 或订阅源
- 站内搜索
- Sitemap
- 可下载的报告

---

## 输出格式

返回以下内容:

1. 公开可访问到了什么
2. 哪些内容需要登录后访问
3. 用户是否已在本地完成登录
4. 授权访问后提取到了什么
5. 仍不可获得的内容

使用说明

# 登录态网页研究

面向用户已授权访问的网站,提供合规的登录态信息提取工作流:本地浏览器登录、会话内浏览、重 JS 页面处理与登录后数据提取,明确不绕过任何访问控制。

## 使用

```text
这篇报告在 xxx 系统里,需要登录才能看,
帮我在我登录后把关键数据整理成表格。
```

技能按「判断拦截原因 → 浏览器加载 → 用户本地登录 → 会话内提取 → 优先官方出口」五步执行,并在结果中区分公开内容与登录后内容。

## 工作原理

- 直接抓取失败时,先分类失败模式(登录墙 / 重 JS / 地域 / 摘要索引),再改用本地浏览器路径
- 登录始终由用户本人在浏览器中完成,凭据不进入对话
- 提取优先走账户仪表盘、导出、官方 API、订阅源等官方出口

如何安装此技能?

访问技能市场,点击「安装」按钮,按提示将技能包放入 AI 编程助手的 skills 目录即可。

浏览技能市场

支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手