网页源码在线查看

下面输入框中输入您要查询的域名

域名或ip:
请求标识: 来源地址: Cookies: 参数:

工具使用说明 & 真实抓取示例

一、核心能力(真实数据)

1. 真实跨域抓取:通过公共代理服务器绕过浏览器同源限制,获取目标网站原始完整HTML源码,非模拟假数据。

2. 自定义请求头:支持UA、Referer、Cookie、URL查询参数,模拟浏览器/爬虫访问,解决网站反爬拦截。

3. 完整下载:抓取成功后下载按钮激活,导出完整源码为本地.html文件。

4. 多请求方法:GET/POST/PUT/DELETE,适配接口与静态页面。

二、标准抓取示例1:百度首页(公开页面)

请求方式:GET 目标地址:https://www.baidu.com 请求标识:不需要 来源地址:(空) Cookies:(空) 参数:(空) 操作:点击查询,编辑器直接输出百度官网完整原始HTML

三、带Cookie登录页面抓取示例2

请求方式:GET 目标地址:https://xxx.com/user/profile 请求标识:PC浏览器 来源地址:https://xxx.com/home Cookies:sessionid=xxxx; token=abc123 参数:page=1&size=10

四、常见问题说明

1. 代理限流:公共代理有访问频率限制,短时间多次抓取会返回429,等待1分钟重试。

2. HTTPS地址必须填写完整https://开头,仅填域名会抓取失败。

3. 部分网站强反爬:缺少UA/Cookie会返回空白/403,切换PC爬虫UA重试。

4. 下载功能仅在成功抓取源码后可用,无源码时按钮置灰不可点击。