用 curl 判断网站是 CSR 还是 SSR
核心原理
curl 获取的是服务器返回的原始 HTML,不会执行 JavaScript。
所以看 HTML 里有没有页面的核心内容,就能快速判断首屏是否由服务器生成。
1. 获取 HTML
curl -sL https://example.com2. 搜索页面文字
curl -sL https://example.com | grep "页面标题"能搜到
HTML 中已经有页面内容
→ SSR / SSG / 预渲染例如:
<h1>文章标题</h1>
<p>文章内容...</p>搜不到
如果 HTML 只有:
<div id="root"></div>
<script src="/main.js"></script>则很可能是:
CSR(客户端渲染)3. 注意:现代网站通常是混合模式
例如 Next.js 可能是:
SSR/SSG
↓
返回 HTML
↓
JavaScript Hydration
↓
CSR 交互所以 curl 判断的是:
服务器返回的初始 HTML 是否已经包含页面内容。
并不能单独证明整个网站是“纯 SSR”还是“纯 CSR”。
4. Googlebot 测试
如果怀疑网站针对爬虫做了不同渲染:
curl -sL -A "Googlebot" https://example.com然后与普通 curl 的结果比较。
一句话记忆:
curl 能看到完整页面内容 → 首屏很可能是 SSR/SSG;只有空壳 + JS → 很可能是 CSR。
暂无标签