核心原理

curl 获取的是服务器返回的原始 HTML,不会执行 JavaScript。

所以看 HTML 里有没有页面的核心内容,就能快速判断首屏是否由服务器生成。

1. 获取 HTML

curl -sL https://example.com

2. 搜索页面文字

curl -sL https://example.com | grep "页面标题"

能搜到

HTML 中已经有页面内容
→ SSR / SSG / 预渲染

例如:

<h1>文章标题</h1>
<p>文章内容...</p>

搜不到

如果 HTML 只有:

<div id="root"></div>
<script src="/main.js"></script>

则很可能是:

CSR(客户端渲染)

3. 注意:现代网站通常是混合模式

例如 Next.js 可能是:

SSR/SSG
  ↓
返回 HTML
  ↓
JavaScript Hydration
  ↓
CSR 交互

所以 curl 判断的是:

服务器返回的初始 HTML 是否已经包含页面内容。

并不能单独证明整个网站是“纯 SSR”还是“纯 CSR”。

4. Googlebot 测试

如果怀疑网站针对爬虫做了不同渲染:

curl -sL -A "Googlebot" https://example.com

然后与普通 curl 的结果比较。

一句话记忆:

curl 能看到完整页面内容 → 首屏很可能是 SSR/SSG;只有空壳 + JS → 很可能是 CSR。