Search King

无敌人机协作搜索器——搜图、搜文字、读网页、深度爬取、反爬网站抓取,一台机器,十八路引擎。

五种行为

搜图 / 搜文字 / 读网页 / 深度爬取 / 平台抓取

引擎矩阵

12 路图片引擎 + 6 路文字引擎

六种后端

从无头浏览器到真实浏览器,层层兜底

工作流

遇验证码自动换路,全挂切真人模式

版权可追溯

每个结果都带来源与许可证记录

快速上手

一行命令,装上就用

一台机器,五种干法

行为参数正交组合,一个工具应付所有内容采集场景。

行为、后端、修饰器参数自由搭配,互不干扰——这也让命令行可预测、可自动化。

  • 搜图(默认):直接输关键词即开搜,支持按引擎、按免费站过滤。
  • 搜文字:`--search`,走 6 路文字引擎链,可关浏览器用纯 HTTP 快速搜索。
  • 读网页:`--read`,提取正文,支持多个 URL 并行。
  • 深度爬取:`--crawl`,基于 Crawl4AI 深度提取,输出 Markdown。
  • 平台抓取:`--fetch`,专门抓雪球帖子、B 站视频与合集。

十八路引擎,谁行谁上

十二路图片 + 六路文字,覆盖主流与地区性搜索引擎。

  • 图片(12):Unsplash、Pexels、Pixabay、Burst、Bing、百度、Brave、DuckDuckGo、Yandex、搜狗、360、Google。
  • 文字(6):Bing、百度、Google、DuckDuckGo、Brave、搜狗。
  • 免费商用优先:`--free` 只走带免费商用许可证的摄影站,版权风险可控。
  • 引擎链自动回退:单个引擎挂了或被拦截,自动换下一个,不中断。

六种后端,层层兜底

从最轻到最重,按被拦截的程度逐渐升级。

  • edge:系统 Edge 浏览器(默认)。
  • chromium:Playwright 内置 Chromium,跨平台一致。
  • cloak:CloakBrowser 反检测,专门过 Cloudflare 类防护。
  • lite:纯 HTTP,最快,只用于文字搜索。
  • opencli:真实 Edge + 保持会话,抗 WAF,抓雪球和 B 站。
  • manual:你浏览、工具提取——反爬到最后,真人兜底。

遇到拦截,就换一条路

CAPTCHA 自动跳过,引擎自动回退,真人浏览兜底。

Search King 把「被拦」当成常态来处理:任何模式遇到验证码或拦截,自动跳过换下一个引擎;全都挂了,切手动模式由真人完成。

  • 验证码自动跳过:不卡死、不提交,直接换路。
  • 深度抓取转文档:爬取结果落到 Markdown,方便二次处理。
  • 并发下载:选中图片批量下载,全程带来源与许可证记录。

版权,不是事后补救

靠一张图解决版权问题的时代过去了——来源要可查,许可要可追溯。

图片下载不是交差,而是交付可用的素材。Search King 始终携带来源文档与许可证信息,让每一次下载都能说清「这图从哪来、能不能商用」。

装上,就能用

安装依赖,一行命令开跑。

python scraper.py "猫"
python scraper.py "猫" --free --download -o pics
python scraper.py --search "AI 2026" --backend lite
python scraper.py --read https://example.com --backend cloak
Playwright Crawl4AI CloakBrowser yt-dlp Python 3.8+