degoog兼容层揭秘:零配置运行SearXNG和4get引擎,白嫖整个搜索引擎生态
【免费下载链接】degoogSearch engine aggregator with a comprehensive plugin/extension system项目地址: https://gitcode.com/gh_mirrors/de/degoog
degoog 是一款可自托管的搜索引擎聚合器,它的兼容层允许你零配置直接运行 SearXNG 的 Python 引擎和 4get 的 PHP 爬虫,无需部署额外服务,即可白嫖两大开源项目积累的整个搜索引擎生态,把数百个来源变成你专属的元搜索入口。
为什么你需要一个搜索聚合器
用惯了单一搜索引擎后,你会发现:
- 🎯 结果被个性化推荐污染
- 🚫 部分站点被封禁、被过滤
- 📰 垂直领域(图片、视频、学术、音乐)搜不到想要的
degoog 的思路很直接:一次搜索,同时问遍多个引擎,结果统一展示。它的兼容层更进一步——不用自己一个个写引擎适配器,而是直接"吞下" SearXNG 和 4get 这两个老牌聚合项目的现成引擎。
兼容层是怎么做到零配置的
很多人以为要白嫖两个生态,得先部署一套 SearXNG、再装一个 4get。degoog 的做法完全不同:
它不是"调用"这两个项目,而是把它们的核心引擎文件直接搬进来,用自己的运行时驱动。
整个机制只有三步:
- 文件级移植—— 安装引擎时,degoog 直接从 SearXNG 官方仓库下载对应的单个
.py引擎文件(或 4get 的.php爬虫文件),放进本地引擎目录,连依赖文件也一并处理,见 install.ts。 - 跨语言 RPC 桥接—— 每个引擎由独立的 Python(runner.py)或 PHP(runner.php)子进程加载运行,通过 JSON-RPC 与主服务通信,核心协议定义在 rpc.ts。
- 统一封装—— 原生 HTTP 请求、缓存、安全搜索、时间过滤全部由 degoog 侧接管。SearXNG 引擎代码里原本负责发请求的部分,会被桥接层拦截并转发到 degoog 的 engine-bridge.ts,自动带上随机 User-Agent、Cookie 和 1 小时结果缓存。
对使用者来说,结果就是:SearXNG 的引擎在 degoog 里跑,4get 的爬虫也在 degoog 里跑,而 SearXNG 和 4get 本身一行代码都不用部署。
SearXNG 兼容层:一键装上 80 个现成引擎
SearXNG 生态最值钱的是它的引擎目录。degoog 内置了一份经人工测试筛选的引擎清单(见 searx/catalog.ts),涵盖:
| 类型 | 代表引擎 |
|---|---|
| 🔍 通用网页 | Brave、DuckDuckGo、Mojeek、Sogou、Bing |
| 🖼️ 图片 | Bing Images、Google Images、Pexels、Pinterest、Openverse |
| 🎬 视频 | YouTube Noapi、Bitchute、爱奇艺、Bing Videos |
| 📰 新闻 | Bing News、Yahoo News、Ansa |
| 🎵 音乐 | SoundCloud、Deezer、Genius 歌词 |
| 🔬 学术 | Core、Crossref、OpenAlex、PubMed |
| 📄 其他 | IMDB、GitHub、Docker Hub、StackExchange、Wolfram Alpha |
使用体验上值得划重点的几个能力:
- ⚡自动依赖解析:安装
bing_images时,degoog 会自动先装它依赖的bing共享模块,卸载时又会自动清理孤儿依赖 - 🛡️安全搜索映射:degoog 的 Off/Moderate/Strict 三档自动翻译成 SearXNG 的 safesearch 参数,图片/视频类引擎默认开启 Moderate
- ⏱️时间过滤:degoog 的时间筛选器直接映射为 SearXNG 引擎的 day/week/month/year 参数
- 📚特性文件同步:安装时同步下载 SearXNG 的 engine_traits.json,为每个引擎补全特性描述
4get 兼容层:把激进爬虫收编进来
如果说 SearXNG 层偏"官方 API 友好",那 4get 层就是重口味担当——它收录的是一批以"啃 HTML"著称的爬虫(清单见 fourget/catalog.ts):
- DuckDuckGo / Brave / Startpage / Yandex:网页、图片、视频、新闻全覆盖
- Marginalia / Mwmbl / WiBy:独立网络小众搜索引擎
- 支持curl 指纹伪装:部分引擎(Brave、Yandex)自带反爬,4get 层可自动启用浏览器指纹请求
- 翻页令牌(npt)管理:4get 引擎翻页需要上一页返回的令牌,degoog 自动缓存并续接,翻到没有令牌为止(见 fourget/index.ts)
- API Key 自动接入:像 Marginalia 这类需要密钥的引擎,在设置里填一次密钥即可,degoog 会自动注入运行时
所有 4get 爬虫同样由 runner.php 子进程驱动,网络请求依然走 degoog 的桥接层——意味着你的出网代理、请求日志、限速策略对它全部生效。
三步开启:最快配置方法
整个流程没有任何命令行操作:
- 打开设置→ Engines 标签页,找到 SearX / 4get 兼容区,打开
searxCompatEnabled或fourgetCompatEnabled开关(注册逻辑见 registry.ts) - 选择引擎→ 目录里每个引擎都有安装/更新/卸载按钮,界面展示其类型、官网、依赖与缺失的 Python 库
- 搜索→ 新引擎立即出现在引擎列表中,带
!bang快捷命令可直接定向搜索,与原生引擎完全同权
需要留意的只有运行环境:SearX 层需要python3(缺失库会提示pip install命令),4get 层需要 PHP;用官方 Docker 镜像启动时这些依赖已预置好。
白嫖生态的正确姿势
degoog 兼容层的设计哲学可以总结为一句话:引擎是文件,运行时是插件,一切归聚合器管。
- 你获得 SearXNG 团队持续维护的 80+ 引擎,且更新只需点一下按钮
- 你获得 4get 社区的爬虫实现,享受其反爬对抗成果,却不必运行整套 4get 服务
- 所有引擎共享 degoog 的缓存、限速、代理与隐私策略,行为统一可控
唯一提醒:兼容层下载的引擎代码来自上游开源仓库,官方目录虽经人工筛选,但仍建议只安装自己信任的引擎。对于想自建"去谷歌化"搜索入口的新手来说,这套零配置兼容层大概是市面上把"白嫖整个搜索引擎生态"这件事做得最彻底的方案之一。
【免费下载链接】degoogSearch engine aggregator with a comprehensive plugin/extension system项目地址: https://gitcode.com/gh_mirrors/de/degoog
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考