Karakeep 是什么
你有没有这种经历:浏览器收藏夹里堆了几千个链接,从来没再打开过?Pocket 收了一堆”稍后读”,结果变成了”永远不读”?各种设备之间书签不同步,找东西全靠记忆?
如果你是 NAS 玩家或者喜欢自托管,Karakeep 可能就是你在找的那个答案。
Karakeep(原名 Hoarder)是一个开源的自托管书签管理应用,GitHub 星标 26.2k+,活跃度很高。它不只是保存链接那么简单——能存网页、笔记、图片、PDF,然后用 AI 自动给每个书签打标签,还能全文搜索。
名字来自阿拉伯语 karakeeb(كراكيب),意思是”那些乱七八糟但舍不得扔的小玩意儿”。翻译过来就是:数字囤积症患者的福音。
核心功能一览:
- AI 自动打标签和摘要——存进去就自动分类,不用手动整理
- 全文搜索 + 高级筛选(支持
tag:source:is:broken等限定符) - 浏览器扩展(Chrome / Firefox / Safari)+ 移动端 App(iOS / Android)
- 网页归档——自动保存完整页面快照,不怕原站挂了
- 规则引擎——按 URL、来源、标签等条件自动化处理
- MCP 协议支持——可以通过 AI 助手直接操作你的书签库
- 多用户协作——共享列表,团队一起管
技术栈是 Next.js + TypeScript + PostgreSQL + Meilisearch + Redis,Docker 一键部署。
v0.32.0 更新了什么
Karakeep 开发节奏很快,刚发布不久的 v0.32.0 有几个值得关注的更新:
浏览器端爬取(实验性)
这是我觉得最实用的新功能。之前 Karakeep 用服务端的 Puppeteer 爬取网页内容来生成快照,但有些需要登录的页面或内网地址服务器访问不到。v0.32 加了基于 SingleFile 核心的客户端爬取,浏览器扩展可以直接在本地抓取并上传完整页面。对自托管用户来说,这意味着内网服务的页面也能正常归档了。
目前还是可选功能,在扩展设置里开启,稳定后会变成默认行为。
安全修复集中修复
这一版修了好几个安全问题:
- SSRF 验证绕过(爬虫重定向导致的)
- 密码修改接口缺少速率限制
- 存储型 XSS(用户名未清理)
- favicon 提取盲 SSRF
- API 速率限制补齐
如果你在跑旧版本,强烈建议升级。自托管不等于安全,该更新的还是要更新。
规则引擎增强
规则引擎现在支持按书签来源写规则了,同一个条件还能加多个值列表。比如你可以设置:”所有来自 YouTube 的书签自动加 video 标签并移入 Videos 列表”。配合 RSS 自动订阅,基本上可以实现零手动整理。
MCP 工具更新
Karakeep 的 Model Context Protocol 支持新增了 update-bookmark 工具,AI 助手不仅能查书签,还能改书签了。配合 OpenClaw、Hermes 这类 Agent 框架,可以做一些有趣的自动化流程。
其他改进
- LLM OCR 图片文字识别
- PDF 归档功能
- 同步阅读进度
- Matter 等其他书签服务的导入优化
- Firefox 后台脚本兼容修复
- yt-dlp 视频下载画质问题修复
怎么部署到 NAS 上
Karakeep 的推荐部署方式是 Docker Compose。官方提供了完整的 docker-compose.yml,需要的依赖包括:
| 组件 | 说明 |
|---|---|
| PostgreSQL | 主数据库 |
| Meilisearch | 全文搜索引擎 |
| Redis | 缓存和队列 |
| Chrome/Chromium | 服务端爬虫(Puppeteer 需要) |
对于飞牛 NAS 或群晖这类 ARM 设备来说,资源占用不算轻——光 Chrome 就要吃不少内存。如果你的 NAS 只有 4GB 内存,建议把 Chrome 换成无头模式或干脆关掉服务端爬虫,只用新的客户端爬取功能。
部署步骤大致是:
- 从 GitHub 仓库拉取 docker/ 目录下的配置文件
- 配置 .env 文件(数据库连接、AI 接口密钥等)
docker compose up -d启动- 打开 Web 端注册账号,装浏览器扩展开始用
AI 标签功能默认走 OpenAI 接口,但也支持接本地模型(Ollama),不想花钱调 API 的话可以用自己的 GPU 跑。
和同类工具对比
市面上的自托管书签工具不少,简单对比一下:
| 特性 | Karakeep | Linkwarden | Omnivore | Shinobi |
|---|---|---|---|---|
| AI 自动标签 | ✅ 内置 | ❌ | 部分 | ❌ |
| 全文搜索 | ✅ Meilisearch | ✅ 基础 | ✅ | 基础 |
| 网页归档 | ✅ 完整页面 | 截图 | ✅ | ✅ |
| 浏览器扩展 | ✅ 三平台 | ✅ | ✅ | ✅ |
| 移动端 | ✅ 原生 App | PWA | ✅ | PWA |
| 规则引擎 | ✅ | ❌ | ❌ | ❌ |
| MCP 支持 | ✅ | ❌ | ❌ | ❌ |
| 多用户 | ✅ | ✅ | ✅ | ✅ |
| 协议 | AGPL-3.0 | AGPL-3.0 | GPL-3.0 | MIT |
Karakeep 的差异化优势很明显:AI 标签 + 规则引擎 + MCP 集成这三样别的工具要么没有,要么做得很浅。如果你已经在跑 Ollama 或者 DeepSeek API,那 AI 标签基本是白嫖的功能。
我的看法
Karakeep 解决了一个真实痛点:收藏的东西越来越多,找的时候找不到。传统的书签管理器本质上是文件夹 + 手动分类,规模一上去就崩。Karakeep 用 AI 把分类这件事自动化了,加上全文搜索和规则引擎,确实能做到”存了就能找到”。
不过也有几个需要注意的地方:
- 资源占用不低——PostgreSQL + Meilisearch + Redis + Chrome,四个容器起步,内存至少留 2GB
- AGPL-3.0 协议——如果你打算二次开发或提供 SaaS 服务,需要注意开源义务
- 还在快速迭代中——API 和数据结构偶尔会变,升级前看下 changelog
- 中文搜索——Meilisearch 对中文分词的支持还可以,但不如 Elasticsearch 那么精细
总的来说,如果你有一台 NAS 或者 VPS,又受够了书签混乱的问题,Karakeep 值得试试。26k 星不是白来的,产品完成度确实高。
项目地址:github.com/karakeep-app/karakeep
在线演示:try.karakeep.app(只读模式,账号 demo@karakeep.app / demodemo)
文档:docs.karakeep.app