Karakeep 是一款面向资料收集者的开源书签归档工具,可以保存网页链接、简短笔记、图片和 PDF,并自动抓取标题、描述与预览内容。它适合希望把稍后阅读、网页存档、全文搜索和标签整理放在自己服务器上的个人或小团队,但完整部署需要同时维护抓取浏览器、搜索服务和持久化数据。
![[Github] Karakeep - 可自托管的开源书签归档与稍后阅读工具](https://wn.zmoyun.com/wp-content/uploads/2026/07/1784091549-karakeep-featured.webp)
快速结论
| 项目 | 当前情况 | 选择建议 |
|---|---|---|
| 定位 | 自托管书签、稍后阅读与网页归档 | 适合资料长期积累和链接防失效 |
| 当前版本 | v0.32.0,2026 年 5 月发布 | 升级前查看迁移和发布说明 |
| 开源许可 | AGPL-3.0 | 二次开发和网络服务需理解许可证义务 |
| 部署方式 | Docker 为主,可按需启用 Meilisearch、Chrome、OpenAI 或 Ollama | 完整功能对服务器资源和维护能力有要求 |
| 主要限制 | 抓取器会从服务器网络访问用户提交的网址 | 不应直接开放给不受信任用户 |
截至 2026 年 7 月 15 日核对时,GitHub 仓库显示约 27,405 Stars、1,347 Forks,最新正式版为 v0.32.0。主分支最近一次提交日期为 2026 年 7 月 12 日,项目仍有近期维护活动;这些数据会变化,应以仓库页面为准。
项目概览
Karakeep 的前身是 Hoarder,核心思路是“什么都能收藏”。链接保存后,后台抓取器会提取页面内容并建立索引;用户也可以直接记录笔记、上传图片和 PDF,再通过列表、标签、全文搜索和批量操作整理资料。它还支持网页高亮、RSS 自动收集、浏览器扩展、移动端应用、REST API 与多个第三方客户端。
项目把 AI 功能设计为可选模块。接入云端模型或本地 Ollama 后,可以自动生成标签和摘要;不配置模型时,基础收藏和归档仍可使用。AI 自动标签可能产生误判,不适合替代人工建立长期分类体系。
核心功能
多类型收藏
Karakeep 不只保存 URL,还能保存文字笔记、图片和 PDF。网页内容可自动获取标题、描述和缩略图,列表可用于区分工作、学习、灵感与待读资料,多人还可以协作维护同一列表。
搜索与归档
完整安装会使用 Meilisearch 提供全文搜索,并通过浏览器容器抓取 JavaScript 页面和页面截图。项目还可以使用 Monolith 保存完整网页、用 yt-dlp 归档视频内容,从而降低原页面修改或失效后的资料丢失风险。归档副本仍需遵守原内容的版权与使用条款。
扩展与同步
官方提供 Chrome、Firefox 和 Safari 扩展,也有 iOS、Android 应用及 API。书签可以从 Chrome、Pocket、Linkwarden、Omnivore 等来源导入,并可借助 floccus 与浏览器书签同步。移动端离线阅读目前仍属于规划功能,不应把它视为现有能力。
部署要求
官方推荐使用 Docker Compose。完整功能通常涉及 Karakeep 主服务、持久化数据目录、Meilisearch 和 Chrome 抓取容器;AI 自动标签还需要配置 OpenAI API 或本地 Ollama。资源受限时可以使用最小部署,但会牺牲全文搜索、JavaScript 网页抓取、截图或 AI 标签等能力。
正式上线前至少要完成以下工作:
- 把数据目录挂载到稳定磁盘,并建立异地备份和恢复演练。
- 把默认的
NEXTAUTH_SECRET改为足够长的随机值。 - 使用 HTTPS、反向代理和最小化的公开入口。
- 升级前阅读 Release 与迁移说明,并先保存数据库和归档文件。
- 为抓取容器限制网络访问范围,避免它探测内部服务。
安全边界
Karakeep 的抓取器本质上会运行浏览器访问用户提交的网址。官方安全文档明确提醒:不受信任的用户可能让服务器访问不希望访问的外部站点、暴露源站 IP,甚至尝试探测内网端点。项目有基础 SSRF 防护,但不能覆盖所有风险。
因此,个人实例应限制注册和邀请;团队实例应只向可信成员开放。更严格的环境可以让抓取流量经过受限代理或 VPN,把浏览器容器放到隔离网络,或者使用外部托管浏览器服务。仅把网站放在 Cloudflare 后方并不能隐藏抓取器主动访问外站时暴露的出口信息。
适合人群
- 希望自托管书签、网页存档与稍后阅读资料的个人用户。
- 需要共同维护研究资料、竞品链接或内容选题库的小团队。
- 需要 API、RSS、浏览器扩展和多客户端接入的技术用户。
- 愿意维护 Docker、搜索服务、备份与网络隔离的自托管爱好者。
如果只需要最简单的跨设备书签同步,或者没有服务器维护能力,浏览器自带同步和成熟托管服务会更省心。Karakeep 的优势是控制权与归档深度,而代价是资源占用、升级、备份和抓取安全责任。
常见问题
Karakeep 免费吗
Karakeep 的核心代码采用 AGPL-3.0 许可证,可以自行部署和使用。服务器、域名、存储、备份以及可选的云端 AI API 可能产生费用;如果使用本地 Ollama,也需要为模型准备额外计算资源。
必须配置 AI 吗
不需要。链接、笔记、图片和 PDF 收藏等基础功能可以在不接入 AI 的情况下工作。未配置 OpenAI 或 Ollama 时,AI 自动标签和摘要会停用,但这不会阻止基础收藏;全文搜索是否可用则取决于 Meilisearch。
能替代 Pocket 吗
如果你重视自托管、网页归档、全文搜索和多类型收藏,Karakeep 可以作为 Pocket 一类稍后阅读服务的替代选择。若你更重视免维护、成熟的离线阅读和统一客服,托管产品可能更合适。
如何避免丢失
至少要备份持久化数据目录、数据库、配置和归档文件,并定期验证恢复。容器镜像不是数据备份,重建容器也不能恢复被误删的书签。大版本升级前应额外创建可回滚的快照或备份副本。
能公开注册吗
不建议把实例直接开放给不受信任用户。抓取器会从服务器网络访问提交的网址,可能暴露出口 IP 或被用于探测内部网络。需要多人使用时,应采用邀请制、网络隔离和严格的抓取访问策略。
总结建议
Karakeep 适合把“资料长期保存”和“数据留在自己服务器”列为核心要求的用户。它把书签、笔记、图片、PDF、全文搜索和网页归档整合得较完整,但不是安装后无需维护的云服务。决定采用前,应先确认服务器资源、备份、升级和抓取隔离都能长期执行。
相关链接
- GitHub 仓库:karakeep-app/karakeep
- 官方网站:https://karakeep.app
- 官方文档:https://docs.karakeep.app
- 最新 Release:https://github.com/karakeep-app/karakeep/releases/latest
© 版权声明
本站部分内容源于网络收集,文章等版权归原作者所有,若需删稿请联系管理员邮箱:satomini@warpnav.com
相关文章
暂无评论...