LarkReader LarkReader
v0.1.0 · 公开测试

飞书知识库,
一键本地阅读

把整个 Wiki 或单篇文档备份成 Markdown + 图片,结构、附件全保留。
桌面原生 · 数据本地 · 不依赖云服务

0
真实飞书 Wiki 验证节点
0
E2E 用例 · 0 失败
0
后端 IPC 命令
0
%
本地保存率
痛点 / 场景

你为什么需要 LarkReader

飞书很好,但长文档在线读起来累,也没法离线。把工作资料备份成通用格式、用自己习惯的方式阅读这件事,市面上没人替你做。

数据自主 / 团队留档

把整个知识库一键导出到本地,长期保留属于你自己的副本。团队成员更替、项目交接、内部知识沉淀,都能从容留存。

离线阅读 / 通勤

把 Wiki 同步成本地 Markdown,地铁、飞机、客户现场都能看。结构、附件、链接全保留。

多维表格做数据分析

导出 Bitable / Sheet 为结构化 NDJSON / XLSX,可直接接入 Pandas / Excel / BI 工具。

合规归档 / 审计

金融、法律、医疗团队需要长期归档。LarkReader 生成的目录结构便于二次检索与脱敏。

使用场景

一份知识库,两种角度

先看日常使用的不便之处,再用真实下载产物证明 LarkReader 能解决到什么程度。

日常使用不便的时候

在浏览器里看飞书知识库,常常是这样的体验:

  • 多 tab 来回切换 · 一篇文档要开好几个页面才能看全
  • 加载受网络影响 · 网速不稳、跨网访问、页面资源多时正文断断续续
  • 搜索 / 跳转能力弱 · 浏览器只能搜标题,正文搜不到,跨文档跳转要手动搜
  • 没有"阅读模式" · 导航、按钮、状态栏都在屏幕上,长文阅读容易分神
  • 离线基本不能用 · 出差、路上、没网的环境里几乎看不了
飞书知识库浏览示例
在线浏览多内容、多目录的知识库时,浏览器里需要不停滑动、点击、等待加载。

备份到本地后用 LarkReader 阅读:一个窗口、左目录右正文、附件集中、断网可读、全文可搜。

真实知识库,已经跑过端到端验证

docs/e2e-download-case/ 是那次导出的完整产物,开源在 GitHub 上:

8
顶层节点
38
导出成功
0
失败 / 跳过
4
节点类型
  • 📄 docx 正文 · 导出 Markdown、图片本地化、附件原样
  • 📊 Sheet · 导出 .xlsx
  • 📋 Bitable · 导出 .ndjson + .manifest.json
  • 📎 文件附件 · 18 种扩展名、原样字节下载
扫描模式对比 Auto 模式(仅导出本节点):1 项 FullSpace 模式(展开整个知识库,默认):38 项 ← 本案例 原理 ↗

这不是示意图 —— 这就是 docs/e2e-download-case/ 落盘后的真实目录:断网后用 LarkReader 的「本地阅读」直接打开,目录、排序、图片、附件全部还在。

整棵目录树按飞书层级与排序落盘,编号前缀即子节点树序,zip 后可直接离线浏览整本知识库。

核心特性

专为飞书设计,每一个细节都对齐官方 Open API

节点级精准导出

勾哪个,导哪个

不像"导出整个 Wiki"那种粗暴做法,LarkReader 用树形勾选界面让你精准指定要保留的节点。Doc / Sheet / Bitable / File / Folder 全部支持。

  • 三级树形 + 多选 / 全选 / 反选
  • 类型自动识别(6 色编码)
  • 节点规模自动统计
实时进度

看得见的 8 阶段流水线

从扫树 → 拉取 → 转 Markdown → 下载图片 → 写盘,全程阶段条 + 当前文档 + ETA,不再"假死"。

并发可控

1-32 任务并行

默认 4 并发温和模式;网络好的拉到 16、32 飞起。失败自动重试,进度条不卡。

桌面原生

Tauri · 不依赖云

基于 Tauri 2 + Rust,体积小、启动快。Windows / macOS / Linux 三端原生,无浏览器依赖、无云中转。

数据本地

不经过任何云

所有 token、所有导出文件、所有日志都在你的机器上,没有中间服务器能看你的文档。

应用内更新

新版本一键跟上

设置页一键「检查更新」;下载进度可见、公钥签名校验;Windows 装好自动接管、macOS/Linux 装好自动重启。启动时也会静默提示一次,不打扰。

  • 设置页「检查更新」入口 + 当前版本展示
  • 进度条 + 已下载字节数,可随时取消
  • GitHub Releases 端点 + 内嵌公钥签名校验
3 步上手

不需要教程,启动就能用

1

粘贴飞书链接

支持 Wiki URL 或单篇文档 URL。首次使用走设备码登录飞书账号,凭据由官方 lark-cli 本地托管。

2

勾选要导出的节点

树形界面多选,支持全选 / 反选 / 按类型筛选。右侧实时显示已选数量与类型分布。

3

一键导出

选好本地输出目录,按"开始"即可。进度条、阶段、ETA、当前文档全程可见。完成自动打开目录。

架构简图

一个桌面进程,一条数据流

LarkReader 架构图:飞书 Open API → Tauri 后端(Rust)→ 本地文件系统

飞书 Open Platform 提供 OAuth + 内容 API;Tauri 后端在本地 Rust 进程里完成权限校验、并发调度、Markdown 转换、图片下载与落盘;前端是 Vue 3 + Naive UI 渲染的控制台。

下载 / 安装

三分钟装好,立即可用

系统要求

  • 系统 · Windows 10+ / macOS 11+ / Ubuntu 20.04+
  • 架构 · x86_64 / arm64
  • 运行前提 · 已安装 Node.js 22+(官方 lark-cli 依赖它,cli 本体由应用自动装)
  • 磁盘 · 至少 200 MB 可用空间
  • 网络 · 能访问 open.feishu.cn
  • 账号 · 一个有目标 Wiki / Doc 权限的飞书账号

下载预编译包(推荐)

GitHub Releases 提供 Windows MSI / macOS DMG / Linux AppImage / Linux deb。

从 GitHub Releases 下载

当前版本 v0.1.0 · 2026-09 发布

从源码编译

需要 Rust stable 与 Node 22+:

git clone https://github.com/LPK3215/LarkReader.git
cd LarkReader
npm install
npm run tauri build

产物在 src-tauri/target/release/bundle/

验证安装

启动后看到"LarkReader · 飞书文档导出工具"窗口即成功。

  • 第一步 · Onboarding 检测 4 项环境
  • 第二步 · 扫码登录飞书
  • 第三步 · 选输出目录 → 完成
FAQ

常见问题

LarkReader 是免费的吗?

完全免费、开源、GPL-3.0 协议。你也可以用源码做二次开发(注意 GPL 传染性)。

我的数据会上传到服务器吗?

不会。LarkReader 不提供云服务、不维护服务器、不收集任何使用数据。所有 token、所有导出文件、所有日志都在你自己的机器上。唯一的网络流量是 LarkReader 直接调用飞书 Open API。

支持哪些飞书内容类型?

Doc(旧文档 / 新文档)、Sheet、Bitable、File、Folder。Doc 支持富文本、表格、代码块、图片附件;Sheet 导出 XLSX,Bitable 导出 NDJSON + manifest;File 按原始格式下载到本地。

登录态会自动续期吗?

会的。LarkReader 自动管理 user_access_token,过期前自动用 refresh_token 续命,不需要你每次扫码。

有新版本会自动提醒我吗?

会。每次启动会静默检查一次 GitHub Releases,发现新版就在顶部提示一次(每进程只提示一次,避免打扰);想立刻检查也可以在「设置 → 软件更新」一键启动,下载进度可见,装好后 Windows 自动接管、macOS / Linux 自动重启。

LarkReader 合规吗?会不会绕过飞书的限制?

不会。LarkReader 只通过飞书官方 Open API 与官方 lark-cli,用你自己的授权账号读取你本来就有权限查看的内容,相当于把「在线阅读」变成「本地阅读」。它不破解、不绕过任何权限机制。导出内容的版权归原作者所有,请仅将结果用于个人学习与工作备份,并遵守飞书用户协议及相关法律法规。

怎么反馈 bug / 提需求 / 贡献代码?

请到 GitHub Repo 的 Issues 区提 issue;想动手改源码的可以 fork 后提 PR,详细流程见 CONTRIBUTING.md