chatlens 怎么搜聊天记录 本地导出全文检索
chatlens 怎么搜聊天记录:单 HTML 本地打开,拖 ChatGPT/Claude 导出建索引,支持全文/正则/时间线,数据不上传。

chatlens 怎么搜聊天记录:把 ChatGPT 或 Claude 官方 export 拖进浏览器里的单文件 index.html,在本地 Web Worker 建倒排索引,全文搜索、时间线与阅读视图都在本机完成,不上传、不调用 LLM。
获取与打开方式
项目:david-g-3654/chatlens(Show HN 2026-08-13)。产物是无构建步骤的单 HTML,无 npm 依赖。
两种打开法:双击 index.html(可离线 file://);或 python3 -m http.server 后访问打印的 URL,也可丢 GitHub Pages / Netlify。首次可点 Explore with sample data 用内置合成数据试 UI,无需 export。
隐私架构:无 backend、无网络请求。断开网络或清空 Network 面板仍可用;刷新 tab 数据即清空。这与把 export 扔给第三方 SaaS 相反,适合含代码片段、内部项目名的历史。
加载 ChatGPT / Claude 导出
chatlens 自动识别三种形态:
- 单个
conversations.json(ChatGPT/Claude 标准 export 解压后) - 每会话一个
.json的文件夹(部分 ChatGPT 分包 export),拖整个文件夹 - 多选多个
.json一次导入
获取路径:ChatGPT → Settings → Data controls → Export data → 邮件 zip;Claude → Settings → Privacy → Export data → unzip。工具会沿 active branch 重建 canonical thread, regenerated 分支不计入统计,避免重复计数。
导入后后台 Worker 索引,主线程 UI 不卡;进度条显示 one-time index 耗时。README 在 M 系笔记本 Chrome 上测得:30MB 真实 export(222 会话、4362 消息)索引约 1.9s,搜索 6–15ms。100k 消息量级索引约 13s,搜索仍约 120ms,符合「个人史」而非档案库定位。
Dark mode 默认偏暖,适合夜间读长对话;从 Insights 跳到 Reader 再回搜索,索引常驻内存直到关 tab。若 export 里混有 Claude 与 ChatGPT 两种 json,chatlens 会分别解析,Insights 的 model 统计能反映你实际常用哪条产品线。
搜索与时间线怎么用
全文搜索为浏览器内倒排索引:
- 多词 AND:所有词都出现才命中
"引号"精确短语/regex/正则,如/colou?r/- 可按「你」或「AI」过滤,点结果跳进 Reader
Timeline 给按月消息量与日×小时热力图;Insights 汇总总词数、最忙日、峰值小时、常用模型、最长会话等。Reader 用轻量 Markdown 渲染代码块、列表、链接,并标每消息模型名。
若你同时在多个 agent CLI 里跑任务,chatlens 只读聊天 export,不索引 Claude Code CLI 基础 那种本地 session 文件;后者可走 agent-hop 跨工具续会话 搜索。工作流文档类重复提问,仍适合用 Skills 和 MCP 有什么区别 里说的 skill 固化,而不是靠搜旧聊天记录复制粘贴。
正则 /error|exception/i 适合挖历史踩坑;多词 AND 搜索适合缩小范围。过滤「you」可只看自己 prompt,排查「我什么时候改过这条规则」类问题。
性能上限与 honest ceiling
README 写明:面向个人史(数千到约 10 万消息),不是多账号共享归档。超过约 10 万消息或数百 MB,索引可能到数十秒,内存随文本线性涨(索引保留小写副本,峰值 RAM 约为文件若干倍)。低内存设备上超大 export 可能 memory-bound。
搜索侧即使命中数万条消息,查询仍常在四分之一秒内;瓶颈在首次 index 而非检索。部分 file:// 环境若浏览器阻止 Blob Worker,会回退主线程解析,大文件时 UI 可能短暂卡顿,改用 http.server 通常更稳。
Insights 页的「 busiest day / peak hour」适合复盘自己何时最依赖 AI;Timeline 热力图能暴露「深夜堆会话」的习惯,对团队规范写 prompt 也有参考。Reader 里跳转到某条消息后,浏览器后退仍留在本地数据,不会丢索引,但刷新页面需重新拖 export。
若 export 含 regenerated 分支,chatlens 只展示 active branch,计数会比 ChatGPT 网页上看到的「所有尝试版」少,这是设计选择而非 bug。多文件 import 时建议先合并同一 provider 的 zip,避免重复会话 id 导致 Insights 重复计数。
Show HN 2026-08-13 帖强调 single HTML 可 audit:右键查看源代码即可确认无外链 tracker。团队合规可把这个文件 pin 到固定版本 hash,升级前 diff 一遍 JS。与 agent-hop 跨工具续会话 互补:hop 找 CLI session,chatlens 找 ChatGPT/Claude 网页 export。
Light/dark 主题默认偏阅读向;从 Insights 点最长会话进 Reader,适合整理「当年架构讨论」笔记。导出前在 ChatGPT/Claude 设置里选 unzip 后单文件或文件夹,chatlens 都能吃,不必手工合并 JSON。
MIT 单文件可 fork 内网版,加公司 logo 或默认 dark 模式都行;升级时保留旧 hash 供合规对比。搜索无 cloud 备份,换电脑记得重新拖 export。
常见问题
chatlens 会继续对话吗?
不会。Non-goals 明确:无 cloud、无 LLM call、无「continue this chat」。它只读已有 export,理解与展示,不连任何模型 API。
和官方 App 内搜索比优势在哪?
官方客户端往往缺少跨会话全文检索与统计视图。chatlens 把 export 变成可检索档案,适合「去年三月问过某配置」这类只记得关键词的场景。敏感团队可内网静态托管单 HTML,比上传第三方更可控;日常 IDE 协作仍见 Cursor 新手完全指南。
导出文件很大时会怎样?
超过 README honest ceiling(约 10 万消息)后,索引时间进入数十秒级,低 RAM 设备可能 OOM。策略是按月拆分 export、或先删无关会话再导。搜索本身仍快,慢的是首次 load;换浏览器 tab 就要重新索引,没有持久化缓存。移动端浏览器内存更紧,大 export 建议在桌面 Chrome 处理。