groupultra/telegram-search
🔍 导出并模糊搜索 Telegram 聊天记录 | Export and fuzzy search your Telegram chat history
解决的问题
Telegram 原生搜索功能存在局限性,尤其对中文用户或在庞大聊天记录中难以定位特定消息的用户而言。本项目提供一种备份个人 Telegram 消息并使用向量搜索和 AI 驱动的摘要技术进行搜索的方法,以更准确、更快速地查找信息。
工作原理
系统将 Telegram 聊天记录导出并备份到数据库(PGlite 或 PostgreSQL)。通过分词处理并生成向量嵌入,使工具能够执行基于关键词的模糊匹配和语义向量搜索。同时支持图像嵌入,实现文本到图像的搜索,并与大语言模型集成,提供基于 RAG(检索增强生成)的智能问答和未读消息的智能摘要。
适用人群
希望拥有功能强大、可自托管的 Telegram 对话归档,并具备高级搜索能力的用户,以及希望使用 AI 对聊天记录进行摘要或基于自身消息数据提问的用户。
主要亮点
- 混合搜索:结合智能分词、模糊匹配和向量语义搜索,实现高精度检索。
- AI 驱动功能:包含基于 RAG 的智能问答和未读消息的自动摘要。
- 多模态搜索:支持图像嵌入,实现通过文本搜索图像。
- 灵活部署:提供 TypeScript CLI 用于本地优先管理,Docker Compose 用于全栈部署,以及浏览器模式。
- 自动备份:自动将媒体资源备份至 MinIO 对象存储,并实时同步新对话。
相关
- 项目
- 项目
- 项目
- 项目