groupultra/telegram-search

🔍 导出并模糊搜索 Telegram 聊天记录 | Export and fuzzy search your Telegram chat history

解决的问题

Telegram 原生搜索功能存在局限性,尤其对中文用户或在庞大聊天记录中难以定位特定消息的用户而言。本项目提供一种备份个人 Telegram 消息并使用向量搜索和 AI 驱动的摘要技术进行搜索的方法,以更准确、更快速地查找信息。

工作原理

系统将 Telegram 聊天记录导出并备份到数据库(PGlite 或 PostgreSQL)。通过分词处理并生成向量嵌入,使工具能够执行基于关键词的模糊匹配和语义向量搜索。同时支持图像嵌入,实现文本到图像的搜索,并与大语言模型集成,提供基于 RAG(检索增强生成)的智能问答和未读消息的智能摘要。

适用人群

希望拥有功能强大、可自托管的 Telegram 对话归档,并具备高级搜索能力的用户,以及希望使用 AI 对聊天记录进行摘要或基于自身消息数据提问的用户。

主要亮点

  • 混合搜索:结合智能分词、模糊匹配和向量语义搜索,实现高精度检索。
  • AI 驱动功能:包含基于 RAG 的智能问答和未读消息的自动摘要。
  • 多模态搜索:支持图像嵌入,实现通过文本搜索图像。
  • 灵活部署:提供 TypeScript CLI 用于本地优先管理,Docker Compose 用于全栈部署,以及浏览器模式。
  • 自动备份:自动将媒体资源备份至 MinIO 对象存储,并实时同步新对话。

相关

  • 项目
  • 项目
  • 项目
  • 项目