从文件搜索到 AI 问答,从知识库管理到语音输入,覆盖文档处理全流程
基于高性能索引引擎,支持 Word、PDF、Excel、TXT 等 12+ 常见格式的毫秒级全文搜索。提供字段限定搜索(按文件名、作者、修改者)、精确匹配、多关键词逻辑组合等高级搜索语法。
基于检索增强生成技术,AI 结合您的知识库文档内容回答提问。支持流式逐字实时显示、多轮对话上下文记忆、引用标注与来源追溯,回答质量有据可依。
支持创建多个独立知识库,每个知识库可绑定不同文件目录、配置专属的分割策略、向量化参数和 OCR 识别方式。支持文件实时监控与增量索引更新,无需手动刷新。
意图分析 → 关键词检索 (BM25) → 语义向量检索 → 联网搜索 → 加权融合排序 → 智能重排序 (Reranker)。全流程自动完成,确保最相关的内容用于生成回答。
支持本地离线语音识别和云端语音识别大模型双策略,实时录音转文字输入。在搜索和对话场景中快速录入长文本,支持识别结果编辑修正后插入。
内置流式安全审核引擎,支持自定义敏感词表(字面词+正则表达式)。AI 回答展示前自动安全检查,命中敏感词可配置替换或拦截,所有命中记录写入审计日志。
融合关键词匹配与语义理解,兼顾精确检索与智能问答
关键词检索 (BM25) 确保精确匹配,语义向量搜索捕获深层语义,智能重排序 (Reranker) 精细筛选。三路融合兼顾查全率与查准率,检索质量远超单一方案。
核心数据不上云 — 本地 LLM + 本地向量化 + SQLite 全链路离线运行。文件内容、对话记录、索引数据全部存储于本地,无需互联网连接即可使用全部核心功能。
统一接口支持三种 AI 后端即插即用:本地 llama.cpp(数据完全本地)、OpenAI 兼容协议(vLLM / 自定义 API)、Anthropic Claude API。根据需求灵活切换,无需修改工作流。
通过影子会话预判问题类型与检索需求,在不污染主对话上下文的前提下自动判断是否需要检索知识库、联网搜索或直接回答。支持中/英多语言和日期时间语义解析。
字面词流式打码与正则统一过滤,支持热重载词表,审计日志可追溯。后处理重组连续引用编号,仅列被引来源,有效防止 AI 幻觉,确保回答可信可查。
系统托盘后台运行、深色/浅色主题自动切换、HiDPI 高分辨率适配、语音输入、会话持久化存储 (SQLite)、文件实时监控与增量索引、可配置的防抖机制与网络代理。
无论您是注重隐私的个人用户,还是需要云端算力的企业客户,都能找到适合的方案
基于 llama.cpp server,所有数据和推理均在本地计算机完成,无需互联网连接。适合对数据隐私有严格要求的用户。
连接任何兼容 OpenAI API 格式的服务,包括自建 vLLM、各类云端 API 代理。灵活配置 API 端点和密钥。
连接 Anthropic 的 Claude 系列模型服务,享受前沿 AI 能力。需 Anthropic API 密钥。
无论您是研究人员、企业员工还是法律从业者,都能助您高效管理文档
管理海量 PDF 论文、电子书和笔记。通过字段限定搜索快速定位特定学者的论文,使用 AI 问答抽屉针对论文内容直接提问——"本文的主要贡献是什么?""实验方法是什么?"
为不同部门或项目创建独立知识库,将公司共享文件夹(NAS 或文件服务器目录)添加为知识库目录。基于企业内部文档回答业务问题——"上个季度的销售数据总结""项目验收标准是什么"。
为不同案件或合同类型创建独立知识库,在系统提示词中设定 AI 角色为"法律顾问",使用固定句子分割策略精确定位每一条款。涉及机密文件时使用本地 AI 推理服务。
深色/浅色主题自动适配,分区布局清晰直观,支持 HiDPI 高分辨率显示
主界面截图 - screenshot.png
左侧文件列表 + 右侧内容预览 + AI 问答抽屉面板
知识库管理界面(示意图)
智能问答界面(示意图)
系统设置界面(示意图)