谛听万物 · 智答未来
基于 RAG 检索增强生成与 AI Agent 的企业级智能知识平台。
混合检索、四级证据评估、引用溯源 —— 让每一次提问都有据可查。
根据 《2024 年度经营报告》,华东区实现营收 4.2 亿元,占总营收的 38.6%,同比增长 12.3%……▌
一套知识引擎,两种使用形态
网页版 RAG 平台,零部署即刻使用,支持在线知识库管理和智能对话。
桌面客户端,本地运行保障数据安全,支持离线使用和本地硬件加速。
区别于市面 RAG 方案的自研引擎能力
LLM 自动分析意图,动态选择 DIRECT 直接检索、REWRITE 重写优化或 DECOMPOSE 拆解并行策略,复杂问题拆为子问题并行检索后汇总。
PGVector 语义检索 + ES BM25 关键词检索,RRF 融合排序,再经类簇聚合与邻居窗口扩展,补全跨片段上下文。
生成前门控评估证据:NONE / WEAK 主动拒答,PARTIAL 区分回答,SUFFICIENT 正常生成并引用溯源,拒绝一本正经地胡说。
图执行引擎驱动「思考 → 工具调用 → 生成回复」,CHAT / KB_SEARCH 双模式同会话动态切换,SSE 流式逐字输出。
会话记忆 → 紧凑摘要 → 运行时截断三级渐进压缩,在有限上下文窗口内最大化保留长对话连贯性。
RBAC 权限 + 群组级数据隔离,RSA/AES 动态接口加密,字段级加解密(AES/RSA/SM2/SM4),操作全程留痕。
从文档上传到引用溯源的完整闭环
分片上传 · 断点续传 · 秒传检测 · SHA-256 校验
→Tika 解析 → 清洗 → 结构感知切片(500/800/80 tokens)
→LLM 分析意图,DIRECT / REWRITE / DECOMPOSE 自动选路
→语义 + 关键词双通道 → RRF 融合 → 类簇聚合 → 邻居扩展
→四级证据充分度门控,证据不足时主动拒答
→SSE 流式输出,附带引用片段、来源文档与相关性评分
Java 企业级全栈,成熟稳定的选型
对比 LangChain / LlamaIndex / Dify / FastGPT 等方案