让每一份数据,都成为企业的知识资产

企业级智能知识管理平台 · 数据集成 · 文档管理 · 元数据资产 · BI 检索 · AI 问答 · 智能出题 · 权限审计 · SaaS/私有化双模部署

🔗

数据集成

📁

文档管理

🏗️

元数据资产

🔍

BI 智能检索

🤖

AI 问答

📝

智能出题

核心功能总览

企业端 9 大功能模块全覆盖,从数据集成到 AI 智能出题,一站式企业知识管理

🔗

① 结构化数据管理

DataX 可视化数据同步,5 步向导式配置任务。支持 MySQL / PostgreSQL / Oracle / SQL Server / ClickHouse 等多种数据源。全量/增量同步,Cron 定时调度,字段类型自动映射,目标端自动建表。

📁

② 非结构化数据管理

支持 30+ 文件格式上传(PDF/Word/Excel/PPT/图片/代码),自动深度解析 + 智能切片。版本管理、MD5 去重、目录树组织。网页内容一键抓取,票据管理(发票/凭证/收据 AI 字段提取)。

🏗️

③ 数据目录资产管理

结构化元数据:自动采集数据库 Schema(表/字段/注释/主键/索引),AI 语义标注(别名/业务描述/相似词),变动检测,审核版本,Excel 批量导入导出。非结构化元数据:文件自动标签、AI 摘要与大纲提取。

📐

④ 数据语义指标管理

业务指标定义与配置,技术字段 → 业务语义映射。支持维度 + 度量灵活建模,聚合计算引擎(SUM/AVG/COUNT/MAX/MIN),时间维度下钻(年/季/月/周/日),指标分类管理与血缘追溯。

🔍

⑤ BI 数据智能检索

自然语言提问 → AI 意图识别 → 指标匹配 → SQL 生成 → 自动执行查询。NL2SQL 思维链 Prompt 引擎,列别名智能映射,时间词自动注入("本月"/"去年"→具体日期)。ECharts 图表自动构建,看板 AI 规划,Word 一键导出。

🤖

⑥ 智能问答中心

RAG 增强 AI 对话:向量语义 + BM25 关键词双引擎检索,RRF 融合算法排序。支持 Text-to-SQL 自然语言查库,资源范围检索(数据源/文件目录/题库目录)。多轮会话管理,点赞反馈样本标注,问答 Word/PDF/Excel 导出。

📝

⑦ AI 题库中心

基于知识库文档 AI 智能出题(单选/多选/判断/简答)。支持指定目录、大纲筛选、难度调节、批量生成(1-5000 题)。题库目录树管理,智能组卷,试卷发布,在线考试,错题集自动收集,成绩报表导出。

📈

⑧ 平台分析中心

企业级数据大屏可视化。核心数据实时统计(文件数/笔记数/问答数/用户活跃度),ECharts 多图表展示(饼图/柱状图/折线图),支持按时间段筛选,投屏展示友好(自适应分辨率)。

🛡️

⑨ 权限与审计

RBAC 5 角色权限体系(超管/企业管理员/部门账号/终端用户/个人账号),功能模块 + 数据目录双权限控制。全量操作日志记录(IP 追溯、UA 设备解析、敏感参数自动脱敏),登录日志追踪,90 天自动清理。企业管理:部门管理、员工账号、AI 授权共享。

产品优势

01

轻量化部署

Python Flask 单体应用 + Redis + MySQL,安装包 < 200MB,10分钟完成部署

02

SaaS / 私有化双模式

支持多租户 SaaS 模式与单企业私有化部署,一键配置切换,无需改代码

03

安全合规

JWT 认证 · API Key 加密存储 · 密码脱敏 · 操作全量审计 · IP 追溯 · 端隔离

04

AI 多模型兼容

支持 DeepSeek / 通义千问 / OpenAI 兼容接口,一键切换,额度管理,成本可控

适用行业 & 场景

📊 金融 / 保险

合规文档检索 · 保单知识库 · 监管政策问答

🏭 制造业

设备手册管理 · SOP 标准化 · 质检规范检索

🏥 医疗 / 医药

药品说明书检索 · 临床指南 · 病例知识库

🎓 教育 / 培训

智能出题 · 题库管理 · 知识点检索 · 在线考试

⚖️ 法律 / 咨询

法规库检索 · 案例匹配 · 合同条款智能问答

🏢 企业通用

内部知识库 · 员工手册 · 技术文档 · 数据资产管理

核心技术亮点

自研多项核心算法与引擎,支撑企业级知识管理全链路

🔀

Qdrant 向量检索引擎 + RRF 融合

以 Qdrant 为核心向量数据库,结合 ChromaDB 辅助存储。并发锁保护,本地存储冲突自动重试。向量语义检索 + BM25 关键词检索双路并行,RRF(Reciprocal Rank Fusion)算法融合排序,k=60 参数调优。

🧩

多模型 AI 统一适配

OpenAI 兼容适配器统一接入 DeepSeek / 通义千问 / Anthropic / Gemini 等多平台。支持 chat / vision / file 三种模型类型,按优先级自动回退(vision→chat→file)。流式 SSE 输出,额度管理,成本可控。

📑

智能文档解析引擎

PDF 三级降级策略:pdfplumber 文本提取 → PyPDF2 回退 → OCR 图片识别。支持 30+ 格式深度解析。AI 视觉模型分析图片内容,多级大纲自动提取。乱码检测算法自动判断解析质量。

🧠

Multi-Agent 协作生成

长文结构化生成流水线:提问拆解 Agent → 大纲规划 Agent → 批判审查 Agent → 内容撰写 Agent(多章节并行)→ 审核校对 Agent → 协调合并 Agent。防编造校验,重复段落检测。

✂️

智能切片算法

自然段落边界识别 + 代码定义行检测(支持 Python/JS/Java/Go/Rust/SQL 等)。大纲层级感知切分,标题路径拼接(如"第一章 > 1.1 概述")。500 字/片 + 150 字重叠滑动窗口,保证语义连续性。

异步任务调度引擎

TaskQueue 后台调度,ThreadPoolExecutor 隔离执行。600s 超时保护,启动自动恢复 pending 任务。支持任务类型注册制(出题/向量嵌入/元数据采集/文件解析等),进度实时可查。

产品整体架构

经典分层架构,高内聚低耦合,支撑企业级知识管理全场景

前端展示层
企业端 / 个人端 / 管理后台 Vue 2.6 + Element UI ECharts 数据大屏
↓ API Gateway
API 服务层
Flask RESTful API JWT 认证鉴权 权限装饰器拦截 操作日志全局钩子
↓ Service / Repository
业务逻辑层
Controller → Service → Repository 三层分层 AI 调度器(多平台多模型) 元数据采集引擎 出题任务队列
↓ Data
数据存储层
MySQL 9.7 主库 Qdrant 向量库 Redis 缓存队列 本地文件系统

企业端 vs 个人端

两套独立端口,数据完全隔离,满足不同场景需求

功能模块 🏢 企业端(旗舰版) 👤 个人端(个人版)
首页仪表盘 ✅ 9 模块快捷入口 + 数据统计 ✅ 6 模块快捷入口 + 数据统计
非结构化数据管理 ✅ 文件上传/解析/版本 + 笔记编辑 + 网页抓取
🔖 票据管理(发票/凭证/收据)
✅ 文件上传/解析/版本 + 笔记编辑 + 网页抓取
数据目录资产管理 ✅ 结构化 + 非结构化元数据
🤖 AI标注 · 批量采集 · 审核版本 · Excel导入导出
✅ 元数据查看 · 目录检索
数据集成 ✅ DataX 可视化数据同步
⚙️ MySQL/PostgreSQL/Oracle/SQL Server 等
BI 智能检索 ✅ 自然语言查数据 + NL2SQL
📊 ECharts图表 · 看板规划 · Word导出 · 指标管理
智能问答中心 ✅ RAG 增强问答 + Text-to-SQL
🔀 双引擎混合检索 · RRF融合 · Text-to-SQL查库
✅ RAG 增强问答
🔍 个人知识库检索 · 资源范围限定
AI 题库中心 ✅ 智能出题 + 组卷 + 发布 + 考试 ✅ 智能出题 + 组卷 + 练习答题
平台分析中心 ✅ 企业级数据大屏(ECharts可视化) ✅ 个人数据统计
企业管理 ✅ 部门管理 · 员工账号 · AI授权共享
👥 5角色RBAC · 终端用户数据白名单
权限与审计 ✅ 角色权限 + 操作日志 + 登录日志
🛡️ IP追溯 · 参数脱敏 · 90天自动清理
系统配置 ✅ AI模型管理 · 数据库配置 · 部署模式切换 ✅ AI 模型绑定 · 个人信息 · 密码修改