|
|
3b82103e87
|
添加XML回退解析机制支持复杂Excel文件
当pandas无法解析某些包含非标准元素的Excel文件时,
添加了XML直接解析功能来提取工作表名称和数据。
- 实现了`_extract_sheet_names_from_xml`方法从XML提取工作表名称
- 实现了`_read_excel_sheet_xml`方法直接解析Excel XML数据
- 添加多种命名空间支持以处理不同Excel格式
- 在pandas解析失败时自动回退到XML解析方式
fix(excel-storage-service): 修复XML解析中的命名空间问题
改进了XML解析逻辑,添加对多种命名空间的支持,
使用通配符查找元素以兼容不同Excel文件格式。
refactor(table-rag-service): 优化XML解析逻辑提高兼容性
统一了XML解析的命名空间处理方式,
改进了元素查找逻辑以更好地支持不同Excel格式。
feat(frontend): 添加RAG向量检索和索引重建功能
- 实现了RAG状态查看、搜索和索引重建接口
- 添加了前端RAG检索界面组件
- 增加了错误处理和加载状态提示
|
2026-04-08 19:21:40 +08:00 |
|
|
|
ec4759512d
|
```
feat(database): 为MySQL服务添加text函数导入支持
添加了SQLAlchemy的text函数导入,用于支持原始SQL查询操作,
增强数据库交互的灵活性和兼容性。
---
feat(excel): 改进Excel存储服务的列名处理机制
优化了列名清理逻辑,支持UTF8编码包括中文字符,实现唯一列名
生成机制,防止列名冲突。同时切换到pymysql直接插入方式,
提升批量数据插入性能并解决SQLAlchemy异步问题。
---
fix(rag): 改进RAG服务嵌入模型加载策略
当嵌入模型加载失败时,采用更稳健的降级策略,使用简化模式
运行RAG服务而非完全失败,确保系统核心功能可用性。
```
|
2026-04-02 03:39:00 +08:00 |
|
|
|
8e1ddb8aff
|
```
feat(config): 添加RAG/Embedding配置选项
- 新增EMBEDDING_MODEL配置项,默认值为"all-MiniLM-L6-v2"
- 用于支持RAG服务的嵌入模型配置
feat(database): 增强MySQL数据库初始化功能
- 实现数据库自动创建功能,若数据库不存在则自动创建
- 使用临时连接在不指定数据库的情况下执行CREATE DATABASE语句
- 支持utf8mb4字符集和排序规则设置
refactor(excel): 优化Excel表创建逻辑
- 将表创建方式从ORM模型改为原生SQL语句
- 提高异步操作的兼容性
- 增加自动时间戳字段(created_at, updated_at)
feat(rag): 增强RAG服务嵌入模型错误处理
- 添加嵌入模型加载异常处理机制
- 当配置的模型加载失败时自动回退到默认模型
- 改进日志记录,提供更详细的初始化信息
```
|
2026-04-02 02:42:03 +08:00 |
|
|
|
c122f1d63b
|
完善后端日志
|
2026-03-30 21:24:13 +08:00 |
|
|
|
332f0f636d
|
完善前端页面
|
2026-03-27 02:55:06 +08:00 |
|
|
|
4e178477fe
|
更新后端
|
2026-03-27 01:40:48 +08:00 |
|
|
|
7c88da9ab1
|
完善数据库调用
|
2026-03-27 00:06:17 +08:00 |
|
|
|
6b88e971e8
|
后端完成异步和rag设置
|
2026-03-26 23:41:03 +08:00 |
|
|
|
5bcad4a5fa
|
添加其他格式文档的解析
|
2026-03-26 23:14:39 +08:00 |
|
|
|
4bdc3f9707
|
完成后端数据库连接配置
|
2026-03-26 19:49:40 +08:00 |
|
|
|
2f630695ff
|
前后端基本架构和完全excel表的解析及统计图表的生成以及excel表的到出
|
2026-03-19 01:51:34 +08:00 |
|