710服务器 Hermes AI 企业知识库部署记录
项目简介
这几天在家庭服务器环境中完成 Hermes AI Agent 部署,实现 Seafile 企业资料库接入、RAG知识库构建、多模型API调用以及飞书机器人远程访问。
目前系统已经完成第一阶段:从“普通NAS服务器”升级为具备私有知识库能力的AI服务器。
整体架构
| 模块 | 技术方案 |
|---|---|
| 宿主环境 | 家庭NAS + PVE虚拟化 |
| AI服务器 | Ubuntu 710 |
| AI框架 | Hermes Agent |
| 文件系统 | Seafile |
| 向量数据库 | ChromaDB |
| Embedding模型 | BAAI/bge-base-zh-v1.5 |
| 入口 | 飞书机器人 |
| 大模型 | SenseNova / Agnes / DeepSeek |
整体数据流:
Seafile资料 → 文件扫描 → 文档解析 → Chunk切片 → Embedding向量化 → Chroma知识库 → RAG检索 → AI生成回答 → 飞书返回
Seafile知识库建设
目前已经完成企业资料AI化流程:
| 功能 | 状态 |
|---|---|
| Seafile API连接 | ✅ |
| 文件扫描 | ✅ |
| Word/TXT解析 | ✅ |
| 文本切片 | ✅ |
| Embedding生成 | ✅ |
| Chroma入库 | ✅ |
| RAG检索 | ✅ |
当前知识库规模:
Chroma知识库数量:26
测试资料包括:
- 天然橡胶产品质量管理文件
- 天然浓缩乳胶资料
- 企业管理资料
AI模型池设计
采用多模型自动切换架构:
| 优先级 | 平台 | Base URL | Model |
|---|---|---|---|
| 1 | SenseNova 日日新 | https://token.sensenova.cn/v1 | sensenova-6.7-flash-lite |
| 2 | Agnes | https://api.agnes-ai.cn/v1 | agnes-2.5-flash |
| 3 | DeepSeek | https://api.deepseek.com | deepseek-v4-flash |
调用逻辑:
用户提问 → 知识库检索 → SenseNova回答 → 失败切换Agnes → 失败切换DeepSeek
三个API均已完成:
- Models接口测试
- Chat接口测试
- RAG实际调用测试
Hermes核心目录
当前生产目录:
| 路径 | 功能 |
|---|---|
| /opt/hermes-ai/.env | API及环境配置 |
| seafile_scanner.py | Seafile文件扫描 |
| document_parser.py | 文档解析 |
| text_chunker.py | 文本切片 |
| embed_generator.py | 向量生成 |
| kb_search.py | 知识库搜索 |
| rag_chat.py | RAG问答核心 |
飞书接入测试
目前已经完成飞书机器人接入。
测试问题:
天然橡胶浓缩乳胶生产流程是什么?
系统能够自动完成:
飞书提问 → Hermes接收 → Chroma检索资料 → 调用AI模型 → 返回答案
测试结果:
成功返回生产流程、工艺步骤、质量要求,并显示参考来源。
当前运行状态
710服务器目前已经具备:
| 能力 | 状态 |
|---|---|
| 私有AI环境 | ✅ |
| 企业知识库 | ✅ |
| RAG问答 | ✅ |
| 多模型备用 | ✅ |
| 飞书访问 | ✅ |
| Seafile资料读取 | ✅ |
当前优化方向
目前系统已经可以使用,但距离生产级还有几个优化点:
| 问题 | 解决方向 |
|---|---|
| Embedding首次加载慢 | 模型本地缓存、常驻进程 |
| 当前手动启动 | systemd服务化 |
| 知识库更新 | Seafile增量同步 |
| 数据规模扩大 | 多知识库管理 |
| 企业使用 | 用户权限隔离 |
下一阶段目标
下一步重点不是增加功能,而是提升稳定性:
- Hermes后台服务化,开机自动运行;
- 优化Embedding加载速度;
- 完成Seafile增量同步;
- 完善飞书长期使用体验;
- 建立企业级AI知识管理体系。
总结
经过几天测试,710服务器已经完成从:
家庭服务器
到:
私有化AI知识库服务器
的升级。
目前已经实现:
自己的服务器 + 自己的数据 + 自己的AI模型调用 + 自己的知识库
下一阶段目标:
让这个系统真正成为日常工作中的AI助手。