Token导航 LogoToken导航TokenDH.com
Document Ingestion Router logo
文档知识未说明官方级别未说明来源级核验

Document Ingestion Router

MCP Server

该服务是一个智能文档处理平台,提供文档分类、内容提取和TriSearch™索引功能,适用于企业级文档管理。

工具数

0

提示词数

0

GitHub Stars

0

资源数

0
Python内容提取文档处理

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

作者 / 组织

derekbmoore

提供方

derekbmoore

最后核验

2026/5/17 20:21

快速接入

先看主来源和安装命令,再打开仓库或文档;下面只保留这个条目的关键接入事实。

详细介绍

文件摄入路由器

用于智能文档摄取、分类和TriSearch™索引的MCP服务器。

![License: MIT](https://opensource.org/licenses/MIT) ![NIST AI RMF](https://www.nist.gov/artificial-intelligence/risk-management-framework) ![FedRAMP High](https://www.fedramp.gov/)

部分 上下文生态学(ctxEco) 平台by Zimax Networks LC\ 开源(MIT)·Azure Marketplace商业支持的MCP服务器

______________________________________________________________________

它的作用

文件摄取路由器按以下方式对文件进行分类 真值,通过专门的提取引擎对其进行路由,并通过以下方式对其进行索引 TriSearch™ --关键字、向量和图知识搜索的融合。

分类系统

类别真值引擎衰减率示例
A.不变的真理IBM文档0.01PDF、手册、规范、标准
B短暂流非结构化.io0.50电子邮件、幻灯片、文档、维基
C操作脉冲Pandas0.90CSV、JSON、日志、遥测

16个企业连接器

类别连接器
云存储AWS S3、Azure Blob、谷歌云存储
协作SharePoint、谷歌云端硬盘、OneDrive、Confluence
票务ServiceNow、Jira、GitHub
消息Slack、微软团队、电子邮件(EML/MSG)
数据与集成数据库(SQL/NoSQL),Webhooks
本地直接文件上传

TriSearch™

  • 关键词:PostgreSQL全文搜索(tsvector/tsquery)
  • 矢量: pgvector Azure OpenAI嵌入的余弦相似性
  • 图形知识(Gk):实体提取→ 属性图→ 遍历查询

______________________________________________________________________

建筑

┌─────────────────────────────────────────────────────┐
│                   MCP Server (API)                   │
│  ┌─────────┐  ┌──────────┐  ┌────────────────────┐ │
│  │ Classify │→ │ Extract  │→ │ Index (TriSearch™) │ │
│  │ A / B / C│  │ Engine   │  │ KW + Vec + Graph   │ │
│  └─────────┘  └──────────┘  └────────────────────┘ │
├─────────────────────────────────────────────────────┤
│  16 Connectors │ Temporal Workflows │ Zep Memory    │
├─────────────────────────────────────────────────────┤
│  PostgreSQL + pgvector │ NIST AI RMF │ FedRAMP High │
└─────────────────────────────────────────────────────┘

______________________________________________________________________

安全

路由器实现了 纵深防御 安全模型与 NIST AI RMFFedRAMP高.

  1. 4层上下文:

- 用户身份 (OIDC+RBAC) - 租户隔离 (数据隔离) - 项目范围 (可选隔离) - ACL组 (基于团队的访问)

  1. 资源访问策略(RAP):

- 对所有资源(文档、块、图)进行统一的SQL级过滤。 - 访问级别: private, team, project, tenant.

  1. 审计日志:

- 所有访问事件的结构化JSON日志(resource.ingest, graph.query). - 通过中间件自动捕获请求上下文。

______________________________________________________________________

快速开始

# Clone
git clone https://github.com/derekbmoore/documentIngestionRouter.git
cd documentIngestionRouter

# Configure
cp .env.example .env
# Edit .env with your Azure OpenAI credentials

# Launch
docker compose up -d

# Access
# API:       http://localhost:8082
# Dashboard: http://localhost:3000
# Temporal:  http://localhost:8088

______________________________________________________________________

遵从

  • NIST AI RMF:地图1.5(边界)、管理2.3(数据治理)、措施2.1(数据质量)、治理1.1(政策)
  • FedRAMP高:静态加密(AES-256)、TLS 1.3、审计日志记录、FIPS 140-2模块支持
  • 美国国家标准学会标准800-60:敏感性分类(高/中/低影响)

______________________________________________________________________

许可证

麻省理工学院——见 许可证

商业支持 可用的 Zimax Networks LC 通过Azure市场。

目录标签

目录标签

Python内容提取文档处理文档分类本地部署TriSearch索引企业级文档管理多引擎处理

接入字段

传输方式(transport,传输协议)

未说明

鉴权方式(authType,认证方式)

none

工具数量(toolCount,工具数)

0

资源数量(resourceCount,资源数)

0

提示词数量(promptCount,提示词数)

0

权限和风险

未说明none部署方式未说明

接入前请确认传输方式、认证方式和部署位置,并根据实际工具能力限制访问范围。

安装前确认

不要直接授予不必要的文件、网络或账号权限;先核对安装命令和配置内容。

仍需确认:installCommand

来源信息

继续浏览同类 MCP