集成与部署
四种接入方式 · Docker 一键部署 · 对接任意 RAG 后端与主流向量库
四种接入方式,总有一款适合您
从一行命令到深度集成,按团队技术栈自由选择
命令行 CLI
适合:运维批量处理单条命令完成预处理、切片、评测。支持目录批量、断点续跑,脚本化对接现有数据处理流程。
HTTP API
适合:应用后端集成RESTful 接口覆盖预处理、知识库构建、评测全流程,支持同步/异步、分块上传、SSE 进度推送。
C 动态库 SDK
适合:C/C++/Java 深度集成跨平台 .so/.dylib/.dll + C 头文件,多平台预编译产物,内嵌到您的服务进程,零网络开销。
Python / LangChain
适合:AI 应用与数据团队零依赖 Python SDK + LangChain 连接器,三行代码把企业知识库装进 Document 列表,元数据透传。
有多简单?看代码
从"文件"到"知识库",比您想象的短
部署:从 Docker 到信创机房
标准环境一键起,特殊环境逐项适配
标准部署(Docker)
OCR/版面分析模型(ONNX)随包分发、本地推理;LLM 摘要增强对接内网任意 OpenAI 兼容端点(可选)。功能模块按 feature 裁剪:只用压缩、只用预处理、或全链路,各取所需。
信创环境
支持麒麟/统信操作系统、飞腾/鲲鹏 CPU(arm64 产物齐备)、达梦/人大金仓数据库,可完全离线安装。已在多个信创兼容项目中验证,详见信创兼容方案。
对接您的 AI 技术栈
基座输出标准结构化 JSON 与带元数据的知识点,可对接:
Milvus Qdrant PGVector Elasticsearch LangChain LlamaIndex Dify 任意自研 RAG
SDK 层面另提供 FFI 动态库(libcompressor.so + sdk.h),C/C++/Java/Go 可直接嵌入。详见Rust 压缩 SDK与开发者中心。
从零到跑通,五步走
通常以"天"为单位,而不是"月"
环境准备
提供服务器规格清单,Docker 镜像或离线安装包交付
接入方式选择
按团队技术栈选定 CLI / API / SDK,半天出首个测试请求
试点文档跑通
拿一批真实文档全链路入库,出解析质检与清洗报告
策略调优
按文档类型选择切片预设,与您共建行业评测集
正式上线
对接向量库与业务系统,评测仪表盘持续监控