返回 AI 工具目录
Infinity
自托管组件人工精选最近核验 2026年7月23日
Infinity 是 InfiniFlow 团队(与 RAGFlow 同源)开源的 AI 原生数据库,面向 LLM 应用的检索场景。它在单一系统内统一支持稠密向量、稀疏向量、张量(多向量)与全文四类检索,并可组合成混合检索,配合过滤与重排(RRF、加权求和、ColBERT),服务于 RAG、搜索、推荐与问答。官方称在百万级向量数据集上可达约 0.1 毫秒查询延迟与万级 QPS。以 C++ 为核心,提供 Python SDK 与 HTTP 接口,支持单二进制或 Docker 自托管且无外部依赖。Apache 2.0 许可,持续更新。
定价开源部署自托管、本地运行国内可达国内可达许可Apache-2.0
解决什么问题
- 在一套系统内同时做向量、稀疏向量、张量与全文检索
- 用混合检索加过滤与重排提升 RAG 召回质量
- 避免向量库与全文引擎分开维护的架构复杂度
- 面向百万级数据的低延迟、高并发查询
适合
- 需要向量与全文混合检索的 RAG 与知识库系统
- 希望自托管、数据不出内网的检索后端
- 已用 RAGFlow 或类似栈、想要配套检索引擎
- 中大规模、对查询延迟与并发有要求的场景
不适合
- 仅需简单向量检索时,引入完整数据库偏重
- 团队缺 C++/数据库运维能力时自托管成本高
- 需要成熟托管云服务、不愿自运维时不合适
- 项目仍在快速迭代,接口与稳定性需自行验证
如何接入
- 提供 Python SDK 与 HTTP API 接入应用
- 支持单二进制或 Docker 部署且无外部依赖
- 与 RAGFlow 等 InfiniFlow 生态检索链路衔接
- 可作为 RAG 管线的向量与全文统一存储层
已知限制
- 版本号仍在 0.x,生产前需评估稳定性与升级
- 自托管需自行负责容量、备份与运维
- 官方性能数字为特定数据集口径,需实测复现
- 深度多向量/张量检索的调优门槛较高
接入与使用事实
- 部署方式
- 自托管、本地运行
- 实现语言
- C++、Python
- 中文界面
- 待确认
- 中文文档
- 待确认
- 定价方式
- 开源
- 许可证
- Apache-2.0
- 国内可达性
- 国内可达
- 可达性观察
- 待补充
权限、依赖与维护信号
这些字段记录公开可见信号,不等同于安全审计结论。
权限信号
暂无公开信号。
依赖信号
暂无公开信号。
维护信号
暂无公开信号。
公开来源与证据
暂无可公开的来源链接。
