返回 AI 工具目录

Infinity

自托管组件人工精选最近核验 2026年7月23日

Infinity 是 InfiniFlow 团队(与 RAGFlow 同源)开源的 AI 原生数据库,面向 LLM 应用的检索场景。它在单一系统内统一支持稠密向量、稀疏向量、张量(多向量)与全文四类检索,并可组合成混合检索,配合过滤与重排(RRF、加权求和、ColBERT),服务于 RAG、搜索、推荐与问答。官方称在百万级向量数据集上可达约 0.1 毫秒查询延迟与万级 QPS。以 C++ 为核心,提供 Python SDK 与 HTTP 接口,支持单二进制或 Docker 自托管且无外部依赖。Apache 2.0 许可,持续更新。

定价开源部署自托管、本地运行国内可达国内可达许可Apache-2.0

解决什么问题

  • 在一套系统内同时做向量、稀疏向量、张量与全文检索
  • 用混合检索加过滤与重排提升 RAG 召回质量
  • 避免向量库与全文引擎分开维护的架构复杂度
  • 面向百万级数据的低延迟、高并发查询

适合

  • 需要向量与全文混合检索的 RAG 与知识库系统
  • 希望自托管、数据不出内网的检索后端
  • 已用 RAGFlow 或类似栈、想要配套检索引擎
  • 中大规模、对查询延迟与并发有要求的场景

不适合

  • 仅需简单向量检索时,引入完整数据库偏重
  • 团队缺 C++/数据库运维能力时自托管成本高
  • 需要成熟托管云服务、不愿自运维时不合适
  • 项目仍在快速迭代,接口与稳定性需自行验证

如何接入

  • 提供 Python SDK 与 HTTP API 接入应用
  • 支持单二进制或 Docker 部署且无外部依赖
  • 与 RAGFlow 等 InfiniFlow 生态检索链路衔接
  • 可作为 RAG 管线的向量与全文统一存储层

已知限制

  • 版本号仍在 0.x,生产前需评估稳定性与升级
  • 自托管需自行负责容量、备份与运维
  • 官方性能数字为特定数据集口径,需实测复现
  • 深度多向量/张量检索的调优门槛较高

接入与使用事实

部署方式
自托管、本地运行
实现语言
C++、Python
中文界面
待确认
中文文档
待确认
定价方式
开源
许可证
Apache-2.0
国内可达性
国内可达
可达性观察
待补充

权限、依赖与维护信号

这些字段记录公开可见信号,不等同于安全审计结论。

权限信号

暂无公开信号。

依赖信号

暂无公开信号。

维护信号

暂无公开信号。

公开来源与证据

暂无可公开的来源链接。

访问官网