返回 AI 工具目录
Kedro
开发框架人工精选最近核验 2026年7月23日
Kedro 是由 LF AI & Data 基金会托管的开源 Python 框架,用软件工程实践把数据科学与数据工程代码组织成可复现、可维护、模块化的管线。它提供标准化的项目模板、连接多种文件格式与云存储的 Data Catalog、带自动依赖解析的管线抽象,以及基于文件的数据与模型版本管理,并配套可视化工具 Kedro-Viz。管线可运行在单机或分布式环境,并支持部署到 Argo、Prefect、Kubeflow、AWS Batch、Databricks 等平台。定位是把 Notebook 或临时脚本升级为工程化、可协作的分析代码骨架。
定价开源部署本地运行、自托管国内可达国内可达许可Apache-2.0
解决什么问题
- 把 Notebook 或临时脚本重构为工程化管线
- 以标准项目结构提升可维护性与协作
- 用 Data Catalog 统一管理数据源与存储
- 管线自动解析节点依赖并可复用
- 一套管线可从单机迁移到分布式与云平台
适合
- 多人协作、需长期维护的数据科学项目
- 希望引入软件工程规范的数据团队
- 需要在多种编排或云平台间迁移的管线
- 以 Python 为主的数据与 ML 工作流
不适合
- 仅一次性分析或小脚本时引入成本偏高
- 它是编排与组织框架,本身不提供计算集群
- 实时流式处理不是其主要定位
- 需团队接受其项目结构与约定
如何接入
- 纯 Python,pip 或 conda 安装
- Data Catalog 对接本地与云存储及多种文件格式
- 可部署到 Argo、Prefect、Kubeflow、AWS Batch、Databricks
- 配套 Kedro-Viz 做管线可视化
已知限制
- 提供的是工程骨架,计算资源需自备
- 版本管理针对文件型数据,非通用数据库
- 上手需学习其项目约定与目录结构
- 文档以英文为主
接入与使用事实
- 部署方式
- 本地运行、自托管
- 实现语言
- Python
- 中文界面
- 待确认
- 中文文档
- 待确认
- 定价方式
- 开源
- 许可证
- Apache-2.0
- 国内可达性
- 国内可达
- 可达性观察
- 待补充
权限、依赖与维护信号
这些字段记录公开可见信号,不等同于安全审计结论。
权限信号
暂无公开信号。
依赖信号
暂无公开信号。
维护信号
暂无公开信号。
公开来源与证据
暂无可公开的来源链接。
