返回 AI 工具目录
GPT Prompt Engineer
AI 应用人工精选最近核验 2026年7月23日
gpt-prompt-engineer 是一个以 Jupyter Notebook 形式提供的提示词自动优化工具,思路是针对给定任务先批量生成多个候选提示词,再用测试用例让它们两两对战,按 ELO 评分排序选出表现最好的提示。它支持用 GPT-4、GPT-3.5-Turbo 或 Claude 生成候选,并提供面向真假判断的分类专用版本,以及把 Claude 3 Opus 提示迁移到更省成本的 Haiku 的能力,可选接入 Weights & Biases、Portkey 记录日志。它把靠手工试错的提示工程变成可量化对比的实验,适合需要系统化挑选提示的开发者。
定价开源部署本地运行、API 接入国内可达国内可达性待核验许可MIT
解决什么问题
- 针对任务自动生成多个候选提示词
- 用测试用例两两对战并按 ELO 排序
- 把手工试错的提示工程变成可量化对比
- 提供真假分类任务的专用评测版本
- 可把 Opus 提示迁移到更省成本的 Haiku
适合
- 需要系统化挑选与对比提示词的开发者
- 有明确任务与测试用例可供评测
- 想量化不同提示效果而非凭感觉
- 需在多个模型间比较提示表现
不适合
- 依赖 OpenAI/Anthropic 付费 API,会产生调用费用
- 需自备测试用例,无用例无法评测
- 以 Notebook 交付,非现成服务或界面
- 生成与对战会多次调用模型,成本随规模上升
如何接入
- 支持 GPT-4、GPT-3.5-Turbo、Claude 生成
- 可选接入 Weights & Biases 记录
- 可选接入 Portkey 做网关与日志
- 以 Python Notebook 运行,便于改造
已知限制
- 运行成本取决于模型与提示数量
- 国内直连 OpenAI/Anthropic 需自建代理
- 评测质量高度依赖测试用例设计
- 更适合评测原型,非生产级提示管理平台
接入与使用事实
- 部署方式
- 本地运行、API 接入
- 实现语言
- Python
- 中文界面
- 待确认
- 中文文档
- 待确认
- 定价方式
- 开源
- 许可证
- MIT
- 国内可达性
- 国内可达性待核验
- 可达性观察
- 待补充
权限、依赖与维护信号
这些字段记录公开可见信号,不等同于安全审计结论。
权限信号
暂无公开信号。
依赖信号
暂无公开信号。
维护信号
暂无公开信号。
公开来源与证据
- 代码仓库仅作事实索引
