返回 AI 工具目录

GPT Prompt Engineer

AI 应用人工精选最近核验 2026年7月23日

gpt-prompt-engineer 是一个以 Jupyter Notebook 形式提供的提示词自动优化工具,思路是针对给定任务先批量生成多个候选提示词,再用测试用例让它们两两对战,按 ELO 评分排序选出表现最好的提示。它支持用 GPT-4、GPT-3.5-Turbo 或 Claude 生成候选,并提供面向真假判断的分类专用版本,以及把 Claude 3 Opus 提示迁移到更省成本的 Haiku 的能力,可选接入 Weights & Biases、Portkey 记录日志。它把靠手工试错的提示工程变成可量化对比的实验,适合需要系统化挑选提示的开发者。

定价开源部署本地运行、API 接入国内可达国内可达性待核验许可MIT

解决什么问题

  • 针对任务自动生成多个候选提示词
  • 用测试用例两两对战并按 ELO 排序
  • 把手工试错的提示工程变成可量化对比
  • 提供真假分类任务的专用评测版本
  • 可把 Opus 提示迁移到更省成本的 Haiku

适合

  • 需要系统化挑选与对比提示词的开发者
  • 有明确任务与测试用例可供评测
  • 想量化不同提示效果而非凭感觉
  • 需在多个模型间比较提示表现

不适合

  • 依赖 OpenAI/Anthropic 付费 API,会产生调用费用
  • 需自备测试用例,无用例无法评测
  • 以 Notebook 交付,非现成服务或界面
  • 生成与对战会多次调用模型,成本随规模上升

如何接入

  • 支持 GPT-4、GPT-3.5-Turbo、Claude 生成
  • 可选接入 Weights & Biases 记录
  • 可选接入 Portkey 做网关与日志
  • 以 Python Notebook 运行,便于改造

已知限制

  • 运行成本取决于模型与提示数量
  • 国内直连 OpenAI/Anthropic 需自建代理
  • 评测质量高度依赖测试用例设计
  • 更适合评测原型,非生产级提示管理平台

接入与使用事实

部署方式
本地运行、API 接入
实现语言
Python
中文界面
待确认
中文文档
待确认
定价方式
开源
许可证
MIT
国内可达性
国内可达性待核验
可达性观察
待补充

权限、依赖与维护信号

这些字段记录公开可见信号,不等同于安全审计结论。

权限信号

暂无公开信号。

依赖信号

暂无公开信号。

维护信号

暂无公开信号。

公开来源与证据

  1. 代码仓库仅作事实索引

访问官网