跳转至

GEPA:让 LLM 用反思进化提示词,样本效率甚至超过强化学习

Ch01.200 GEPA:让 LLM 用反思进化提示词,样本效率甚至超过强化学习

📊 Level ⭐ | 1.0KB | entities/gepa-reflective-prompt-evolution-iclr2026-oral.md

-> 原文存档

GEPA 提出了一种面向 LLM workflow 和 agent 的提示词优化方法:它不更新模型权重,而是让模型阅读自己的执行轨迹、错误反馈和评分结果,用自然语言反思出新的 prompt,并通过 Pareto frontier 保留多条有潜力的进化路线。

来源