GEPA:让 LLM 用反思进化提示词,样本效率甚至超过强化学习¶
Ch01.200 GEPA:让 LLM 用反思进化提示词,样本效率甚至超过强化学习¶
📊 Level ⭐ | 1.0KB |
entities/gepa-reflective-prompt-evolution-iclr2026-oral.md-> 原文存档
GEPA 提出了一种面向 LLM workflow 和 agent 的提示词优化方法:它不更新模型权重,而是让模型阅读自己的执行轨迹、错误反馈和评分结果,用自然语言反思出新的 prompt,并通过 Pareto frontier 保留多条有潜力的进化路线。
来源¶
- 原文: GEPA:让 LLM 用反思进化提示词,样本效率甚至超过强化学习
- 原始链接: : "https://mp.weixin.qq.com/s/dxXAMzZDQtmlYjXHvGseGQ