一個生成、一個評審,讓兩個 AI 互相對抗才能做出好東西(翻譯文)
原文作者:Prithvi Rajasekaran,Anthropic Labs 團隊成員。 原文連結:https://www.anthropic.com/engineering/harness-design-long-running-apps 【關於這篇文章】 你叫 AI 「自我評估」,它幾乎永遠說「很棒」,就算做出來的東西普通到不行。這是 AI 工程實作上的常見痛點,Anthropic 工程師 Prithvi Rajasekaran 花了幾個月研究這個問題,然後借用深度學習的 GAN(生成對抗網路)概念想出了解法:把「做事的 AI」和「評審的 AI」拆開,讓評審者專門挑毛病,做事者根據回饋迭代,形成有效的品質迴圈。 實際效果是:用一行提示詞就能讓 AI 自主開發功能完整的全端應用程式,