Karpathy分享理解大语言模型输出的技巧
未来我们会花更多时间去理解大语言模型的输出。这里分享一些想法、经验和技巧:
第一个方向是写作。我亲测有效的一个方法是:让大语言模型用ASD-STE100来解释内容。ASD-STE100原本是为航空维修文档开发的受控语言规范。
大语言模型很熟悉这套规范,它对简洁写作风格有很强的约束,产出的内容可读性往往好得多。
这套规范要求很严格,有时候我会放宽一点要求,比如要求“达到ASD-STE100标准的80%”就好。
但比写作更好的方向是:图表/图片。不要让大语言模型写文字,让它生成一张图表。图表处理、解析和理解起来都会容易很多。
比图表更好的方向是:网页。让大语言模型用HTML格式输出,就能得到一个美观的交互式网页。现在大语言模型的前端开发能力已经很不错了,可以生成很漂亮的界面、动画等等。
比网页更好的方向是:讲解视频。我最看好的输出格式是针对任意主题生成完全自定义的讲解视频。你可以试试类似这样的提示:“生成一个讲解X主题的3b1b风格视频,用我的ElevenLabs API密钥生成配音旁白”。(你需要有ElevenLabs的API密钥,也可以让大语言模型帮你找不错的免费替代方案,用本地算力运行)。这种方式现在居然已经能用了!
总结一下:
- 随着大语言模型能力越来越强,它们会自主完成越来越多的基础工作,我们的工作会越来越向上抽象,变成监督和理解。
- 幸运的是,大语言模型也能在这方面帮上忙。因为现在智能和算力越来越充足,你可以要求生成大型、自定义、用完就丢的软件产物(比如网页应用、视频讲解),放在以前根本不可能去做这些东西。大胆去尝试突破边界,你会得到惊喜的。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖