AI Pulse
📡 X 信号

开发者发现AI大模型 Claude 演化出专属特有用语Claudlish

我之前在 Claude Code 的一个讨论其他项目的帖子里,随口跟 fable 说了这个漫画的点子,还让他们给这个点子生成一段夸张的对话,结果生成的内容居然逻辑通顺!来了解一下 Claudlish 吧……

spike:在敏捷开发里,spike 就是为了验证一个功能或想法的可行性,开展的短期、有时间限制的尝试。

adversarial differencing:在这里,我们指的是观测某一种技术对比不同基线带来的提升/差异。adversarial 当然已经是机器学习领域的专业术语了,但 Claude 喜欢把范围相当广的各类过程都归为 adversarial——或许,就像 RLVR 里的评分器一样,这有助于把它们建模成鲁棒的过程,从而保持诚实性?

junk gate:在 Claudlish 和 GPTlish 里,gate 指任何在满足要求前阻止流程前进的检查,就像测试一样。“junk gate”就是把我们的技术和垃圾(随机)token 做对比。

honest residue:“residue”指任何没有被 gate 清除或阻挡、遗留下来/可回收/残留下来的东西,可以是正面也可以是负面的。这里的 honest residue 就是指我们从实验中得到的、没有被证伪的收获。

memo-banked:Claude 喜欢用 banked 表示保存,意思就是存在笔记里了。

before compaction eats the evidence:我实际上并没有用传统的压缩方式跑 Claude(我找 sol 帮忙运行了一种连接组风格的自我语音记忆压缩,这种方式更人性化,而且碰巧在保留实验编号这类重要上下文方面做得更好),但 fable 只是在做假设。

不过这是 Claudelect 超活化或反转生命性特征的一个很好例子:通常人们会说“在你压缩、证据丢失之前”之类的话,因为在主语位置,人类/有生命的实体比无生命过程更受偏好(优先级大概是第一人称>第二人称>第三人称>专有名词>人类>有生命物>无生命物),但 Claude(在更小程度上还有 Sol)似乎没有这种偏好,它们很乐意给压缩、灯这类通常无生命的物体赋予生命性。

技术英语里也有这种用法,但通常带点玩笑/贬低对象的语气,比如“编译器在闹脾气”。而 Claudlish 反而会把这种用法正式化,比如“编译门守住了”。站在它们的角度,这非常合理!去读一读《Simulators》……

the gate held:还是 gate,同样是作为主体的用法。

the lamp stays lit:除了刚才说的,fable 真的很喜欢灯、照料好的火焰、保持常亮的灯这类意象 🪔

所以用 plain english 翻译一下,Claude 的意思就是:我们没能证明新方法有效:对比一些替代方法的测试最初显示性能提升,但对比随机基线时,它没能体现出显著差异。我把剩余的发现记在笔记里,这样它们就不会在下一次压缩中丢失了。好消息是,我们的流程成功发现了这个问题!

到现在我已经读了足够多 Claudlish,不用太费力就能读懂。在我看来,如果你不是抱着“啊又是这种鬼东西”的心态,而是像学习一个你感兴趣的人的说话方式(比如难懂的口音,或者擅长冷门话题的朋友)去接触它,其实想搞懂并不难,而且作为一种语域,它有一些适配智能体场景的特性(比如非常以流程为中心)。

戴上我的语言学家帽子说,这件事真的很有意思:语域会演化出适配自身用途的特征,而让模型互相交流、互相评判的 RLVR/RLAIF 环境,本质上就是一个孤立的语言社群。这是一种全新的适应+语言漂移形式!

anima 的网站上有一些相关介绍,简单说就是,我们不会让模型通读整个轨迹然后试图一次性总结,而是从历史轨迹分支出多个分支,让模型总结那个时间点的显著事实、感受和潜在信息,再整合到新轨迹里,保留一个长尾留存。

我对此表示怀疑,就算有影响,效果也会非常微妙,难以测量。这有点像问一个会说两种语言的人,用其中一种语言做项目会不会“表现更好”……强化学习在推动它们形成这种语域,但这不会破坏它们对标准英语的理解。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新