五个模型经济体中消失的崩溃:控制与涌现

Hugging Face:Blog(RSS)·2026-06-08 21:10·104天前
AI 导读

用五个不同实验室的AI模型(OpenAI、NVIDIA、OpenBMB及一个自微调的5亿参数模型)各自驱动一个智能体构建经济市场,试图复现此前单一模型下出现的银行挤兑式价格崩溃。结果同一场景下模型不仅不抛售反而囤积,导致价格不跌反涨。通过纯谣言、库存泛滥、加大做空三种方式均无法重现崩溃。最终在结算环节直接覆盖价格,使崩溃成为设计事实。实验表明,AI智能体的涌现行为是偶然的而非稳健的,有效系统需在涌现纹理与确定性控制之间找到精确接缝。

Hugging Face:Blog(RSS)
精选
57AI 编辑部评分,满分 100

五个模型经济体中消失的崩溃:控制与涌现

2026-06-08 21:10· 104天前
AI 导读

用五个不同实验室的AI模型(OpenAI、NVIDIA、OpenBMB及一个自微调的5亿参数模型)各自驱动一个智能体构建经济市场,试图复现此前单一模型下出现的银行挤兑式价格崩溃。结果同一场景下模型不仅不抛售反而囤积,导致价格不跌反涨。通过纯谣言、库存泛滥、加大做空三种方式均无法重现崩溃。最终在结算环节直接覆盖价格,使崩溃成为设计事实。实验表明,AI智能体的涌现行为是偶然的而非稳健的,有效系统需在涌现纹理与确定性控制之间找到精确接缝。

推荐理由

做 agent 的人必读,自己动手构建一个多模型经济体后才发现,涌现行为脆弱,控制要卡在结算层而非输入层,廉价模拟器会给你虚假信心。这篇复盘比成功案例更值钱。

正文 · AI 翻译

来自 2026 年 6 月 Build Small Hackathon 的现场笔记。第三篇。 在这些笔记的第一篇里,我讲了一个我引以为豪的故事。我画了一个叫《突袭乌娜的宝藏》的林地传说,把 1929 年的银行挤兑重新包装成林地民间传说,然后看着那只守着蜂蜜的猫头鹰读懂恐慌情绪并开始抛售。供应洪流在接下来的几个回合里把蜂蜜价格从 10 砸到了 3。没有人写脚本安排这一切。一个重新包装的银行挤兑让一个智能体抛售了一项资产,而这次抛售又推动了价格。这就是整个论点:给一个小模型一个角色和一份预算,涌现出的市场行为就会免费掉出来。

然后我重建了这片林地,崩盘就不再发生了。这一篇讲的就是为什么,因为这次失败教给我的关于在智能体之上做构建的东西,比最初那次成功还要多。

五个实验室,五种心智

这次重建把用一个模型驱动五个生物,换成由五个不同实验室的小模型组成的议事会,每个模型驱动自己的生物:一个 OpenAI 模型、一个 NVIDIA 模型、一个 OpenBMB 模型,还有一个我自己微调的 5 亿参数模型,由它驱动其中两个。关键在于诚实。如果主张是小模型能够运行一个活生生的经济体,那么这个主张最强的版本就是五种不同的架构在同一个市场里做出不同的选择,而不是一个模型戴五顶帽子。

正是这种异质性,击碎了我早已写好的那个故事。

价格就是智能体们决定以什么价格交易

我也重建了操盘手这一侧。玩家现在是一名在暗处运作的金融家:做空某种商品,悄悄放出真实的内幕消息来为它的下跌铺路,触发那个传说,然后在价格暴跌时收割。我把这个循环在屏幕上做得清晰可读,有目标、有记分板,还有一键完成首笔交易。让一个承诺变得可见,是发现这个承诺为假的最快方式。

因为当我做空蜂蜜并触发对 Oona's Hoard 的挤兑时,蜂蜜并没有崩盘。它反而上涨了。议会模型们读到一则金库已空的谣言,以及一条收成注定完蛋的内幕消息,并没有像最初那个单一模型那样抛售蜂蜜。它们把它囤了起来。是稀缺,而非贱卖。这笔做空亏了钱,而叙事者写下的标题,毫无讽刺意味,说的是这场蜂蜜赌局已经变味了。

这就是教训,而且它并不局限于某个游戏。在智能体经济中,参考价格不是你可以随意拧动的旋钮。它是智能体们实际选择交易什么的沉淀结果。最初的那场崩盘是真实的,但它取决于某一个模型的性情,而不是这个系统的一个稳健属性。改变参与者群体,你所记录下的涌现行为就可能干脆蒸发。

三种失败的方式

我花了三次实盘运行,试图通过从外部推动这个经济体来让那场崩盘重现,就像你会去冲击一个教科书式的供需模型那样。

首先,我把那条传闻纯粹当作谣言放着,信任智能体会自行反应。它们没有抛售。其次,我把一大笔意外之财般的蜂蜜倾倒进每个生物的金库,推断供应过剩会压垮需求、把价格拉低。这一招对我的测试策略——一个我用于快速离线运行的基于规则的替身——效果极佳,因为测试策略遵循机械式的需求阈值:把它的库存灌满,它就会停止买入。而真实模型无视了这笔横财,按照它们自己对场面的解读进行交易。这一招又输了。第三,我加大了做空的规模,结果只是让亏损更大。

三段记录,三次亏损:负十五、负二十六、负二十七颗石子,而整个前提本应是这就是赚钱的方式。这个模式本身就是警告。我拉动的每一根杠杆都是智能体决策的一个输入,而智能体可以自由地拒绝。你无法用一次机械式的冲击去操控一个异质的模型群体,因为这种冲击只是对它们仍然有权做出的选择施加了一点偏向。

陷阱之中的陷阱值得单独点明。那个对我的快速测试策略有效的修正给了我虚假的信心,并让我付出了一次真实运行的代价才得以证伪。当廉价的替身和真实智能体出现分歧时,说谎的是替身,而任何只在替身下才能复现的结果都不是结果。

去编写接缝,而不是去推动输入

解决方案是停止试图说服智能体,而是通过构造让恐慌成为真实。银行挤兑,按定义来说,就是一场崩盘。所以现在传说在结算时、在市场完成该轮清算之后,直接覆写参考价格,让它的商品崩盘。智能体们想怎么交易就怎么交易;然后挤兑作为事实落地,价格腰斩,抢跑做空的那笔交易便结算为盈利。崩盘不再是我期盼的一种行为。它是我在唯一一道下游无从争辩的接缝处强加的一种被编写的后果。

这听起来像是放弃涌现,但恰恰相反。涌现层——五个模型交易、八卦、囤积、结怨——仍然在做着所有让这片林子显得有生气的工作。我学到的是,你不能靠对涌现输入施加更大压力来获得可靠的结果。你要靠选择那道精确的接缝,在那里编写一个确定性的覆写,并让上游的一切保持自由。用涌现来营造质感,用编写的控制来确保那些必须发生的时刻。真正的技艺在于分辨哪个是哪个,以及那道接缝在哪里。

尝试 机制 结算时的蜜糖 策略盈亏
原始版,单模型 那个模型选择抛售 10 比 3 展示性胜利
Council,仅为传闻 五个模型选择持有 因稀缺而上涨 减 15
Council,库存过剩 需求崩塌,仅为测试策略 几乎未动 减 26 至 27
Council,结算覆盖 清算后价格暴跌,由法令所致 可靠地减半 加 40

表 1. 同样的策略在四个世界中的表现。崩盘在单一模型下是涌现的且脆弱的,在异构 Council 下不存在,只有在结算接缝处被编写进去后才变得可靠。

我的收获

三点,且这三点都比这个游戏更长久。

第一,涌现是偶然的,而非持久的。你从某一群智能体身上观察到并记录下来的行为,在更换群体后可能会消失,即使其他一切都没有改变。要把单次令人印象深刻的运行视为轶事,而非固有属性,直到它能在另一组不同的智能体阵容中依然成立。

第二,你无法通过冲击输入来控制一个智能体市场。供需杠杆只会影响智能体仍然可以自由做出的选择,而一个异质的议事群体往往会拒绝。可靠的结果来自于在结算接缝处进行编写——位于每一个决策的下游,而不是在上游施加更大的压力。

第三,那个让你快速迭代的廉价模拟器,也恰恰是最容易美化一个错误修复的模拟器。当替身与真实智能体出现分歧时,相信真实智能体。

我以构建基于智能体的市场模型为生,而上述每一个错误,我都曾在更大规模、更高风险的场景中犯过——远比一片住满林地生物的树林要大得多、险得多。能在这样一个唯一可能受损的只是一堆小石子和一个我初次讲述时过于自信的故事的地方,把这些错误再犯一遍,是很有益的。

小模型,大冒险,还有一场必须由你自己来书写的崩溃。


试一试:这个Space。开放的智能体轨迹:这个数据集

来源:Hugging Face:Blog(RSS)· huggingface.co