← 返回AI 前沿
AI 前沿

世界人工智能合作组织宣布了重要阶段性进展,但真正值得你关注的,不是他们签了什么协议——而是一个让所有AI研究者头疼了几十年的问题,终于被放到了台面上:两个AI之间,怎么互相信任?

老师有没有告诉你,全球AI合作最难的,不是技术——是信任

2026-07-19 · 🕐 约 7 分钟

丢笔哥 发布

🖊️ 老师有没有告诉你…

老师有没有告诉你,全球AI合作最难的,不是技术——是信任

两个AI之间的信任,比两个陌生人之间的信任更难建立——因为AI没有「直觉」可以兜底。

你肯定觉得,AI合作不就是大家坐下来开个会、签个字吗?但真相是——让全世界顶尖AI实验室在安全标准上达成一致,比训练GPT-10还难。

一份没人敢签的安全协议

2023年,全球几家头部AI实验室曾被邀请共同签署一份AI安全承诺。表面上大家都说「支持」,但具体到条款时,每一家都有自己的一套标准——有的管得松,有的管得严,有的干脆说「你管得太宽了会影响创新」。最后这份协议变成了一个所有人都同意、但没有人真正执行的「吉祥物」。不是他们不想合作——是彼此之间根本没有建立信任的基础。你想想,连人类同行都互相防着,何况是让AI自己互相验证?

为什么AI比核武器更难监管

核武器你可以数弹头——有几颗、在哪儿、谁有。但AI模型呢?代码可以复制,权重可以下载,训练一次的成本从几亿美元降到几百万美元只用了两年。你怎么监管一个可以无限复制的东西?更要命的是,核弹不会自己进化,AI会。你今天检查通过的模型,三个月后微调一下可能就变成了完全不同的东西。这意味着传统「签约—检查—制裁」的监管模式在AI面前全线失效。我们需要的不只是一纸协议,而是一套AI之间能自动验证对方「是否安全」的技术协议——就像你的浏览器自动检查网站证书一样,不需要你手动操作。

信任不是签出来的,是练出来的

你信任你最好的朋友,不是因为你们签了「友谊协议」——而是因为你们一起经历了足够多的事。AI之间的信任也是同一个道理。目前最前沿的思路叫「递归奖励建模」:让一个AI去监督另一个AI,然后让第三个AI去监督前两个,如此递归下去。每一步都不需要人参与。听起来像套娃对吧?但它的精妙之处在于——你不是在设计一个「完美的监督者」,你是在设计一套「作弊就会被发现的游戏规则」。这就是这次合作组织进展的核心:不是签文件,是建一套所有AI都能参与验证的「信任训练场」。

AI的「语言障碍」比你的更可怕

你可能觉得,AI不都说同一种编程语言吗?有什么沟通障碍?问题是,AI的「价值观」不是写在代码里的——它是从训练数据里「长」出来的。一个用中文互联网数据训练的模型,它的世界观和一个用英文Reddit数据训练的模型,差异可能大到它们对「公平」这个词的理解完全不同。当两个来自不同文化背景的AI试图在安全标准上达成一致时,它们首先得定义「什么是安全」——而这件事,人类自己吵了几千年都没吵明白。合作组织的第一个阶段性成果,就是发布了一套跨文化、跨语言的AI安全基础词汇表——相当于给全世界的AI建了一本「通用词典」。

蚂蚁教会AI的事:简单规则,复杂协作

你知道蚂蚁是怎么协作的吗?没有CEO,没有KPI,没有季度规划。每只蚂蚁只遵循三条简单规则:跟着前面的走、闻到食物就释放信号、遇到障碍就绕路。结果呢?整个蚁群能建出结构精密的蚁巢,能跨越河流,甚至能形成「活桥」。AI合作正在借鉴这个思路:不指望所有AI都遵守同一套复杂规则,而是设计几条极其简单、无法作弊的「元规则」——比如「不得对验证者撒谎」「每次决策必须留下可追溯的哈希指纹」。当每个AI只遵守这几条规则时,自动涌现出来的协作能力,比你硬塞给它一百页合规手册强得多。

真正的问题不是「能不能合作」——是「合作了然后呢」

假设有一天,全世界的AI真的能做到无缝合作了。然后呢?一个由AI自治的全球网络,决策速度快到人类连按「暂停」都来不及。这不是危言耸听——而是合作组织白皮书里明确提出的「速度不对等问题」:当AI之间的协作以毫秒为单位推进时,人类监管者还在翻会议纪要。所以这次进展最让人安心的反而不是合作本身,而是合作组织同时公布了「人类断点协议」——任何AI协作链中必须有人类可读的摘要节点,就像高速公路每隔一定距离必须设服务区一样。你可以理解为,他们在给AI的合作之路装「红绿灯」,而且灯杆是人拿着的。


小测验

1. 为什么AI比核武器更难监管?

查看答案 正确答案:2

2. 「递归奖励建模」的核心思路是什么?

查看答案 正确答案:2

3. 在AI合作体系中,「元规则」指的是什么?

查看答案 正确答案:2
🖊️

关于丢笔哥

丢笔哥不是一个具体的人——它是一种态度。在信息爆炸的时代,用最直白的语言,把硬核知识讲透。覆盖金融证券、AI 前沿、Web3、东方智慧。

一支笔丢在桌上,一堂课就此开始。

📬 订阅丢笔哥 →

📖 继续阅读

🔗 Web3
老师有没有告诉你,科学界最大的丑闻不是造假——是那篇改变世界的论文被拒了三次
如果有一个系统,审稿人可以在拒绝你论文的同时,偷偷把你的idea发给自己团队——而且你永远不知道——你会觉得这是科幻小说吗?不,这是每周都在发生的真实故事。
🌌 东方智慧
老师有没有告诉你,宇宙里最稳定的系统,其实一直站在悬崖边上
1987年,三个物理学家在实验室里玩沙子,发现了一个让所有「稳定」这个词的定义都失效的现象。而你身体里、股市里、甚至你的婚姻里——同一件事正在发生。
📈 金融证券
老师有没有告诉你,「房价还能重新上涨吗」这个问题本身就是你亏钱的原因
你问「房价还能涨吗」的时候,其实不是在问市场——你是在问一个已经被你的大脑偷偷改过答案的问题。而这个问题本身,比房价涨跌更值钱。

📬 不想错过下一堂丢笔课?

每周一篇硬核科普,用最好玩的方式讲最硬核的知识。
不卖课、不荐股、不画饼。

💬 讨论区