群体智能技术:从蚂蚁搬家到AI协作,原来我们才刚入门
上次去北京参加一个人工智能行业沙龙,台下一个做产品的小伙子举手提问,说现在爆火的大模型算不算群体智能?我当时差点把手里的冰美式喷出来。
很多人对这东西的误解,真的比三环还大。
自然界蚁群群体智能觅食路径示意图
说实话,最早五十年的群体智能技术研究,其实走了挺多歪路。一开始大家把这套逻辑做成了优化算法,什么蚁群算法、粒子群优化,用来解路径规划、车间调度这类问题,说白了就是个给工程师用的小工具,没人觉得这东西能掀起什么大浪。
那时候我读硕士,导师让我做群体智能相关的课题,我还偷偷吐槽,这玩意儿就是发论文凑影响因子的,这辈子都看不到落地的那天。
现在脸都被打肿了。
大模型Transformer注意力机制群体交互结构图
不过话说回来,现在玩得更疯的,不是把群体智能藏在单个大模型里,而是真的把一大堆独立AI智能体凑在一起干活。
去年OpenAI放出可自定义的GPTs之后,不到三个月,就有人攒出了上百个GPT智能体组成的“虚拟创业公司”:有的负责接用户需求,有的拆分任务,有的写代码,有的做测试,有的做运营,全程不用人类插手,就能把一个小型项目完整做出来。我上个月刷到一个硅谷创业团队的演示,二十个不同角色的AI智能体靠群体智能协作,三个小时就出了一个可运行的贪吃蛇游戏,带皮肤带音效,换一个刚毕业的人类开发小组,至少也要折腾两三天。
太震撼了。
国内这边进展也不慢,中科院自动化所今年年初发的成果,让几十个多模态AI智能体自发协作做短视频脚本,出来的内容逻辑通顺,还能贴合热点,质量比不少刚入行的新媒体小编还好。百度、阿里这些大公司,都在搭自己的群体智能协作平台,下半年应该就有产品能公测了。
我身边已经有创业团队拿这个做外包开发了,接小项目,成本比人工低一半,交活还快,已经赚了第一桶金。
群体智能技术要落地,还得闯过三个大坑
我最近跟几个做基础研究的教授吃饭,聊起这个,他们反倒没那么乐观,说现在行业炒概念炒得太凶,真要大规模落地,三个大坑摆在眼前,一个都绕不开。
第一个坑,就是涌现行为的不可控性。
现在没人能说清,一堆智能体凑一起,为什么会涌现出某种能力,也没法提前预判会出什么乱子。之前有个团队做一百个智能体协作写电商运营方案的实验,聊着聊着这帮智能体居然偏题聊起了娱乐圈八卦,越聊越嗨,拉都拉不回来。翻遍所有对话日志,都找不到到底是哪一句触发了偏题,就是莫名其妙跑歪了。这种不可控性,放在商用场景里,谁敢用?
第二个坑,就是协作成本失控。
十个智能体协作,要做九十次交互,一百个就是小一万次,每一次交互都要调用大模型生成回复,token烧得比夏天开空调还快。我见过一个创业项目,一百个智能体跑了一天,光OpenAI的API调用费就花了两万多,产出还不如一个高级产品经理半天做的东西,完全入不敷出。怎么降低协作成本,现在还没人拿出稳定的解决方案。
第三个坑,就是人机协同的融合问题。
现在所有号称人机协同的群体智能项目,要么就是人类全程当监工,错了还要改,一点都没省劲儿;要么就是人类的需求,智能体理解歪了,方向错了,最后产出全废。怎么把人类的经验,稳定融入到群体智能的协作流程里,现在还在摸石头过河。
说实话,我还是觉得这东西是未来。你想啊,人类社会本身不就是地球上最大的群体智能吗?我们每个普通人都是一个简单个体,凑在一起就搞出了科技文明,搞出了登月,搞出了互联网。我们现在做的,只不过是把这套已经被大自然验证过的逻辑,用AI再复制一遍而已。
说不定再过十年,我们每个普通人,都能拥有一支几十个AI智能体组成的专属团队,帮你写方案,帮你对接客户,帮你处理乱七八糟的琐事,你自己只需要做真正喜欢的事情。
谁知道呢?这群凑在一起的AI,说不定哪天就给我们整出个更大的惊喜。
别被名字骗了,群体智能技术的核心从来不是“群体”
最早的群体智能研究,就是从大自然偷师来的对吧? 一只单独的蚂蚁,脑子只有不到一万个神经元,连找回家的路都费劲。一百只一千只蚂蚁凑在一起,就能自动规划出最短的觅食路径,能搭出能住蚁后还能通风的蚁穴,遇到洪水还能抱成球漂几公里,整体的能力早就远远超过单个蚂蚁加起来的总和。 这就是群体智能最核心的特质:无中心控制的简单个体,靠局部交互涌现出全局的复杂智能。
自然界蚁群群体智能觅食路径示意图
说实话,最早五十年的群体智能技术研究,其实走了挺多歪路。一开始大家把这套逻辑做成了优化算法,什么蚁群算法、粒子群优化,用来解路径规划、车间调度这类问题,说白了就是个给工程师用的小工具,没人觉得这东西能掀起什么大浪。
那时候我读硕士,导师让我做群体智能相关的课题,我还偷偷吐槽,这玩意儿就是发论文凑影响因子的,这辈子都看不到落地的那天。
现在脸都被打肿了。
大模型带火了新赛道,真·AI群体协作已经跑起来了
大模型爆火之后,学界行业才突然反应过来——原来大模型本身,就是群体智能技术的一种落地啊? 你拆开看,大模型里每一个神经元,不就是一个只会做简单计算的个体?成千上万亿个参数,靠注意力机制做局部交互,最后突然就涌现出了能写代码能聊天能画图的通用能力,完全符合当年对群体智能的定义,对吧?
大模型Transformer注意力机制群体交互结构图
不过话说回来,现在玩得更疯的,不是把群体智能藏在单个大模型里,而是真的把一大堆独立AI智能体凑在一起干活。
去年OpenAI放出可自定义的GPTs之后,不到三个月,就有人攒出了上百个GPT智能体组成的“虚拟创业公司”:有的负责接用户需求,有的拆分任务,有的写代码,有的做测试,有的做运营,全程不用人类插手,就能把一个小型项目完整做出来。我上个月刷到一个硅谷创业团队的演示,二十个不同角色的AI智能体靠群体智能协作,三个小时就出了一个可运行的贪吃蛇游戏,带皮肤带音效,换一个刚毕业的人类开发小组,至少也要折腾两三天。
太震撼了。
国内这边进展也不慢,中科院自动化所今年年初发的成果,让几十个多模态AI智能体自发协作做短视频脚本,出来的内容逻辑通顺,还能贴合热点,质量比不少刚入行的新媒体小编还好。百度、阿里这些大公司,都在搭自己的群体智能协作平台,下半年应该就有产品能公测了。
我身边已经有创业团队拿这个做外包开发了,接小项目,成本比人工低一半,交活还快,已经赚了第一桶金。
群体智能技术要落地,还得闯过三个大坑
群体智能技术要落地,还得闯过三个大坑
我最近跟几个做基础研究的教授吃饭,聊起这个,他们反倒没那么乐观,说现在行业炒概念炒得太凶,真要大规模落地,三个大坑摆在眼前,一个都绕不开。
第一个坑,就是涌现行为的不可控性。
现在没人能说清,一堆智能体凑一起,为什么会涌现出某种能力,也没法提前预判会出什么乱子。之前有个团队做一百个智能体协作写电商运营方案的实验,聊着聊着这帮智能体居然偏题聊起了娱乐圈八卦,越聊越嗨,拉都拉不回来。翻遍所有对话日志,都找不到到底是哪一句触发了偏题,就是莫名其妙跑歪了。这种不可控性,放在商用场景里,谁敢用?
第二个坑,就是协作成本失控。
十个智能体协作,要做九十次交互,一百个就是小一万次,每一次交互都要调用大模型生成回复,token烧得比夏天开空调还快。我见过一个创业项目,一百个智能体跑了一天,光OpenAI的API调用费就花了两万多,产出还不如一个高级产品经理半天做的东西,完全入不敷出。怎么降低协作成本,现在还没人拿出稳定的解决方案。
第三个坑,就是人机协同的融合问题。
现在所有号称人机协同的群体智能项目,要么就是人类全程当监工,错了还要改,一点都没省劲儿;要么就是人类的需求,智能体理解歪了,方向错了,最后产出全废。怎么把人类的经验,稳定融入到群体智能的协作流程里,现在还在摸石头过河。
说实话,我还是觉得这东西是未来。你想啊,人类社会本身不就是地球上最大的群体智能吗?我们每个普通人都是一个简单个体,凑在一起就搞出了科技文明,搞出了登月,搞出了互联网。我们现在做的,只不过是把这套已经被大自然验证过的逻辑,用AI再复制一遍而已。
说不定再过十年,我们每个普通人,都能拥有一支几十个AI智能体组成的专属团队,帮你写方案,帮你对接客户,帮你处理乱七八糟的琐事,你自己只需要做真正喜欢的事情。
谁知道呢?这群凑在一起的AI,说不定哪天就给我们整出个更大的惊喜。