猫眼电影
猫眼电影记者 苗静 报道首次登录送91元红包
↑阅读之前记得关注+星标⭐️,,每天才能第一时间接收到更新
AI圈里一直流传着一句信条:“More agents is all you need”(智能体越多越好)。
大家的直觉很简单:一个诸葛亮不够,那就找三个臭皮匠来凑。甚至有人觉得,只要我把一堆AI拉进一个群里,让它们互相讨论、投票,无论什么任务都能做得更好
但现在,Google Research、DeepMind联合MIT的一项重磅研究,给这个想法泼了一盆冷水
https://arxiv.org/pdf/2512.08296
他们做了一场史上最严苛的压力测试,结果发现了一个反直觉的真相:
盲目组建AI团队,不仅不能提升能力,甚至可能把原本聪明的模型搞成“人工智障”,性能暴跌70%。
为此,研究团队总结出了一套 “智能体Scaling Law”,这是第一套能帮你算清楚“到底该单干还是群殴”的数学公式
为了搞清楚AI协作的真相,研究人员没有只测一种模型,而是把市面上最强的三大模型——OpenAI (GPT系列)、Google (Gemini系列)、Anthropic (Claude系列) 全部拉上了擂台
他们设计了180种不同的配置,不仅有单打独斗的(单智能体),还有四种不同的“组队模式”:
1.各自为战: 大家各干各的,最后凑一起。2.中心化指挥: 有个“经理”负责分派任务和检查。3.去中心化讨论:大家围成一圈开会,互相辩论。4.混合模式:既有经理,底下人也能私聊
为了公平,不管是单人还是团队,手里能花的钱(Token预算)和能用的工具都是一样的
测试结果出来后,呈现出了极端的两极分化,就像两个平行宇宙。
宇宙一:人多力量大
在 金融分析(Finance-Agent)这类任务里,多智能体简直杀疯了
因为金融任务可以拆得非常细,比如A查财报,B看K线,C做风控,最后汇总。在这种场景下,找个“经理”来指挥(中心化架构),性能直接比单干提升了80.9%
宇宙二:人多即地狱
但在“规划任务”(PlanCraft,比如在Minecraft里合成物品)里,情况完全失控
这类任务讲究逻辑的连贯性:你得先砍树,才能做木板,再做工作台。步骤环环相扣
结果研究发现,只要引入协作,所有多智能体架构全部崩盘因为大家七嘴八舌地讨论打断了推理的连贯性,把宝贵的计算资源都浪费在了沟通上。比起单干,性能最高暴跌了70%
还有个中间派:
模拟真实职场打工(Workbench)的任务,结果显示,这就属于费力不讨好。折腾半天组建团队,最好的结果也就提升了5.7%,甚至有的架构还倒退了
为什么会出现这种差异?研究团队通过那套Scaling Law公式,像法医一样解剖了背后的原因,找到了三条铁律:
铁律1:工具越重,开会越废(工具-协作权衡)
想象一下,如果一个工匠要用16种不同的锤子和锯子干活
单干时,他拿起工具就干。但如果是个团队,每换个工具都要跟队友确认、同步信息
数据显示,任务需要的工具越多,协作带来的内耗就越严重。在这种“重工具”场景下,把资源花在沟通上简直是浪费,不如留给单人去思考
铁律2:高手不需要队友(能力饱和)
研究划定了一条残酷的“红线”:45%。
如果一个单智能体自己做这道题的准确率已经超过了45%,那么给它加队友往往是负收益
就像学霸做题,自己做能得90分。非要给他配几个60分的队友在旁边指指点点,最后成绩反而会被拉低。
铁律3:没经理的团队是灾难(错误放大)
这是最吓人的数据
如果你让一群AI各自跑结果(独立架构),却没人负责检查,错误率会被放大17.2倍!
因为一个AI犯了错,没纠正,另一个AI接着错,最后错上加错
只有引入“中心化”的经理角色,强制进行检查验证,才能把错误控制住(只放大4.4倍)
结论:算好这笔账
这项研究最大的贡献,就是告诉大家:别迷信人海战术了
Google和MIT把这些发现浓缩成了一个预测模型。现在,只要你输入三个数据:
1. 模型本身聪不聪明?
2. 任务要用多少工具?
3. 这任务能不能拆解?
这个公式就能以87%的准确率告诉你:该单干,还是该组队
简单来说,这就是一本AI算力经济学:在预算有限的情况下,把算力花在让一个大脑深思熟虑上,往往比让一群大脑开会吵架更划算——除非,你真的有一个好经理和容易拆分的任务
最后记得⭐️我,每天都在更新:欢迎点赞转发推荐评论,别忘了关注我
时事1:凯发k8国际官网手机版最新版本
12月27日,【统战巡礼】牢记嘱托担使命 凝心聚力绘新篇——“十四五”期间黑龙江省统战工作综述,中方对2024年3月成功举行的俄罗斯联邦总统大选表示欢迎,认为本次选举组织程度高,公开、客观且具有全民性,其结果充分彰显俄罗斯政府所奉行的国家政策获得广泛拥护,而发展同中华人民共和国的友好关系是俄罗斯外交政策的重要组成部分。,现金网投游戏网。
12月27日,《康雍乾三朝通纪》发布 收录200余幅珍贵图像资料,今年1月1日,佛山市委办公室、佛山市政府办公室联合发布的“1号文件”透露,佛山将加快建设十大创新引领型特色制造业园区、十大现代服务业产业集聚区,重点培育发展机器人、新能源汽车等战略性新兴产业,推进家电、铝型材等优势传统产业链向价值链高端跃升。,彩票app澳门永利,AG平台官网多少,博e百国际赌城。
时事2:澳门金沙官网官网
12月27日,吉林省实现连续45年无重大森林火灾,进一步对公司业务板块分析可知,当前公司各核心业务发展显著分化。宜昌人福(麻醉镇痛领域)作为公司的“利润奶牛”,其增长已显疲态。2025年上半年,神经系统用药(主要为麻醉镇痛药)营收同比仅增长约4%,远低于前几年的增速。在麻醉镇痛领域面临新品种集采压力、市场竞争加剧的背景下,这一核心引擎的动力减弱是公司整体增长乏力的主因。,彩票平台app,免费百家乐,澳门有个捕鱼的网站。
12月27日,多位选手在残特奥会田径(马拉松)项目刷新全国纪录,全市场杠杆率上升。(1)银行间周度市场杠杆率抬升0.49pct至116.73%;(2)商业银行杠杆率下降0.15pct至102.99%;(3)广义基金杠杆率抬升0.86pct至114.34%;(4)券商杠杆率抬升13.41pct至217.30%;(5)保险杠杆率抬升1.90pct至135.28%。,365bet官网娱乐,炸金花那张牌最大,ms88体育官网。
时事3:多宝体育登录
12月27日,江西弋阳腔非遗传承“破局”:人才新政让年轻人从“出走”到“回归”,其中扰动更强的因素有:(1)1月缴税规模相较于12月或抬升13,000亿元附近;(2)1月信贷投放更加积极;(3)仍有高息定期存款到期,对负债端仍旧有影响;(4)中长期流动性到期规模增加2000亿元;(5)春节取现和权益可能的春季躁动对资金形成摩擦。,2026世界杯投注量排行,澳门新葡亰官方app,app世界杯投注。
12月27日,“不放弃任何一个求助”——香港消防员的48小时火海奋战,靳东,1976年出生于山东省,毕业于中央戏剧学院,国家一级演员,曾获得“青年五四奖章”先进个人、“全国德艺双馨电视艺术工作者”等荣誉称号。他还是第十四届全国政协委员。,尊龙网址登录,威尼斯官方娱乐网站,bsport体育在线App。
时事4:opt电竞
12月27日,日本民众举行集会 抗议高市政权放宽武器出口限制的动向,在加入国任保险之前,邓可的职业生涯长期在阳光保险集团度过,积累了从地方到总部、从前线销售到后台运营的全面经验。,走兽飞禽,凯发k8AG旗舰,金宝博网址多少。
12月27日,文博有意思丨“西周路由器”终于连上网了,密码是……,这些翻新机多来自深圳华强北,并非一般意义上的“山寨机”,更多是将小米、OPPO、vivo、三星等品牌的二手手机翻新。“从外观来看,翻新机也是新的,和新机差别不大。翻新机在非洲更受欢迎的主要原因还是低价,在华强北拿货只要两三百元人民币。而一部三四千元的国产新机换算成美元也要五六百美元,当地人还难以承受。”,足球世界杯买球软件,体育平台送365彩金,火狐体育手机版下载。
责编:陈庚
审核:费正清
责编:杨媛媛












