竞技场的设计师-龍德明宇

竞技场的设计师

作者:龍德明宇

新的黄金时代系列篇二

导读

81 年前,布什说科学在侧翼,应当请上舞台中央;81 年后,报告说政府的核心角色是「塑造竞技场」。当年是科学要上台,如今是政府要造场。

报告说「不指导发现」,但它设挑战领域、划优先级、定预算方向。场的设计本身,就是方向裁断。签名到处都是,只是没有人为「这个方向值得」押上自己。

这座场的设计重心是吞吐量。判断没有被取消,它被保留在「系统报错时才调用」的接口处。


1945 年 7 月 5 日,范内瓦·布什向美国总统呈交了一份报告,《科学:无尽的前沿》(Science: The Endless Frontier)。布什当时是美国科学研究与开发办公室(OSRD)的主任,这个机构统管二战时期美国的战时科研,雷达、青霉素大规模生产都由它协调;这份报告,是他为战后科学画的蓝图。81 年后,2026 年 7 月 21 日,白宫科技政策办公室(OSTP)主任迈克尔·克拉齐奥斯呈交了另一份报告,《科学:新黄金时代》(Science: A New Golden Age)。两份报告的体例几乎一个模子:总统先写委托信,主任回呈交信,然后是诊断、建议、给未来定调。第一份催生了美国国家科学基金会(NSF,美国联邦专设的跨学科资助基础研究的机构),联邦资助基础科研的这一支由此确立;第二份宣称,那套框架建于 81 年前,如今需要「再次更新根基」。

这两份报告我都通读过。最让我在意的,不是谁给的钱多,也不是哪份更看重 AI,而是各自纲领处的一个空间隐喻。

1945 年的报告第一章,布什写道:「Science has been in the wings. It should be brought to the center of the stage---for in it lies much of our hope for the future.」(科学一直在侧翼。它应当被请到舞台的中央,因为其中寄托着我们大部分对未来的希望。)侧翼是舞台两侧的候场区:听得见台上的声音,观众看不见。他说的是政府和科学的关系:战争年代,科学家在幕后干活,政府在前台拍板;和平年代到来,科学应该走到台前。

2026 年的报告第五章,克拉齐奥斯写道:「The central role of the Federal Government is to shape the arena rather than direct discovery.」(联邦政府的核心角色,是塑造竞技场,而非指导发现。)

一个是舞台,一个是竞技场。一个说科学该上台,一个说政府来造场。

先交代一句:这是两份各自的修辞,「主语换座位」是我的读法,不是文本自己的陈述。但这个读法值得展开。81 年间,隐喻里的主语换了座位。1945 年,等待上场的是科学,台下出钱的是政府;2026 年,政府坐到了设计师的位置上,科学成了场上的选手。

这篇文章要讨论的,就是这次换座位:「谁给科学定方向」这件事,在 81 年里发生了什么变化。

一、布什的克制:出钱的人不进导演席

先看 1945 年。布什的报告通篇在讲政府该怎么支持科学:出钱,要出得稳定,签多年期的合同;建机构,他提议设立一个国家研究基金会,也就是 NSF 的前身;培养人才,用奖学金把有科学天分的年轻人找出来。但在这份要钱的报告里,有一段非常重的限定。报告第六章给这个新基金会立了五项基本原则(Five Fundamentals),管的正是政府资助科学的分寸,其中第四条规定:政府的资助,不得干预受资助机构内部对政策、人事、研究方法与研究范围的自主权。

紧跟这一条,布什写下了一句加重语:「This is of the utmost importance.」(此乃重中之重。)

翻译成白话:政府可以出钱,但别指手画脚。什么研究值得做、谁该被雇用、用什么方法、研究铺多宽,这些判断,留给科学界自己。

五项原则里还有一项同样要紧:基金会须向总统和国会负责,并保留在各机构之间分配资金的裁量权。也就是说,布什的体制在顶层从来不缺政治问责链,出钱的人本来就要向选民的代表报账。他刻意守住的是执行层:具体资助哪份申请,交给懂科学的人关起门来判断。顶层讲政治问责,执行层讲专业自主,两层各有各的规矩,互不越界。

这不是客套。布什的报告第一章有一个判断作为地基:「Scientific progress on a broad front results from the free play of free intellects working on subjects of their own choice, in the manner dictated by their curiosity for exploration of the unknown.」(科学在广阔战线上的进步,来自自由头脑的自由发挥:题目由他们自己选,方式由他们对未知的好奇决定。)既然引擎是科学家自己的好奇心,政府就不该把手伸进判断,只管出钱。

这套克制后来被做成了制度。NSF 于 1950 年成立,它分钱的方式是同行评审(peer review,请同一领域的专家来把关申请书):政府出钱,科学家互相把关,政府站在门外。

要说明的是,布什设计的这套体制,并不意味着科学的方向完全由科学家个人说了算。NSF 把经费划给哪些领域、哪些方向的申请书更容易通过,本身就是机构层面的引导;机构替人做判断,在科学史上从来就有。但在布什的机制里,判断至少还握在「人」的手里:评审专家是具体的人,他们在用自己的专业判断投票。判断经过了机构,没有离开人。

81 年后的报告,在「政府不指导发现」这半句上,看起来延续了布什的克制。但克制的外形之下,有另一个动作在发生。

二、竞技场的形状:「不指导发现」要拆开读

「塑造竞技场而非指导发现」这句话,出现在 2026 年报告第五章一个叫「创世纪使命」(Genesis Mission)的小节里。报告对它的定性很重:这套设计反映的是「全报告的核心信念」(the core convictions of this report)。

先把时态摆正,这影响后文所有判断。创世纪使命不是这份报告的新设想:它在 2025 年 11 月 24 日已经由总统行政令(EO 14363)正式启动,能源部受命牵头;2026 年 2 月,能源部已经公布了 26 项国家科技挑战的清单,科学部副部长达里奥·吉尔(Darío Gil)被任命为使命主管。报告 2026 年 7 月才发布,它做的是追认、定调、主张扩大。所以严格说,这座竞技场的设计师不是这份报告,而是签署行政令的体制本身;报告提供的,是这套设计的哲学和纲领语言。这一点不妨碍我们读它,恰恰相反:纲领语言最能暴露设计者的默认假设。

单看「塑造竞技场」这一句,它像布什式克制的延长线:政府不指导发现,还是那个意思,甚至更谦逊,政府只造场。

但这句话值得拆开读,一步一步来。

第一步,看它的字面语境。这句话的紧邻下文说的是:承认私营部门拥有公共机构必须学会借用、而非复制的能力(recognizing that the private sector possesses capabilities public institutions must learn to leverage rather than replicate)。也就是说,这句话的直接语境,是政府与私营部门的分工:企业已经能干的事,政府不必重复建设。就字面而言,它管的甚至不是科学判断,而是「谁干什么活」。

第二步,看同一个「创世纪使命」里同时进行的另一个动作。它不只是一句修辞。行政令把它从能源部的项目扩展为全政府行动,2026 年 7 月白宫宣布投入超过 50 亿美元,覆盖 15 个以上的联邦机构;能源部系统的国家实验室、NSF 新设立的可编程云实验室网络(首期 20 个节点、投入 3.8 亿美元,NSF 后来的通稿按 4 亿口径宣传)等研究资源被统筹进来;报告设立了国家科学与技术挑战领域(National S&T Challenge areas),瞄准跨领域的难题(cross-cutting problems);四个总目标里的第三条写得明白:政府要「设定明确的科学目标」。随报告同发的白宫 FY2028 研发优先事项备忘录,把创世纪使命列为了中央研发优先事项(central R&D priority)。

第三步,把两步并起来。造场(管分工)和划优先级(定方向),是两个动作,报告并没有把后者装进「塑造竞技场」这句话里。但两个动作发生在同一个使命、同一套设计里;把两步并成一步看,才能看清这座竞技场是什么:它不是一块空地,而是一块带着优先级的场地。

并这一步,需要一个论证:为什么「造场」就是「划方向」?

因为对科学来说,场地从来不是中立的。哪些领域有挑战计划,哪些方向进了预算优先事项,哪些难题配上了国家实验室的设备,哪里的科学家就更容易把研究做下去。方向裁断,就是替科学选方向的那次判断,它并不需要一道命令说「你们必须研究这个」;只要资源的地形被塑造出来,方向就已经被裁断了。政府确实不指导你怎么发现,但它决定了你在哪块地上发现。而决定「在哪块地上发现」,就是决定「什么值得发现」。

这套造场逻辑也不是 2026 年凭空冒出来的。曼哈顿计划、阿波罗计划,都是国家定方向的极端形态;1958 年诞生的 DARPA(国防高级研究计划局),几十年来玩的就是设挑战、划赛道、按里程碑付费、项目经理集权这一套。2026 年的新意在别处:这种原本属于国防特例的使命竞赛逻辑,借着 AI 基础设施,正在扩散成整套科学体系的通用底座。

这是方向裁断的第一步位移:从科学家手里,移到机构手里。

真正要紧的是第二步。布什时代的 NSF 也在划地形,经费结构本身就是引导;区别在于,NSF 的地形由同行评审来定,一群具体的科学家在用专业判断投票,出了偏差,可以指着一个环节说,这是人做的判断。而创世纪使命的方向裁断,说话的是行政令的条款,是预算附件里的优先级列表,是一套激励架构(不直接下命令,而是设计规则和参数,让参与者在规则里自行走向目标)。

这里必须承认一件事,免得话说满。宏观方向上,人是点得出名字的:行政令有签署者,能源部长被点名在 60 天内提交挑战清单,使命有主管,预算案有表决人。批评者担心的甚至是相反的事:方向正在向少数政治任命者手里集中。这种政治与行政问责,一直都在。

但注意这些签名担保的是什么:程序合规,财政合法,大方向不超出政治授权。没有人为「这个科学方向值得」这句话本身负责,用学术生涯和智识声誉做抵押的那种负责。从前的体制里,一个评审专家为一个项目签字,签的是自己的专业名声;如今的列表和机制划出方向,走对了是集体的胜利,走进了死胡同,系统只会吐出一份新的参数优化报告,没有一颗头颅需要为漫长的平庸负责。

行政上有签署者,认识上无抵押人。这是两种问责的错位。

这就是第二步位移:裁断从机构沉到系统。路线可以完整画出来:科学家自己选题,是人做判断;同行评审分钱,是机构做判断,但链条上站着人;优先级列表加激励架构加 AI 引擎,是系统做判断,链条上找不到一个为方向押上自己的人。每挪一步,裁断就离一个可以问责的具体的人更远一步。不是没有人负责,而是方向的责任地址变得模糊、难以指认。这件事没有一张脸,你可以叫它裁断的非人格化。

我在这个系列的母文里写过,这 81 年最深的变化,是「主体位置的迁移」:谁拍板这件事,从一件不用想的事,变成了需要被点名、被保卫的稀缺品。本文看的,是这场迁移在政府与科学关系上的具体形状:方向裁断没有被取消,它先是被机构化,然后被非人格化。

三、机构长在 AI 上:人从圆心退到接口

场地之上,是机构。报告第五章有一句容易被当成技术细节的话:

「Eventually, we will need AI-native scientific institutions, with rules, infrastructure, capital models, and cultural norms built around the use of powerful AI systems.」(最终,我们将需要 AI 原生的科学机构:规则、基础设施、资本模式与文化规范,都围绕强大 AI 系统的使用来建造。)

注意时态:eventually,终将需要。这是愿景,不是现状;下面描述的,是蓝图里的机构,不是已经存在的机构。

「AI 原生」(AI-native)这个词值得停下来拆。它说的不是「机构用 AI」。今天的大学也在用 AI,就像办公室用电脑:工具换一茬,机构还是那个机构。「原生」的意思,是从地基开始按 AI 的存在来设计,好比「云原生软件」不是把老软件搬上云,而是假设云的存在重新写程序。

围绕什么重造?报告点了四个维度:规则、基础设施、资本模式、文化规范。

规则:机构的章程、评审标准、成果认定,按「人与 AI 协作」重写。举例来说,当实验方案由 AI 提出、机械臂执行时,一项成果算谁的贡献、署名怎么记,老的规则接不住。

基础设施:实验室和数据系统不再是「人操作的仪器」,而是机器可以直接调用的接口。设备排队、数据进出,优先按工作流的逻辑排。

资本模式:钱的给法变了。报告前文主张投资组合式拨款,像投资人一样下注一批研究者:快轨、金票、按结果付费(奖金、先期市场承诺)。这里要拆开说,因为金票恰好是个反例,值得诚实对待:金票(golden ticket)允许一名评审人力排众议,直接资助被评审组否决的非共识项目。这是给个人判断开的门,不是给吞吐量开的门。但注意它的位置:它是一条例外通道,用来对冲共识评审的僵化,不是常设岗位。一套体制给判断留了旁路,不等于把判断写进了主流程。资本整体的设计重心,仍然从「长期养一个实验室」转向「一个想法快速跑通验证循环」。

文化规范:什么算好科学。当生成便宜了,一年产出上百篇论文不再是稀罕事,文化上尊敬什么、奖励什么,就要重新定义。

四个维度都重造之后,机构的地基里就不再有「以人为圆心」这个假设。原来的机构,一切都是围着人转的:实验室是人的工作场所,经费是给人的研究供血,制度是人和人之间的契约。蓝图里的 AI 原生机构,承重墙换成了 AI 工作流;人出现在接口上,在系统拿不准的地方接入,在需要承担责任的签字位上出现。

还是拿车打比方。老机构围着司机造,车听人的;AI 原生机构像自动驾驶的车队,路线和保养由系统定,人退成接管员,只在出状况的一刻负全责。

用过 L3 级辅助驾驶的人知道,长时间不碰方向盘的巡航,不会让人更敏锐,只会让人在突发故障的那一秒措手不及。日常判断的肌肉在标准化流程里萎缩,等系统报出「异常」的那一刻,坐在接口位置上的人,真的还握得住方向盘吗?

机构不是 AI,负主体性这样的理论名字不能直接套在它头上;但有一个趋势是清楚的:机构的运行,越来越多地由流程、指标和吞吐量(throughput,单位时间的处理量)决定,越来越少地由某个具体的人在某个下午拍板决定。机构不在任何一个环节停下来问一句:这件事值得吗。

地基的图纸换了,场上的玩家也在换。

四、无判断的玩家:工厂里只有核验,没有判断

创世纪使命投资的项目清单里,有一类东西叫自主实验室(autonomous laboratories)。报告摘要的行动清单里专门有一条:加速自主实验(Accelerate Autonomous Experimentation);这类自主实验基础设施,被列为创世纪使命的核心支柱之一。

两个名词解释一下。自主实验室,是一个闭环:AI 提出假设、设计实验,机械臂执行,结果自动核验,然后 AI 根据结果调整下一轮。云实验室(cloud laboratory),是把实验室做成云服务:像在网上下单一样提交实验需求,远程的自动化设备执行,数据传回来。

报告对它有一句定性:「Cloud laboratories become the factories of this economy.」(云实验室成为这个经济的工厂。)报告把未来的科研想象成一种「经济」,有分工、有交易、有自动化生产;而云实验室,就是这种经济的工厂。

「工厂」这个词很诚实:标准化流程,连续运转,产能以吞吐量计。但工厂里只设了核验,没有做判断的岗位。

自主实验室的闭环恰好印证这个结构:提出假设,设计实验,执行,分析,按程序核验。这里要把两件事分开。闭环里的「核验」,是测量与比对:数据符不符合预设的标准,结果能不能复现。这部分自动化没有问题。但科学意义上还有另一类判断:这个结论成立吗,重要吗,值得押上名声追下去吗。闭环内部没有为后一类判断设岗位。闭环外当然有判断者(提交实验需求的人就在做判断),但注意他的位置:在接口上,不在流程里。

我在系列母文里用一对概念描述人与 AI 的分工:正主体性,指人在乎、人选择、人做最终判断;所谓做判断,是押上自己,判断对了是声望,判断错了是代价。负主体性,指 AI 提供参考、执行、做统计预测,但不做最终判断,因为它没有可以押上的自己。自主实验室提供了一个纯净的样本:在 AI 系统的意义上(不是在机构的意义上),它是负主体最彻底的形态,一台只站在生成与核验的位置上、从不站在判断位置上的系统。

现在把三层放在一起看。政府造场,场的形状就是方向;机构按蓝图长在 AI 上,承重墙换成工作流;场上跑着不判断的玩家,只运转,只产出。三层合起来,是一个完整的图景,可以压缩成一句话:

竞技场为吞吐量优化,判断被保留在接口处。

这句话的每一半都有出处。先看吞吐量这一半:报告为这座场铺的每一块砖,都在给「快」和「多」铺路:规模化验证基础设施,可复现性奖励,机器可审计的成果格式,一个月内决断的快速拨款。再看判断这一半,要把话说公道。报告自己的诊断其实很细腻:它明说瓶颈不只是产出的数量,还主张更新「资助什么、发表什么、奖励什么、纠正什么」的制度;它给判断留的设计也不止一处:押注于人的长期资助,给非共识项目开门的金票。所以准确的说法不是「这座场不要判断」,而是:判断在这座场里以例外和接口的形式存在,不以岗位和流程的形式存在。设计重心(预算的大头、机构的设置、指标的语言)压在吞吐量上。而判断是慢的:一个人为一个结论押上自己的时间和名声,这个动作快不起来。判断在这座场里的位置,报告自己写得最清楚:「When results prove ambiguous, human experts provide the judgment that automated systems lack.」(当结果被证明模糊时,提供判断的是人类专家,这份判断是自动化系统所没有的。)判断被保留了,但被保留在「模糊处」,像一个应急接口:系统运转不需要它,系统卡住了才呼唤它。

报告其实郑重地给人留过位置,第五章末尾写道:「human researchers setting directions, posing questions, integrating findings, and making the judgments that require wisdom rather than computation.」(人类研究者设定方向、提出问题、整合发现,并做出那些需要智慧而非计算的判断。)四个动作,读起来很完整。可就在同一章里,方向有挑战领域,问题有优先级排序,整合有自动工作流。这个对应是我的读法,问题和优先级并不完全等价,但重心的走向是清楚的:四个动作,前三个都被机制分走了一块。剩下完整保留给人的,只有最后一格:判断。

于是留下一个真问题。报告里动人的一句承诺是「Bet on people, not just projects.」(押注于人,而不只是项目。)报告也诊断说,老的科研体制「太多已变成服务于它自身,而非服务于其中的科学家」(Too much of our research enterprise has come to serve itself rather than the scientists within it),要把个体科学家从体制里解放出来。可是,解放之后的个体科学家,落地的是一座以吞吐量为重心的竞技场。这个被解放的人,在这座场里,到底是一个自己拿主意、自己担责任的正主体,还是更大系统的一个零部件,判断力只在系统报错时被调用?

这个问题,报告没有回答,也没法在设计层面回答。因为答案不在图纸上,而在一个更根本的账本里:生成便宜了,判断为什么没有变便宜?这是本系列第三篇《裁断为什么没有变便宜》要处理的问题。

结语

回到开头那两个隐喻。1945 年,布什说,科学一直在侧翼,该请它上舞台中央。81 年后,科学确实在台上了,只是台换成了竞技场,而执笔画下场地的人,坐在场边。

这篇文章无意指认这是谁的失误,因为这不是失误,是设计:行政令有签署日期,挑战清单有主管名字,预算附件有优先级列表。设计者的手伸进的是场地参数,不直接伸进方向;方向由参数推着走,却不挂在任何一个名字下。要看清这种设计的力道,不用读修辞,读钱就够了:同一届政府,一边在 FY2027 预算请求里提议把 NSF 的基线砍掉一半以上,一边在报告发布次日宣布为创世纪使命整合超过 50 亿美元的联邦投入。资源的地形正在被重新塑造,这比任何纲领语言都更直接。这本账还可以再往下读:谁拿到算力订单、谁承接挑战项目,利益的地形同样在重划。本文只取到预算方向这一层。

看清了设计,才谈得上评价。我的评价标准是文章开头那条旧规矩:顶层可以讲政治问责,执行层得有为判断负责的人。这座新竞技场的问题不在于有人设计(场地从来有人设计),而在于它的执行层把判断从流程里挪到了接口上。一个由参数划出的方向,不需要任何人说出「这是我的判断」;而一个不需要任何人押上自己的方向,走错了,也没有一颗头颅需要为漫长的平庸负责。

知道场为什么这样设计,才知道人的位置在哪里。至于那个位置为什么越来越贵,那是下一篇的账本。


《Science: A New Golden Age》

新的黄金时代系列篇一《布什的河与克拉齐奥斯的圈》

新的黄金时代系列篇三《裁断为什么没有变便宜》


相关推荐
具身AGI1 小时前
端侧推理的工程账,全栈自研 物理AI 的最后一公里
人工智能
径硕科技JINGdigital1 小时前
出海企业想要借助统一平台接入国际主流基础模型,可选哪些云上生成式 AI 平台?
大数据·人工智能
DP DPharness1 小时前
从零装通 dsh-plugin-subscriptions:三条安装路径、版本门槛与 headless 跑法
人工智能·dpharness
龙亘川1 小时前
智慧交通运输监管平台业务建模与架构解析
人工智能·架构·智慧城市·数据可视化·政务
Summer-Bright1 小时前
深度 | 谷歌Gemini 4 Argon单次输出100万Token:长输出是智能体刚需,先给防御者不给攻击者才是新玩法
人工智能·安全·ai
梦帮科技1 小时前
多任务权重流形融合:SLERP 球形线性插值、DARE 稀疏剪枝与多专家模型融合落地
人工智能·深度学习·算法·机器学习·tensorflow·聚类·剪枝
合调于形1 小时前
Xinxngb xnrxim chanyes《新兴信息产业》词条汉语拼音字母标调拼写实测案例
人工智能·自然语言处理·人机交互·语音识别·学习方法
workflower1 小时前
世界模型向产业上游发掘的热点
人工智能·机器学习·机器人·云计算·无人机
Yolanda_20222 小时前
17.卷积操作
人工智能·深度学习