The Bitter Lesson优雅中译(苦涩的教训)
作者Rich Sutton时间2019年3月13日七十年来人工智能研究教会我们的最大一课是那些善于利用算力的通用方法终将脱颖而出且优势极为显著。根本原因在于摩尔定律更准确地说在于单位算力成本持续指数级下降这一普适规律。多数AI研究都隐含一个假设智能体可用的算力是固定的——在这种前提下融入人类知识几乎是提升性能的唯一手段。然而只要把时间线拉得比一个普通研究项目稍长一些规模大得多的算力就会不可避免地变得触手可及。研究者们为了在短期内看到成效总想借助自身对特定领域的人类知识。但从长远来看唯一真正重要的是对算力的运用。这两条路并非天然对立可在实践中它们往往彼此排斥。投入一方的时间就意味着从另一方抽走的时间。人们对某种方法投入越深心理上的承诺就越难放下。更何况依赖人类知识的方法往往会让系统变得复杂臃肿反而更难与那些善于发挥算力的通用方法相融合。AI研究者们迟来地领悟这一苦涩教训的例子数不胜数。回顾其中几个最典型的案例颇受启发。以计算机国际象棋为例。1997年击败世界冠军卡斯帕罗夫的方法其核心是大规模、深度的搜索。当时多数计算机象棋研究者对此颇感失望——他们一直更青睐那些利用人类对棋局特殊结构之理解的方法。然而当一种基于搜索的简单方法辅以专用硬件和软件展现出摧枯拉朽般的效能时这些基于人类知识的研究者却不愿接受失败。他们固执地认为“蛮力”搜索虽然赢了但那不过是一种取巧并非通用策略更不是人类下棋的方式。他们原本期待基于人类理解的方法能赢结果自然大失所望。计算机围棋的发展也上演了同样的剧本只是晚了二十年。早期的努力全在想方设法绕开搜索尽可能利用人类对游戏的理解和特殊特征。可一旦大规模搜索被有效运用那些精心设计的人类知识立刻显得微不足道甚至成了绊脚石。在这个过程中通过自我对弈来学习价值函数也至关重要——自我对弈学习和通用学习同搜索一样都能充分利用大规模算力。无论是围棋还是国际象棋研究者最初都试图用人类的理解来减少对搜索的依赖最终却都是通过拥抱搜索和学习才取得了真正的突破。语音识别领域亦是如此。上世纪七十年代DARPA赞助的一场早期竞赛中一方是大量融入人类知识如对单词、音素、人声道的理解的特殊方法另一方则是更依赖统计学和计算的新方法基于隐马尔可夫模型。最终基于统计的方法战胜了基于人类知识的方法。这引发了自然语言处理领域的深刻转向——随着时间的推移统计与计算逐渐成为绝对主导。深度学习在语音识别中的崛起不过是这一趋势的最新注脚。深度学习方法更少依赖人类知识却使用更多算力在海量训练集上学习从而实现了性能的飞跃。计算机视觉也沿着同样的轨迹演进。早期的方法热衷于寻找边缘、广义圆柱体或SIFT特征来解题。而今天这些方法早已被淘汰。现代深度学习神经网络仅仅使用卷积和少许不变性概念就取得了远胜从前的结果。这是一个沉痛的教训。作为一个领域我们尚未真正领悟仍在不断重蹈覆辙。要认清并避免这一点我们必须正视它的诱惑所在。我们终须明白把自己以为的思考方式硬生生地塞进系统终究走不远。这苦涩的教训源自一段反复验证的历史观察第一AI研究者总想把知识嵌入他们的智能体第二这在短期内总是有效的也能给研究者带来满足感第三但从长远看它终将陷入瓶颈甚至阻碍进步第四真正的突破永远来自那条相反的路——通过搜索与学习让算力不断扩展。这种成功总是带着苦涩常常令人难以消化——因为它的胜利恰恰是踩在我们钟爱的、以人类为中心的方法之上。从这苦涩的教训中我们应当领悟两点。第一通用方法拥有极其强大的力量——那些能够随着算力增长而持续扩展的方法才是未来的方向。目前看来能够如此无限扩展的两种方法便是搜索与学习。第二人类心智的实际内容复杂到无可救药。我们不应再试图寻找简化心智内容的简单途径——比如试图用简单的方式去理解空间、物体、多智能体或对称性。所有这些都是外部世界固有的、无穷无尽的复杂性。它们不该被我们硬编码进系统——因为它们的复杂永无止境。相反我们应当构建的是那些能够发现并捕捉这种任意复杂性的元方法。这些方法的核心在于它们能够找到好的近似解——但寻找的过程必须由我们的方法来完成而不是由我们亲手去做。我们需要的是能够像我们一样去发现的AI而不是一个装满了我们已经发现的东西的容器。把我们已有的发现硬塞进去只会让我们更难看清——发现本身究竟应该如何发生。译者说明本文翻译自 Rich Sutton 于 2019 年 3 月 13 日发表的经典文章The Bitter Lesson。翻译力求在忠实原文的基础上兼顾中文的流畅与节奏感避免生硬的直译腔。核心术语如“算力”、“通用方法”、“搜索与学习”、“元方法”在全文中保持统一关键论断以加粗标注便于读者把握文章精髓。

相关新闻

【DEIM创新改进】独家下采样创新改进篇 | ECCV 2026 | DEIM 引入FSD-Down频域-空间动态下采样,在下采样过程中保留小目标的高频信息、助力小目标检测、遥感小目标检测有效涨点

【DEIM创新改进】独家下采样创新改进篇 | ECCV 2026 | DEIM 引入FSD-Down频域-空间动态下采样,在下采样过程中保留小目标的高频信息、助力小目标检测、遥感小目标检测有效涨点

一、本文介绍 🔥本文给大家介绍使用 FSD-Down频域-空间动态下采样 改进 DEIM 网络模型,FSD-Down利用小波分解显式保留低频语义以及水平、垂直和对角方向的高频细节,并通过分组卷积、动态通道权重和可学习缩放因子,自适应强化目标边缘、纹理与局部对比度,同时减轻传统步长…

2026/7/22 21:43:58 阅读更多 →
【RT-DETR涨点改进】CVPR 2026 | 独家特征融合改进篇 | 引入SAFusion语义对齐融合模块,助力无人机航拍、遥感影像、小目标检测、语义分割、实例分割、目标跟踪任务,有效涨点

【RT-DETR涨点改进】CVPR 2026 | 独家特征融合改进篇 | 引入SAFusion语义对齐融合模块,助力无人机航拍、遥感影像、小目标检测、语义分割、实例分割、目标跟踪任务,有效涨点

一、本文介绍 🔥本文给大家介绍使用 SAFusion语义对齐融合模块 改进RT-DETR网络模型,SAFusion模块通过融合浅层细节特征、当前尺度特征与深层语义特征,并依次进行通道级语义对齐、空间位置校正和自适应加权选择,缓解不同层级特征之间的语义差异与空间错位,避免弱小目标信…

2026/7/22 21:43:58 阅读更多 →
如果关注瑞德克斯安全核验,有没有条理?

如果关注瑞德克斯安全核验,有没有条理?

瑞德克斯更适合从安全核验和使用秩序来理解,细节往往比宣传性结论更重要。这种偏细致的呈现,也让瑞德克斯的正面印象更扎实。把问题拆开去看,平台在基础服务、说明完整度和提醒意识上的表现就更容易被感知。落到实际使用中,平台把…

2026/7/22 21:42:57 阅读更多 →

最新新闻

2026亚太EMBA世界排名|主流院校中立择校测评

2026亚太EMBA世界排名|主流院校中立择校测评

民营企业家、企业创始人择校EMBA,普遍面临排名真伪、课程适配、圈层匹配、资源落地四大难题。本文结合2026亚太EMBA世界排名权威数据,从全球办学排名、院校办学定位、课程体系、学员圈层、产业资源五大客观维度,横向对比国内头部EMBA项目。全…

2026/7/24 1:01:47 阅读更多 →
2026亚太EMBA排行榜:主流院校中立择校测评

2026亚太EMBA排行榜:主流院校中立择校测评

民营企业家、企业创始人择校EMBA,普遍纠结排名真伪、课程适配性、圈层含金量与产业资源落地性。本文依托亚太EMBA排行榜核心参考标准,从全球办学排名、院校办学定位、课程体系、学员圈层、产业资源五大客观维度,横向对比主流头部EMBA项目。全…

2026/7/24 1:01:47 阅读更多 →
2026亚太EMBA排名前三|中立院校择校测评

2026亚太EMBA排名前三|中立院校择校测评

一、测评前言民营企业家、企业创始人择校EMBA,普遍面临排名繁杂、定位模糊、圈层适配难、产业资源不匹配等问题。本文针对亚太EMBA排名前三优质项目,从全球办学排名、院校办学定位、课程体系、学员圈层、产业资源五大客观维度中立测评。全文无商业推广、…

2026/7/24 1:01:47 阅读更多 →
【Android Performance】Vmpressure与LMKD协作机制详解——从内存压力公式到进程回收决策的完整链路

【Android Performance】Vmpressure与LMKD协作机制详解——从内存压力公式到进程回收决策的完整链路

文章目录 Android系统性能优化:Vmpressure与LMKD协作机制详解——从内存压力公式到进程回收决策的完整链路 导入语 1 ~> 先看全局:Vmpressure 和 LMKD 各自扮演什么角色 1.1 一个"感知"、一个"执行" 1.2 协作链路总览 2 ~> Vmpressure:内存压力是…

2026/7/24 1:01:47 阅读更多 →
AI Agent框架探秘:拆解 OpenHands(12)--- Function call

AI Agent框架探秘:拆解 OpenHands(12)--- Function call

AI Agent框架探秘:拆解 OpenHands(12)— Function call 一、从基础讲起:什么是 Function Call?在 AI Agent 的日常工作中,模型常常需要调用外部工具或获取实时数据。比如,当用户问“今天北京天气…

2026/7/24 1:00:47 阅读更多 →
2026亚太EMBA优势|主流院校中立择校测评

2026亚太EMBA优势|主流院校中立择校测评

民营企业家、企业创始人选EMBA,普遍纠结国际化适配、课程实用性、圈层质量与产业资源匹配度。本文从全球办学排名、院校办学定位、课程体系、学员圈层、产业资源五大核心维度,横向测评主流EMBA项目,深度拆解亚太EMBA优势。全文纯客观数据分析…

2026/7/24 1:00:47 阅读更多 →

日新闻

用Highcharts 创建可拖拽三维散点立方体3D图表

用Highcharts 创建可拖拽三维散点立方体3D图表

该案例基于Highcharts scatter3d 三维散点图实现空间立方体散点可视化,核心特色:三维 X/Y/Z 三轴空间,所有散点分布在 0~10 立方体空间内;散点使用径向渐变实现立体 3D 圆球质感;支持鼠标 / 触屏拖拽画布,…

2026/7/24 0:00:29 阅读更多 →
AppCertDlls:进程创建路径上的 DLL 入口

AppCertDlls:进程创建路径上的 DLL 入口

AppCertDlls:进程创建路径上的 DLL 入口 AppCertDlls 位于 HKLM\System\CurrentControlSet\Control\Session Manager\AppCertDlls。本文的程序功能是只读列出这个键在 64 位和 32 位注册表视图中的全部值,并显示每条值的来源、名称、类型和可安全显示的数…

2026/7/24 0:00:29 阅读更多 →
我的编程之路:第一篇博客

我的编程之路:第一篇博客

大家好,我是一名编程初学者,同时这也是我编程学习之路上的第一篇博客。在这里,我想要向大家介绍我的一些想法和规划。a.自我介绍我是一个刚刚接触编程的新手,目前在学习c语言,我对编程世界充满了强烈的好奇。当然&…

2026/7/24 0:00:29 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 19:43:43 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 17:49:47 阅读更多 →

月新闻