The Bitter Lesson优雅中译(苦涩的教训)
作者Rich Sutton时间2019年3月13日七十年来人工智能研究教会我们的最大一课是那些善于利用算力的通用方法终将脱颖而出且优势极为显著。根本原因在于摩尔定律更准确地说在于单位算力成本持续指数级下降这一普适规律。多数AI研究都隐含一个假设智能体可用的算力是固定的——在这种前提下融入人类知识几乎是提升性能的唯一手段。然而只要把时间线拉得比一个普通研究项目稍长一些规模大得多的算力就会不可避免地变得触手可及。研究者们为了在短期内看到成效总想借助自身对特定领域的人类知识。但从长远来看唯一真正重要的是对算力的运用。这两条路并非天然对立可在实践中它们往往彼此排斥。投入一方的时间就意味着从另一方抽走的时间。人们对某种方法投入越深心理上的承诺就越难放下。更何况依赖人类知识的方法往往会让系统变得复杂臃肿反而更难与那些善于发挥算力的通用方法相融合。AI研究者们迟来地领悟这一苦涩教训的例子数不胜数。回顾其中几个最典型的案例颇受启发。以计算机国际象棋为例。1997年击败世界冠军卡斯帕罗夫的方法其核心是大规模、深度的搜索。当时多数计算机象棋研究者对此颇感失望——他们一直更青睐那些利用人类对棋局特殊结构之理解的方法。然而当一种基于搜索的简单方法辅以专用硬件和软件展现出摧枯拉朽般的效能时这些基于人类知识的研究者却不愿接受失败。他们固执地认为“蛮力”搜索虽然赢了但那不过是一种取巧并非通用策略更不是人类下棋的方式。他们原本期待基于人类理解的方法能赢结果自然大失所望。计算机围棋的发展也上演了同样的剧本只是晚了二十年。早期的努力全在想方设法绕开搜索尽可能利用人类对游戏的理解和特殊特征。可一旦大规模搜索被有效运用那些精心设计的人类知识立刻显得微不足道甚至成了绊脚石。在这个过程中通过自我对弈来学习价值函数也至关重要——自我对弈学习和通用学习同搜索一样都能充分利用大规模算力。无论是围棋还是国际象棋研究者最初都试图用人类的理解来减少对搜索的依赖最终却都是通过拥抱搜索和学习才取得了真正的突破。语音识别领域亦是如此。上世纪七十年代DARPA赞助的一场早期竞赛中一方是大量融入人类知识如对单词、音素、人声道的理解的特殊方法另一方则是更依赖统计学和计算的新方法基于隐马尔可夫模型。最终基于统计的方法战胜了基于人类知识的方法。这引发了自然语言处理领域的深刻转向——随着时间的推移统计与计算逐渐成为绝对主导。深度学习在语音识别中的崛起不过是这一趋势的最新注脚。深度学习方法更少依赖人类知识却使用更多算力在海量训练集上学习从而实现了性能的飞跃。计算机视觉也沿着同样的轨迹演进。早期的方法热衷于寻找边缘、广义圆柱体或SIFT特征来解题。而今天这些方法早已被淘汰。现代深度学习神经网络仅仅使用卷积和少许不变性概念就取得了远胜从前的结果。这是一个沉痛的教训。作为一个领域我们尚未真正领悟仍在不断重蹈覆辙。要认清并避免这一点我们必须正视它的诱惑所在。我们终须明白把自己以为的思考方式硬生生地塞进系统终究走不远。这苦涩的教训源自一段反复验证的历史观察第一AI研究者总想把知识嵌入他们的智能体第二这在短期内总是有效的也能给研究者带来满足感第三但从长远看它终将陷入瓶颈甚至阻碍进步第四真正的突破永远来自那条相反的路——通过搜索与学习让算力不断扩展。这种成功总是带着苦涩常常令人难以消化——因为它的胜利恰恰是踩在我们钟爱的、以人类为中心的方法之上。从这苦涩的教训中我们应当领悟两点。第一通用方法拥有极其强大的力量——那些能够随着算力增长而持续扩展的方法才是未来的方向。目前看来能够如此无限扩展的两种方法便是搜索与学习。第二人类心智的实际内容复杂到无可救药。我们不应再试图寻找简化心智内容的简单途径——比如试图用简单的方式去理解空间、物体、多智能体或对称性。所有这些都是外部世界固有的、无穷无尽的复杂性。它们不该被我们硬编码进系统——因为它们的复杂永无止境。相反我们应当构建的是那些能够发现并捕捉这种任意复杂性的元方法。这些方法的核心在于它们能够找到好的近似解——但寻找的过程必须由我们的方法来完成而不是由我们亲手去做。我们需要的是能够像我们一样去发现的AI而不是一个装满了我们已经发现的东西的容器。把我们已有的发现硬塞进去只会让我们更难看清——发现本身究竟应该如何发生。译者说明本文翻译自 Rich Sutton 于 2019 年 3 月 13 日发表的经典文章The Bitter Lesson。翻译力求在忠实原文的基础上兼顾中文的流畅与节奏感避免生硬的直译腔。核心术语如“算力”、“通用方法”、“搜索与学习”、“元方法”在全文中保持统一关键论断以加粗标注便于读者把握文章精髓。

相关新闻

【DEIM创新改进】独家下采样创新改进篇 | ECCV 2026 | DEIM 引入FSD-Down频域-空间动态下采样,在下采样过程中保留小目标的高频信息、助力小目标检测、遥感小目标检测有效涨点

【DEIM创新改进】独家下采样创新改进篇 | ECCV 2026 | DEIM 引入FSD-Down频域-空间动态下采样,在下采样过程中保留小目标的高频信息、助力小目标检测、遥感小目标检测有效涨点

一、本文介绍 🔥本文给大家介绍使用 FSD-Down频域-空间动态下采样 改进 DEIM 网络模型,FSD-Down利用小波分解显式保留低频语义以及水平、垂直和对角方向的高频细节,并通过分组卷积、动态通道权重和可学习缩放因子,自适应强化目标边缘、纹理与局部对比度,同时减轻传统步长…

2026/7/22 21:43:58 阅读更多 →
【RT-DETR涨点改进】CVPR 2026 | 独家特征融合改进篇 | 引入SAFusion语义对齐融合模块,助力无人机航拍、遥感影像、小目标检测、语义分割、实例分割、目标跟踪任务,有效涨点

【RT-DETR涨点改进】CVPR 2026 | 独家特征融合改进篇 | 引入SAFusion语义对齐融合模块,助力无人机航拍、遥感影像、小目标检测、语义分割、实例分割、目标跟踪任务,有效涨点

一、本文介绍 🔥本文给大家介绍使用 SAFusion语义对齐融合模块 改进RT-DETR网络模型,SAFusion模块通过融合浅层细节特征、当前尺度特征与深层语义特征,并依次进行通道级语义对齐、空间位置校正和自适应加权选择,缓解不同层级特征之间的语义差异与空间错位,避免弱小目标信…

2026/7/22 21:43:58 阅读更多 →
如果关注瑞德克斯安全核验,有没有条理?

如果关注瑞德克斯安全核验,有没有条理?

瑞德克斯更适合从安全核验和使用秩序来理解,细节往往比宣传性结论更重要。这种偏细致的呈现,也让瑞德克斯的正面印象更扎实。把问题拆开去看,平台在基础服务、说明完整度和提醒意识上的表现就更容易被感知。落到实际使用中,平台把…

2026/7/22 21:42:57 阅读更多 →

最新新闻

【硬核】2026 Java 进阶指南:Spring AI 2.0 + JDK 25 实战 Agent 开发

【硬核】2026 Java 进阶指南:Spring AI 2.0 + JDK 25 实战 Agent 开发

前言:Java 生态的 AI 工程化拐点 2026 年,对于 Java 后端开发者而言,注定是极具转折意义的一年。随着 JDK 25 LTS(长期支持版)的正式发布,以及 Spring AI 2.0 将核心定位从“大模型接入”全面转向“Agent 基…

2026/7/22 22:29:14 阅读更多 →
古代黑科技延伸推演:华夏无源古机械五维体系 在月球深空探测中的工程落地价值

古代黑科技延伸推演:华夏无源古机械五维体系 在月球深空探测中的工程落地价值

一、深空探测的核心痛点:电子体系的“极端环境脆弱性” 现代登月、深空探测体系,高度依赖芯片、传感器、电池、电控执行机构与卫星导航。 但宇宙真实环境极其苛刻: 月球无地磁场,电子罗盘彻底失效;太阳风暴、高能宇宙射…

2026/7/22 22:29:14 阅读更多 →
Liquid模板引擎终极指南:在React/Vue中构建安全动态内容

Liquid模板引擎终极指南:在React/Vue中构建安全动态内容

Liquid模板引擎终极指南:在React/Vue中构建安全动态内容 【免费下载链接】liquid Liquid markup language. Safe, customer facing template language for flexible web apps. 项目地址: https://gitcode.com/gh_mirrors/li/liquid Liquid模板引擎是GitHub加…

2026/7/22 22:29:14 阅读更多 →
ComfyUI-LTXVideo终极指南:本地AI视频生成完整教程

ComfyUI-LTXVideo终极指南:本地AI视频生成完整教程

ComfyUI-LTXVideo终极指南:本地AI视频生成完整教程 【免费下载链接】ComfyUI-LTXVideo LTX-Video Support for ComfyUI 项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI-LTXVideo 你是否梦想过在本地电脑上生成高质量AI视频,摆脱云端服…

2026/7/22 22:29:14 阅读更多 →
AI客户生命周期管理落地失败真相(92%企业踩中的3个算法陷阱)

AI客户生命周期管理落地失败真相(92%企业踩中的3个算法陷阱)

更多请点击: https://intelliparadigm.com 第一章:AI客户生命周期管理落地失败真相(92%企业踩中的3个算法陷阱) 当企业将AI模型嵌入客户获取、留存与价值提升环节时,87%的项目在6个月内遭遇显著ROI衰减——根源并非数…

2026/7/22 22:29:14 阅读更多 →
测试123

测试123

测试123123

2026/7/22 22:28:13 阅读更多 →

日新闻

TI DSP系统配置模块SYSCFG详解:中断机制与主设备优先级配置实战

TI DSP系统配置模块SYSCFG详解:中断机制与主设备优先级配置实战

1. 项目概述与SYSCFG模块的核心价值在嵌入式系统,尤其是像TI C6000系列这样的高性能DSP开发中,我们常常会与芯片手册里那些密密麻麻的寄存器打交道。很多开发者可能更关注算法实现、内存优化或者外设驱动,但对于一个稳定、高效的系统而言&…

2026/7/22 0:00:26 阅读更多 →
微信Server酱:高到达率的应急通知方案实践

微信Server酱:高到达率的应急通知方案实践

1. 为什么我们需要"最次"的通知方案? 在数字化协作环境中,消息通知系统的重要性不言而喻明。但现实情况是,企业级通知方案往往需要复杂的API对接(如企业微信、钉钉、飞书),个人开发者的小项目又经…

2026/7/22 0:00:26 阅读更多 →
甲方要的“简洁“PPT,到底是简洁还是省事?

甲方要的“简洁“PPT,到底是简洁还是省事?

甲方说"简洁一点",乙方听到的是"少做几页"。甲方说"不要太复杂",乙方理解成"别放图表了"。结果交过去,甲方说"我说的简洁不是这个意思"。"简洁"这个词在PPT语境里,是…

2026/7/22 0:00:26 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 19:43:43 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 12:54:44 阅读更多 →

月新闻