
决策智能洞察力、结构化思维框架和最佳实践,适用于对决策非常严肃的组织。

在1785年,孔多塞通过数学证明了当观点得到适当汇总时,群体的表现优于个人。谷歌的阿里斯多德项目证实了这一点:心理安全感比团队成员的组成更能预测团队的有效性。科学告诉我们这些——以及何时不应合作。

厌倦了那些人们在会议上空谈却没有实质内容的场合吗?了解如何通过会议前的论点准备、实时评分和完整的决策可追溯性,将浪费的会议时间转化为集中、高效的决策 — 这一切都基于对会议浪费的已发布研究。

从18世纪的法国数学家到麻省理工学院人工智能实验室,群体智能的科学经历了六个时代的演变。以下是完整的历史。

研究表明,多元思维的团队表现优于高智商专家团队。这里是科学依据——以及为什么它比头条新闻所暗示的更为复杂。

在2018年,谷歌创造了一个新的职位名称:首席决策科学家。为什么?因为拥有数据并不等于善用数据。决策智能——由洛里恩·普拉特提出,由卡西·科齐尔科夫实施——弥合了洞察与影响之间的差距。以下是680亿美元市场背后的框架。

在2018年,杰夫·贝索斯揭示了他的决策哲学:“你获得报酬是为了做少量高质量的决策。”他归功于沃伦·巴菲特的方法。以下是完整的采访、10点规则,以及为什么“直觉决策”并不是你想的那样。

杰夫·贝索斯将他的决策哲学归功于沃伦·巴菲特。但巴菲特本人实际上是怎么说的呢?他的20个插槽打卡规则、泰德·威廉姆斯的甜蜜点类比、“接近懒惰的无精打采”,以及他为什么每天阅读500页。9000亿美元背后的真正哲学。

在最近的一次Lex Fridman对话中,埃隆·马斯克大声计算道:“一个好决策的边际价值在一个小时内很容易就能达到一亿美元。”贝索斯每天计算决策数量。巴菲特阅读500页以做准备。马斯克则为每小时定价。这就是为什么这个数字不是虚张声势——以及它对每个规模的每个组织意味着什么。

在皮克斯作为上市公司的十年间,史蒂夫·乔布斯罢免了两名董事会成员——不是因为他们无能,而是因为他们从未与他意见相左。艾德·卡特穆尔的第一手叙述:分歧的领域、《玩具总动员2》的重启、滚石机的隐喻,以及为什么“现实扭曲场”的 caricature 误解了乔布斯的实际决策方式。

弗朗西斯·高尔顿参加了一个乡村集市,原本希望证明普通选民是无望的。然而,787个对一头牛的净重的猜测的中位数竟然在真实值的1%以内——比牛类专家的判断还要准确。这是建立群体智慧的实验的完整故事:方法论、统计数据、注意事项,以及这对今天团队决策的意义。

1785年,一位法国数学家证明了如果每位选民正确的可能性大于错误的可能性,那么多数人几乎总是正确的。这个定理现在为集成AI提供了动力。

产生智慧的相同人群动态也可以产生疯狂。从郁金香狂热到推特暴徒,这里是集体失败的科学——以及如何防止它。

在2013年,沃伦·巴菲特在自己的年度会议上邀请了一位做空者上台,反对伯克希尔,以便为自己辩护。这就是钢铁人辩论。拉波波特的规则、模拟法庭、麦肯锡红队、真实的研究——以及使表演性的魔鬼辩护适得其反的陷阱。

贝索斯用六个字批准了他并不相信的节目:“我不同意,但我承诺”——并希望它能成功。麦肯锡的异议义务、桥水的可信度加权、亚马逊的六页文档:这三者共同拥有的五个结构要素,以及如何在下次会议中实施它们。

1958年,一位哲学家出版了一本关于推理的书,拒绝将其归为形式逻辑,并被告知他已经偏离了正轨。六十年后,所有能够读取记录并告诉你争论内容的系统都使用了他的词汇。论证挖掘的弧线:图尔敏的担保,沃尔顿的关键问题,弗里曼的削弱,使其可测量的语料库,以及那一半从未变得更简单的部分。

给两个训练有素的注释者同一段文字,并询问哪一句是主张。他们经常意见不合——而这个单一的事实塑造了将论证挖掘从理论转变为可测量任务的十年。为什么注释者之间的一致性是真正的上限,为什么体裁比数量更重要,以及为什么更多的数据从未解决关系检测的问题。

分歧在注释数据中占少数——在某些语料库中不到十分之一的关系。因此,模型学习到猜测一致性通常是安全的,这正是你部署模型的原因的反面。有三个结构性原因使得攻击检测难以解决,以及为什么稀有类别是决策所依赖的。

二十年来,“我们能在我们的数据上进行论证挖掘吗?”的答案是另一个问题:你们首先会标注多少千份文档?大型语言模型使这个问题不再被提问。语料库瓶颈的崩溃实际上改变了什么,它又留下了什么,以及以解决方案的名义出现的新陷阱。

将预算会议输入提取引擎,并询问哪个论点最重要,它会给你一个统计数据——这正是错误的。高层次地看我们如何应用论点挖掘:为什么讨论被归类为单词类别,为什么每个类别恰好一个论点成为主要主张,为什么模型自身的信心是选择错误的方式,以及为什么没有任何内容能幸存下来,除非是从你的来源中引用的。

逻辑并不是一次性发明的。在公元前6世纪到4世纪之间,印度、中国和希腊独立发展了复杂的结构化论证系统——后来,伊斯兰学者将希腊逻辑与本土辩论传统进行了综合。这就是《推理的根源》系列的核心:平行出现的重要性、每个传统的贡献,以及全球历史教会我们如何进行有效辩论。

印度辩论理论古老、制度化,并且惊人地程序化:《Nyāya-sūtra》列出了22种输掉辩论的方式。五人三段论是为公共辩论而构建的,而非私人证明。Dignāga的理由之轮是一个九格矩阵,用于区分好证据和坏证据。佛教的prasaṅga、四难题和耆那教的七重资格构成了一个西方大体上未曾建立的工具包。

古典中国思想在没有正式三段论的情况下发展了论证。墨家学派以西方传统所缺乏的精确性分析了辩论(辩)、类比和名词的正确应用。当希腊逻辑问“这是否成立?”时,墨家逻辑问“这个名称是否正确应用?”——这是一个不同的问题,使用了不同的工具。这就是为什么中国逻辑走上了不同的道路,以及它今天所提供的内容。

伊斯兰哲学不仅仅是保留了希腊逻辑——它将其与本土的神学和法律辩论传统相结合,创造出了新的东西。卡拉姆(神学)、基亚斯(法律类比)、贾达尔(辩证法),最终是ʿilm al-munāẓara(争论科学):为结构化辩论制定的正式规则,预示着现代论证协议。这就是传承亚里士多德并改造他的传统。

亚里士多德在西方传统中创立了逻辑的正式研究。他的《工具论》涵盖了范畴、三段论、证明、辩证法和谬误,成为了两千年来逻辑教育的基础。《修辞学》增加了三种诉求(伦理、情感、逻辑)。但亚里士多德实际上建立了什么,他之前有什么,以及他遗漏了什么?理解主导框架对于看到其局限性至关重要。

印度的五项成员三段论、希腊的三项成员三段论、墨子的类比论证、伊斯兰的qiyās以及佛教的四难题——五个文明发展出了五种不同的有效论证结构。对它们的比较揭示了亚里士多德逻辑的强大但不完整,以及全球论证史提供的推理工具比任何单一传统更为丰富。

超级碗历史上最糟糕的进攻战术可以说是一个好的决定——而这种混乱有一个名字。决策质量,斯坦福血统的框架由卡尔·斯佩茨勒正式化,通过六个要素在决策时进行评判:框架、替代方案、信息、价值观、推理、承诺。链条法则(质量 = 最弱环节)、由此产生的陷阱、15分钟的最弱环节检查,以及如何通过改善决策过程机械地提高决策质量。

在商业中使用最广泛的框架——SWOT——没有经过验证的发明者,这从来都不重要:框架之所以传播是因为它们是有用的容器。这个选择器根据决策情况对它们进行分类:战略定位(SWOT、PESTLE、五力模型、BCG)、资金(CBA、NPV、决策树、真实期权)、不确定性(情景规划、ERM)、执行(平衡计分卡、7S、PDCA)、群体思维(六顶思考帽、前景理论)和角色(RAPID)。还有主框架何时使用的表格——以及每个模板跳过的步骤。

在特维斯基和卡尼曼1981年的实验中,将生死选择的措辞从“拯救的生命”改为“失去的生命”使大多数人的选择发生了翻转——在一个框架中,72%的人选择了安全,而在另一个框架中,78%的人选择了冒险。结果相同,决策相反。翻转背后的理论,它在商业中的影响(加倍下注、处置效应、禀赋效应)、复制辩论的真实状态,以及捍卫你决策的框架翻转技巧。

在1994年,默克的首席财务官告诉《哈佛商业评论》,公司使用期权数学为其研究管道定价——因为一个药物项目是一系列继续权,而不是一次全有或全无的赌注。真实期权思维:在你的路线图中隐藏的六种期权类型,为什么不确定性在下行风险被限制时从敌人转变为资产,互联网泡沫后的滥用使这一方法声名狼藉,以及保持其诚实的杀死标准纪律。

大约四分之三的首席财务官使用净现值(NPV)和内部收益率(IRR)(Graham & Harvey, 2001)——这两个指标可能会从同一项目列表中选出相反的赢家。IRR的再投资幻想和规模盲点,NPV的隐性判断(折现率、终值、赞助商撰写的基准案例),为什么放弃折现现金流(DCF)是错误的教训,以及三假设审计如何在十五分钟内将任何模型转变为一个可争辩的案例。