论证:
逻辑学的语言
《简单的逻辑学》第三章|展开精讲|非 ELI5
论证不是观点的堆积,
而是理由对结论承担责任的结构
真正的问题不是“你说了多少”,而是“结论是否由前提支持,以及支持到什么程度”。
第二章建护栏,第三章让推理开始移动
固定概念边界
作出可真可假的断言
提供接受结论的理由
让结论反映证据
逻辑分析的最小单位从“单个命题”升级为“命题之间的支持关系”。
十九个小节,可以压缩为六条学习线
论证骨架
建立论证、断言、否定、论证结构。
范围移动
从全称到特称、从特称到全称。
比较推理
比较、比较与论证。
演绎结构
正确论证、条件论证、三段论。
前提审计
真实性、相关性、事实与价值。
强度与构造
量、质、归纳、评定与构造。
先找到结论,
再问哪些理由真正支持它
没有清楚的前提—结论关系,就只有叙述、解释、情绪或修辞。
论证由前提、推理关系和结论构成
前提是被提供的理由;结论是希望读者据此前提接受的命题;“∴”代表支持关系,不代表结论自动成立。
同一个“因为”,可能在证明,也可能在解释
论证
目标:说明一个尚未被接受的结论为什么应当为真。
“地面是湿的,因为刚刚下过雨。”——把下雨作为地面湿的证据。
解释
目标:在事实已被接受后,说明它为何发生。
双方都已看到地面湿,接着解释其成因。
区分方法:听众是在怀疑“是否如此”,还是在追问“为何如此”?
指示词能帮助定位结构,但不能替代分析
前提信号
它们通常引入支持材料。
结论信号
它们通常引入主张。
最可靠的识别问题是:作者究竟希望我接受哪一句话?其他句子怎样支持它?
日常论证常把最关键的桥梁省略掉
补出隐含前提后,争议常从情绪转为可检查的问题:位置是否必要?“过度”的标准是什么?
演绎的典型移动:把一般规则应用到个案
全称规则
所有已撤销证书都不得继续建立可信连接。
个案归类
证书 A 已被撤销。
特称结论
证书 A 不得继续建立可信连接。
在现代形式逻辑中,从“所有 S 都是 P”单独推出“某个 S 是 P”还需要 S 存在;此处个案前提提供了存在信息。
从一般规则到个案,必须通过三道门
规则成立吗?
全称前提是否真实,是否包含例外与适用条件?
个案归类对吗?
当前对象是否真的属于规则主项所指的类别?
结论超界了吗?
有没有加入规则和个案前提都未包含的新信息?
许多“按规定办”的错误,不在推理形式,而在规则被断章取义或个案被错误分类。
形式正确,也可能因归类错误而得出假结论
形式
所有机密文件都须加密
文件 A 是机密文件
∴ 文件 A 须加密形式有效:若前提真,结论不可能假。
争议点
文件 A 是否真的属于
“机密文件”类别?若分类依据只是文件名含“secret”,前提二可能为假。
有效性保护的是结构,不替你核验分类事实。
归纳的典型移动:由观察样本估计更大范围
样本 a 有属性 P
更多样本也有 P
总体 S 很可能有 P
箭头从“必然推出”变成“增加可信度”:结论可强可弱,但始终可被新证据修正。
结论覆盖越广,证据成本越高
从“我遇到两次”直接跳到“这类人都如此”,不是大胆洞察,而是没有支付范围扩张的证据成本。
样本数量不是唯一问题,样本怎样进入更重要
代表性
样本是否覆盖总体关键差异?
选择偏差
谁更容易或更愿意进入样本?
独立性
多个观察是否其实来自同一来源?
稳定性
结果是否跨时间、场景重复出现?
一万个来自同一社群的自愿回答,可能不如一个设计良好的小型随机样本。
每一次断言,
都在把属性连接到对象
主项、谓项、范围和否定位置,决定你到底承诺了什么。
“S 是 P”看似简单,却包含一项事实承诺
归属
“鲸是哺乳动物”
属性
“这份报告不完整”
身份
“晨星是金星”
不能把属于集合的属性直接归给每个成员
集合层级
“这个团队规模很大。”
谓词“规模很大”描述整体。
成员层级
不能因此推出:“团队里的每个人体型都很大。”
整体属性并不自动分配给每个成员。
反向也要警惕:每个零件很轻,不代表组合后的系统一定很轻。
否定不是“说相反话”,而是精确撤销某个断言
谓项否定
“有些申请不是完整的。”
∃x(Sx ∧ ¬Px)
全称否定
“没有申请是匿名的。”
∀x(Sx → ¬Px)
命题否定
“并非所有申请都完整。”
¬∀x(Sx → Px)
第三句通常等价于“至少有一个申请不完整”,并不等价于“所有申请都不完整”。
“不是所有”与“所有都不是”相差一个世界
否定词放在哪里,决定你否定的是范围、关系,还是知识状态。
形式逻辑中的双重否定,和日常语气不总是同一回事
形式层面
经典逻辑中,否定一个否定恢复原命题。
语用层面
“这并非不可能”常表达较弱的可能性或谨慎态度,并不等同于强烈肯定“这一定可能”。
逻辑内容与说话力度需要分开分析。
比较不是把两个数字
摆在一起就结束
可比性需要共同维度、共同尺度、共同基准和相关差异。
一个有效比较至少要交代四件事
对象
比较的两组对象是否属于可比类别?
维度
成本、速度、质量还是风险?
尺度
使用什么单位、算法与时间窗口?
基准
与过去、目标、对手还是对照组相比?
“A 比 B 更好”如果没有维度和权重,只是一句未完成的命题。
绝对数经常不可比,先转换到共同分母
| 表面比较 | 问题 | 标准化 |
|---|---|---|
| A 店投诉 100,B 店投诉 60 | 订单量不同 | 每万单投诉率 |
| 今年营收高于去年 | 价格与通胀变化 | 实际增长率、同店口径 |
| 模型 A 错误更少 | 样本难度不同 | 同一测试集与分组指标 |
| 团队甲交付更多 | 任务复杂度不同 | 按验收难度或价值分层 |
类比的力量取决于“相关相似”,不是相似数量
相关性
相似点是否与 P 有机制关系?
关键差异
是否存在足以破坏推断的差异?
多样案例
是否只挑了一个方便的类比对象?
类比可以照亮问题,也可以偷渡不相干义务
有用相似
都需要信任、协作、长期关系和冲突修复。
这些相似点可用于讨论团队氛围。
关键差异
公司有合同、绩效、退出机制和权力层级;家庭关系并非等价交换。
不能由“像家庭”推出员工应无条件牺牲。
类比不是身份判断。“A 像 B”只授权转移与相关相似点有关的结论。
正确论证需要
结构与材料同时合格
有效性回答“若前提真会怎样”;可靠性还要求前提实际上为真。
把形式有效和前提真实分开
结论必真
结论真假未定
偶然得到真结论,不会把一个无效论证变成好论证;逻辑评价关注“理由是否真正支持”。
有效:不存在“前提全真而结论为假”的可能情形
看结构
把具体内容替换后,支持关系仍成立。
假设前提真
评估有效性时暂不争论前提事实。
寻找反模型
只需构造一个前提真、结论假的情形即可证无效。
检验结构最有效的方法:尝试让前提真而结论假
原论证
所有医生都受过专业训练
李明受过专业训练
∴ 李明是医生反模型
李明可以是律师
他也受过专业训练
但不是医生前提可全真而结论假,所以形式无效。
反模型不需要证明现实中的李明是谁;它只需展示该结构允许失败。
条件命题连接前件与后件:如果 P,那么 Q
前件 P
提出足以触发条件关系的情形。
后件 Q
在 P 成立时被保证或预期的结果。
它本身不承诺 P 实际成立,也不承诺 Q 只有通过 P 才能成立。
肯定前件与否定后件
肯定前件 Modus Ponens
P → Q
P
∴ Q若付款成功则生成订单;付款成功;所以生成订单。
否定后件 Modus Tollens
P → Q
¬Q
∴ ¬P若付款成功则生成订单;未生成订单;所以付款未成功。
这里假设条件前提本身没有例外;现实系统若可能“付款成功但订单生成失败”,就应先修正第一前提。
肯定后件与否定前件
肯定后件
P → Q
Q
∴ P下雨会地湿;地湿;所以一定下雨。忽略洒水等其他原因。
否定前件
P → Q
¬P
∴ ¬Q坐高铁能到上海;没坐高铁;所以没到上海。忽略飞机等路径。
“如果 P 那么 Q”:P 充分,Q 必要
P 是 Q 的充分条件
P 一旦成立,足以保证 Q;但 Q 可能还有其他来源。
Q 是 P 的必要条件
没有 Q 就不可能有 P;但有 Q 不保证一定有 P。
自然语言中的“只有、只要、除非、必须”方向不同,标准化时要先确认箭头指向。
三段论用中项把小项连接到大项
小项
结论主项
中项
仅在前提
大项
结论谓项
M 是桥梁:大前提连接 M 与 P,小前提连接 S 与 M,结论连接 S 与 P。
经典有效形式:Barbara
中项“哺乳动物”在两条前提中建立包含关系,但不出现在结论中。
中项若从未覆盖其整个类别,就无法保证两端相连
中项不周延
所有猫都是动物
所有狗都是动物
∴ 所有狗都是猫“动物”在两个肯定谓项位置都未指全体动物。
结构图像
猫和狗都可位于“动物”大集合内部,却彼此分离。共享上位类不等于互相包含。
NOT BUILT
传统三段论的五项快速检查
三项
只能有 S、P、M 三个含义固定的项。
中项
M 至少在一条前提中周延。
分配
结论中周延的项,前提中也须周延。
否定
两个否定前提不能推出结论。
质一致
有一否定前提,就应有否定结论。
现代布尔解释还需注意存在预设:两个全称前提不能无条件推出特称结论。
结构再漂亮,
也承载不了虚假或无关的前提
前提要同时通过真实性、相关性和类型审计。
前提的真实性必须独立核验
来源:信息来自原始记录、可靠二手资料还是转述?
口径:数字的分母、时间、范围、定义是否明确?
时效:前提现在仍然成立,还是已被环境变化淘汰?
独立性:多个来源是否其实互相抄引同一个错误来源?
“研究表明”不是前提真实性的通行证
| 检查层 | 追问 | 常见失败 |
|---|---|---|
| 研究对象 | 样本是谁? | 用大学生样本概括所有成年人 |
| 研究设计 | 观察还是随机实验? | 把相关结果说成因果 |
| 效应大小 | 差异多大、区间多宽? | 只报告“显著” |
| 重复性 | 是否被独立重复? | 把单篇论文当定论 |
真实前提也可能与结论毫无关系
相关前提
若前提为真,会提高结论为真的概率,或在演绎上排除结论为假的可能。
无关前提
可能有趣、感人、权威、令人愤怒,但不会改变结论的逻辑可信度。
相关性的检验不是“这句话重要吗”,而是“删除它,结论的支持度会下降吗?”
每条前提都应能画出通往结论的支持路径
新流程将平均审批步骤从 7 步降到 4 步
减少等待与重复转交
处理周期下降
新流程可能提高审批效率
若“CEO 支持该流程”无法连接到效率指标,它可解释决策背景,却不能证明流程有效。
事实命题描述“是什么”,价值命题评价“好不好、应不应”
事实命题
原则上可通过观察、记录或经验研究判定。
“方案 A 的成本比 B 高 18%。”
价值命题
包含评价标准、目标优先级或规范承诺。
“多花 18% 换取更高安全性是值得的。”
价值命题并非“纯主观所以不能讨论”;它需要公开标准、后果与权衡。
仅靠事实前提,通常推不出规范性结论
把价值桥梁写出来,才能讨论“成本可接受”的阈值、权利限制和替代方案。
评价一个价值前提,检查四个维度
一致性
同类情形是否采用同一标准?
普遍化
若人人遵循,该原则能否承受?
后果
利益、伤害与风险如何分配?
权利边界
是否有不能被总效益轻易覆盖的限制?
价值分歧常不是“有理与无理”,而是不同原则、权重和责任边界之间的冲突。
让结论只说
前提真正授权它说的话
量不能扩大,质不能反转,隐藏结构必须显形。
把散文还原成标准论证的五步
圈出作者最终希望接受的结论。
将每个独立理由改写成完整命题。
删除修辞、重复、背景与纯解释性材料。
补出使前提能够连接结论的隐含前提。
按支持顺序编号,并标注演绎或归纳关系。
前提可以联合工作,也可以各自独立支持
联合支持
缺少任一前提,支持链就断裂。例如规则前提与个案归类前提。
独立支持
P2 → C
每条前提单独提升结论可信度,例如多个独立证据来源。
论证图能揭示:反驳一条前提会摧毁整个论证,还是只削弱其中一条证据线。
前提只谈“有些”,结论不能擅自升级为“所有”
非法扩大
有些短视频包含错误信息
∴ 短视频都是不可信的从特称直接跳到全称。
范围相称
样本中 18% 的视频含可核实错误
∴ 该样本存在显著错误信息问题结论保留样本与比例边界。
数量范围最常见的三种越界
样本 → 总体
没有抽样依据,却把观察人群推广到全部对象。
大多数 → 所有
把高比例趋势改写成无例外规律。
存在 → 普遍
用一个成功案例证明方法对任何场景有效。
结论中的量词,是你向现实开出的承诺额度。
结论的肯定或否定必须由前提中的关系决定
两肯定前提
不能凭空推出否定结论。
一否定前提
若结构有效,结论应为否定。
两否定前提
无法建立两个项之间的确定联系。
从“未证明”不能推出“已经证明为假”
错误
没有证据证明该添加剂有害
∴ 该添加剂已被证明无害把知识缺口转换成反面事实。
相称
现有研究未发现显著伤害证据
∴ 目前不能确认存在显著伤害结论保留证据状态与时间边界。
归纳不保证结论,
但可以让结论变得更有理由
强归纳追求的是概率支持、可复制性与对替代解释的抵抗力。
常见归纳不是一种,而是多种证据结构
枚举归纳
由样本频率估计总体。
类比推理
由相关相似推测新属性。
因果推断
由时间、机制与干预支持因果。
最佳解释
选择最能统摄证据的假设。
不同结构需要不同评估问题:不能只用“样本够不够大”评价所有归纳。
强归纳:前提为真时,结论很可能为真
样本
数量与代表性
一致
跨场景重复
独立
证据源不共因
机制
解释为何相关
反证
主动寻找失败
归纳强度不是“我有很多理由”,而是这些理由共同排除了多少竞争解释。
两种论证追求不同的成功条件
| 维度 | 演绎 | 归纳 |
|---|---|---|
| 目标 | 必然保持真 | 提高结论概率 |
| 评价 | 有效 / 无效 | 强 / 弱 |
| 反例作用 | 反模型证明无效 | 削弱强度、调整范围 |
| 新证据 | 不改变既定有效形式 | 可能显著改变可信度 |
| 典型用途 | 规则应用、数学证明 | 科学、预测、政策决策 |
论证评定不是一句“我不同意”
结构
前提若真,是否足以或大幅支持结论?
前提
每条前提是否真实、清楚、可核验?
相关
每条材料是否真正改变结论可信度?
范围
结论的量和质是否超出前提?
替代
是否有同样解释证据的竞争假设?
缺失
是否遗漏关键反例、成本或隐含前提?
用六维评分替代模糊印象
| 维度 | 0 分 | 1 分 | 2 分 |
|---|---|---|---|
| 结论清晰 | 找不到结论 | 可推测 | 明确限定 |
| 前提真实 | 明显错误 | 部分可证 | 来源可靠 |
| 相关性 | 多为无关材料 | 部分相关 | 路径清楚 |
| 支持强度 | 几乎不支持 | 有限支持 | 与结论相称 |
| 反方处理 | 完全回避 | 提及 | 公平回应 |
评分是诊断工具,不是把复杂判断伪装成精确数学。
先重建对方最合理的版本,再进行批评
消除歧义
在语境允许时选择最连贯的解释。
补充显然前提
补出对方合理依赖但省略的桥梁。
保留真实意图
不把谨慎主张夸大成容易攻击的全称。
击败一个被你削弱的版本,只证明你擅长制造稻草人。
好的论证不是写出来的,
而是设计、测试和压缩出来的
先决定结论的精确范围,再选择能真正承担它的证据。
从问题到可审计论证
1 问题
明确要解决的争议。
2 结论
写出可真可假的一句话。
3 定义
固定关键词与范围。
4 证据
收集支持与反对材料。
5 结构
安排联合与独立支持。
6 压力测试
找反模型、反例与替代解释。
7 校准
把结论强度降到证据能够承担。
交付
公开假设、限制与更新条件。
先把结论写成能被反驳的句子
弱写法
“我们需要重视人工智能带来的影响。”
无法判断范围、行动和成功条件。
可审计写法
“在未来六个月,客服团队应对外发回复启用人工复核,因为当前自动回复的高风险错误率超过 2% 阈值。”
对象、时间、行动、理由和阈值都可检验。
反对意见应进入论证结构,而不是最后礼貌提一句
应采用方案 A
收益、风险、可行性
成本与替代方案
在条件 X 下采用 A
有时最诚实的回应不是“击败反方”,而是缩小结论或增加实施条件。
“公司应实行四天工作制”如何变成完整论证
| 层级 | 内容 | 审计点 |
|---|---|---|
| 结论 | 研发部门进行 12 周、薪酬不变的四天制试点 | 限定部门、周期与形式 |
| 事实前提 | 相似团队试点后产出未降,离职意愿下降 | 样本可比性 |
| 机制前提 | 减少低价值会议可抵消工时下降 | 是否有流程数据 |
| 价值前提 | 在产出不降时,应重视员工可支配时间 | 价值权重公开 |
| 反对意见 | 客户支持覆盖可能不足 | 轮班与服务指标 |
| 退出条件 | 关键交付连续两周低于基线 10% | 可证伪与回滚 |
发布一个重要论证前,完成十二项检查
结论是否能用一句可反驳的话表达?
前提与结论是否已经分开编号?
关键术语是否保持同一含义?
隐藏前提是否已经公开?
每条事实前提是否可核验?
每条前提是否真正相关?
形式是演绎有效还是归纳较强?
量与质是否越过前提授权?
事实到价值之间是否有规范桥梁?
是否检验了反模型、反例与替代解释?
是否公平回应最强反对意见?
什么新证据会让你修改结论?
四组练习,把论证结构变成直觉
标准化
从一篇评论中抽取 P1、P2、C 和隐含前提。
反模型
为三个“看起来合理”的演绎论证寻找反模型。
范围校准
把“所有、一定、证明了”降到证据可承担的强度。
钢人化
先替反对立场写出最强版本,再回应。
练习目标不是更快反驳,而是更快看见“这个结论究竟靠什么站着”。
好论证让结论
不多说一句,也不少承担一分
资料、方法与版权边界
本文件依据公开目录与出版信息制作,是原创分析性讲义,不是原文翻译、逐段改写或章节替代。
中文目录核对
豆瓣阅读公开目录:第三章“论证:逻辑学的语言”及 19 个小节。
read.douban.com/ebook/29260314/
英文目录核对
Google Books:The Language of Logic 分部目录、书目信息与作者定位。
books.google.com/books?id=Cj6FDwAAQBAJ
操作:← → / PageUp PageDown / 空格切页;手机左右滑动;滚轮切页;T 目录;F 全屏;E 编辑;Ctrl+S 下载编辑后的 HTML。