这篇散文探讨了那些因慢性病或残疾而无法持续参与工作的人所面临的根深蒂固的羞耻感与系统性困境。受新教职业道德影响,现代西方文化将生产力与人类美德混为一谈,致使残障人士认为自己无法“履行职责”是一种道德失败。 作者强调了这种意识形态如何营造了一种敌对环境,即残疾被视为对资本主义所幻想的“独立躯体”的破坏。除了应对慢性病带来的生理和代谢损伤外,残障人士还面临着系统性贫困、社会保障网不足,以及为了证明自己“有资格”获得支持而背负的沉重负担。 通过分享失去经济自主权的个人悲痛,作者揭示了我们的自我价值是如何与经济效用深度捆绑的。最终,这篇文章呼吁将我们的人性与产出剥离开来。它挑战读者去打破人类仅仅是劳动机器的固有信念,并提出了一个至关重要的问题:如果我们被剥夺了生产力,我们还能在自身看到怎样的内在价值?我们又该如何构建一个能够承认人类经验中基本脆弱性的社会?
作者认为,要求大语言模型(LLM)生成自我评估的“置信度分数”(尤其是 0–100 的连续量表)在很大程度上是无用的,且在科学上是无效的。尽管 LLM 表现出了一定的内部推理能力,但它们缺乏准确量化自身确定性的元认知能力。
要点如下:
* **“心理安慰”:** 置信度分数往往只是开发者的心理慰藉,在并未提升模型性能的情况下,营造了一种虚假的可靠感。
* **缺乏校准:** 传统的机器学习使用成熟的方法(如 Platt 缩放)来衡量不确定性,而 LLM 的置信度分数是主观且未经核实的,往往倾向于集中在某些任意数字上。
* **“谁来监督监督者”的问题:** 任何用于“验证” LLM 置信度的机制本身也需要被验证,这会导致无限回归。
* **更好的替代方案:** 如果模型意识到自己可能出错,应该提示它进行自我纠正或执行基于检索的搜索,而不是简单地给一个可能存在缺陷的输出附加一个分数。
最终,作者认为这些分数只是“凭感觉”而非测量结果。真正的工作重点应放在严谨的检索系统和定义明确的任务特定启发式方法上,而非数值型的置信度代理指标。
出于好奇,一名博士生对“益生菌茶”这种备受质疑的营销产品进行了调查。虽然标准的冲泡温度理应杀死大多数细菌,但该学生发现,产品中所使用的特定菌株——凝结芽孢杆菌(BC30)——是一种能够耐受沸水的芽孢杆菌。
这项实验凸显了商业营销与生物学现实之间的差距。尽管细菌确实存活了下来,但茶中的含量仅为临床试验常用剂量的极小一部分,这对其宣称的健康益处引发了质疑。这一叙述将该实验与科学发现的漫长历史联系起来——从路易·巴斯德关于发酵的奠基性工作,到麻省理工学院那罐保存了二十七年的变质牛奶的离奇轶事。
更深层的启示在于,我们现代对“细菌的战争”因一个靠兜售微生物作为保健品获利的行业而变得复杂。归根结底,这个故事强调了科学突破往往源于对他人弃之不顾的事物进行更深入的研究。无论是麻省理工宿舍里的好奇心,还是对消费品的怀疑性分析,质疑平凡——甚至是质疑“垃圾”——正是科学进步的本质。