立场:大语言模型无法“跳跃”
Position: LLMs Can't Jump

原始链接: https://openreview.net/challenge?redirect=%2Fforum%3Fid%3DklU4737opt

OpenReview.net 正在验证您的浏览器 请完成下方验证以继续访问 OpenReview 请完成上述验证。 已有 OpenReview 账号?请登录以跳过此验证。 OpenReview — 开放同行评审。开放出版。开放获取。

这场 Hacker News 的讨论围绕着立场文件《LLMs Can’t Jump》展开。该文认为,大语言模型(LLMs)在结构上无法进行“溯因推理”(abduction)——即生成全新的解释性假设(例如爱因斯坦提出广义相对论的过程)。作者主张,真正的创造性飞跃需要基于感官体验和物理直觉,而这些正是大语言模型所缺乏的。 评论区的争论凸显了几个反复出现的主题: * **能力与局限性:** 许多人认为,“大语言模型无法做某事”的论调正不断改变衡量标准。随着模型的发展,它们展现出了许多曾被认为不可能的推理能力。怀疑论者则坚持认为,大语言模型仅仅是概率性的标记预测器,缺乏“理解力”或真正的创新能力。 * **基础的作用:** 一些参与者同意,物理、感官和“世界模型”输入对于突破性的洞察力是必要的。另一些人则反驳称,抽象的数学和逻辑领域并不需要物理实体的介入,且智能本身最终或许能够跨越这些鸿沟。 * **智能的本质:** 该讨论串探讨了是否应将大语言模型视为强大的、增强型的语言“计算器”,而非独立的自主智能体。人们指出,它们最直接的价值在于提升人类生产力,而非取代人类的创造力。
相关文章

原文

Verifying your browser

Complete the check below to continue to OpenReview

Please complete the verification above.

OpenReview — Open Peer Review. Open Publishing. Open Access.
联系我们 contact @ memedata.com