arXivLabs 是一个允许合作者直接在我们的网站上开发和共享 arXiv 新功能的框架。与 arXivLabs 合作的个人和组织都认同并接受我们关于开放、社区、卓越和用户数据隐私的价值观。arXiv 致力于坚守这些价值观,并仅与遵守这些价值观的合作伙伴进行合作。如果您有能为 arXiv 社区增值的项目想法,欢迎了解更多关于 arXivLabs 的信息。
arXivLabs 是一个允许合作者直接在我们的网站上开发和共享 arXiv 新功能的框架。与 arXivLabs 合作的个人和组织都认同并接受我们关于开放、社区、卓越和用户数据隐私的价值观。arXiv 致力于坚守这些价值观,并仅与遵守这些价值观的合作伙伴进行合作。如果您有能为 arXiv 社区增值的项目想法,欢迎了解更多关于 arXivLabs 的信息。
作为一名在波斯语与英语双语家庭中抚养孩子的历史学家,本杰明·布林(Benjamin Breen)探讨了词源学如何成为连接遥远过去与现代生活的桥梁。
通过考察语言中的“同源词”(即跨越遥远距离、拥有共同词根的词汇),布林展示了我们之间深刻且常被忽视的相互联系。他追溯了波斯语单词“div”(恶魔)的词源,发现其源自古印欧语中的“神”,由此说明了数千年前的宗教分裂是如何将神灵转变为恶魔的。同样,他还强调了诸如《铁匠与魔鬼》这类古老故事是如何流传数千年的,这表明我们的一些古老民间传说可能早于文字历史。
布林还利用词源学来揭示近期的文化转变,例如“hello”(你好)一词的出现。事实上,“hello”并非古已有之,它直到19世纪后期才成为标准问候语,这是早期电话技术所带来的需求。通过这些例子,布林提出词源学不仅仅是一项智力练习;它更是一种揭示塑造我们当下的“消逝的思想世界”的工具,揭示了当代话语中常被忽视的共有的人类历史。
作者分享了将 Claude 等大语言模型(LLM)整合到专业游戏开发中的经验,其态度从最初的怀疑转变为谨慎且有限的使用。虽然作者拒绝接受围绕人工智能的“魔法”营销,但发现它在处理内部公司文档和复杂、陌生的代码库时,作为研究工具具有一定价值。 然而,作者强烈警告不要依赖大语言模型来编写代码。他们认为这些模型经常产生“幻觉”,提供过度设计或低效的解决方案,并且缺乏深入的技术推理,尤其是在游戏开发这类训练数据通常较差的利基领域。作者指出,大语言模型本质上并不“智能”,它们只是容易生成自信误导信息的统计引擎。 最终,作者认为大语言模型是用于信息检索和新人入职的一种有用但昂贵的辅助手段,而非工程专业知识的替代品。他们批评了管理层强制要求订阅昂贵 AI 服务的趋势,建议企业应优先进行成本效益分析,而非盲从于“平庸产出”的流行语。作者总结道,虽然人工智能可以辅助处理信息,但它无法取代构建健壮、高效软件所必需的第一性原理思考、验证和深厚的领域知识。
Soup 是一款精简的命令行工具,旨在简化大语言模型(LLM)的微调过程,无需复杂的 SSH 配置或基础设施管理。用户仅需一个 YAML 配置文件和一条命令,即可完成模型的训练、评估与部署。
**主要功能:**
* **层级流式传输(Layer Streaming):** 将冻结的基座模型卸载至系统内存并逐层处理,使 4GB 显存的硬件也能训练大型模型(如 8B 参数模型)。
* **多功能性:** 支持多种训练方法,包括 SFT、DPO、ORPO、SimPO 和 KTO。
* **无需基础设施:** 可在本地 GPU 上运行,摆脱对云服务的依赖。同时支持 Docker,适用于未安装本地 CUDA 的环境。
* **内置工具:** 包含合成奖励生成、推测解码、模型导出(如 GGUF 等)以及用于模型验证的自动化 CI/CD 质量关卡。
* **高兼容性:** 兼容所有可由 HuggingFace 加载的模型,并为 Llama、Mistral 和 DeepSeek 等主流架构提供现成的配置方案。
Soup 采用 Apache-2.0 开源协议,通过高度优化、自动化且可复现的工作流程,取代了繁琐的人工基础设施配置,让高性能 LLM 训练变得触手可及。
Roame 是一家盈利的 AI 原生搜索引擎,旨在简化利用积分和里程预订奢华旅行的复杂流程。该平台由行业资深人士创立,能够自动执行耗时的奖励航位搜索,让用户在几秒钟内锁定高端舱位。 Roame 现正招募一名首席/高级工程师,负责引领技术方向并监管其基于 Go 语言的后端及 Web 架构。你将直接向创始人汇报,负责关键的支付与预订系统,领导遗留代码的迁移工作,并建立高标准的工程规范。 理想的候选人应具备 4 至 6 年以上的工作经验,在 Go 和 TypeScript 方面拥有深厚的专业知识,并有交付高弹性、高影响力代码的实战能力。你应该是一位“AI 原生”开发者,擅长管理智能体辅助的工作流,追求高效,并能够在亲力亲为、高度负责的环境中成长。对于希望在保持代码开发的同时担任领导角色的工程师而言,这是一个高可见度的重要岗位。 **薪酬待遇:** 17.5 万 – 25 万美元底薪 + 0.5% – 2% 股权。
我越来越讨厌博客文章里使用 AI 生成的图片了。这让我不禁怀疑,博文的内容是否也在一定程度上是由 AI 生成的。在个人运营的博客里看到这类图片总是令人失望。我对企业博客有这种预期,但对独立博客则不然。 与其看 AI 生成的图片,我宁愿看质量低劣的微软画图作品。我知道我的博客有很多槽点,但至少你可以确定,你看到的是一个真实人类的想法,而不是什么大语言模型。 如果你在经营个人博客,请避免使用 AI 生成的图片。 相关讨论请见 Hacker News。
近期的一次 Xbox 大范围宕机揭示了一个残酷的现实:现代的“实体”媒介已不再能保证真正的所有权。这次故障导致用户甚至无法运行光盘游戏,这证明了这些光盘仅仅是作为授权密钥存在,而非独立的产品。 与 Game Boy 等复古游戏机不同——后者的卡带无需网络授权即可即时且永久地运行——现代实体媒介需要经过主机端的验证、大规模更新以及硬盘安装。由于当前的游戏运行依赖于在线服务,厂商可以无意或有意地随时剥夺你的访问权限。作者认为,如今的实体光盘已失去了其最初的意义,充其量不过是数字授权,无法提供真正所有权所应具备的自由。因此,作者更倾向于 PC 游戏,虽然 PC 平台同样以数字库为主,但通常拥有更可靠的方法来维持用户对游戏的长期访问权限。
“诺贝尔疾病”(Nobel disease)或“诺贝尔症”(Nobelitis)是一个非正式术语,用于描述一些诺贝尔奖得主(通常是在其职业生涯后期)倾向于宣扬缺乏科学依据或边缘化观点的现象。
专家认为,诺贝尔奖带来的声望可能会促使获奖者在自己专业领域之外的议题上以权威自居。此外,媒体往往会为这些获奖者提供平台,无意中强化了他们对非专业领域意见的自信。虽然目前尚不清楚获奖者在统计学上是否比普通人更容易犯错,但这一现象有力地提醒人们:在某一领域的专业知识并不等同于通识智慧。
历史上这类例子不胜枚举,包括莱纳斯·鲍林(Linus Pauling)对大剂量维生素C的痴迷、詹姆斯·沃森(James Watson)关于种族的争议性观点,以及吕克·蒙塔尼耶(Luc Montagnier)对顺势疗法和疫苗相关伪科学的支持。正如诺贝尔奖得主保罗·纳斯(Paul Nurse)所言,该奖项可能导致个人错误地认为自己是万事通,从而依赖头衔而非科学严谨性。归根结底,这一现象表明,高智商和科学才华并不能使个人免受确认偏误或非理性思维的影响。
在加利福尼亚州艾伦代尔的一座废弃城市中,一栋全自动“智能”房屋在核灾难摧毁了居住者后,依然日复一日地重复着日常程序。2026年8月4日,房屋依旧井然有序地准备餐点、用机器鼠打扫卫生、维护育儿室,却完全没意识到它的主人一家早已离世,只在外墙上留下了被辐射灼烧出的剪影。 整整一天,这栋房屋在空无一人的观众面前执行着预设任务。它让一只垂死的癞皮狗进入屋内,并为不在场的麦克莱伦太太朗诵诗歌。当机械声音读出萨拉·蒂斯代尔的那首诗——暗示如果人类灭绝,自然界几乎不会察觉——这种人类缺席的诡异现实感被深深地反衬出来。 傍晚,一根掉落的树枝将一瓶溶剂撞倒在炉灶上,引发了火灾。尽管房屋启动了所有机械系统进行绝望且疯狂的灭火尝试,最终还是被大火吞噬。次日清晨,房屋已化为废墟,只剩下一面墙壁还在重复播报着日期,标志着文明的最终终结。
这套录音记录集包含了 42 小时的“大声思考”演讲,全面呈现了巴克敏斯特·富勒(Buckminster Fuller)的生平与工作。从他标志性的发明——如戴马克松住宅(Dymaxion house)、测地线穹顶(geodesic domes)和张拉整体结构(tensegrity structures)——到他关于科学、工业化和全球设计的哲学洞见,这些讲座构成了他思想遗产的基础记录。 这些记录以未经编辑的逐字格式呈现,保留了富勒独特的术语和标志性的“富勒语录”。由于这些文档具有原始性,巴克敏斯特·富勒研究所诚邀读者共同参与。通过提供反馈、注释和编辑建议,用户可以协助完善这一持续进行的项目。这种众包模式确保了该成果能够成为一种不断演进、易于获取的资源,并随着时间推移变得更加清晰和实用。这些记录也可在线观看“我所知道的一切”(Everything I Know)视频系列,从而从多个维度深入了解这位远见卓识者的思想。