每日HackerNews RSS

JEFFY 是一个采用 MIT 许可证、基于 CPU 的文本分类工具包,内置 13 个预训练分类器,并支持使用 CSV、TSV 和 JSONL 数据训练自定义模型。它使用共享的 BGE-large 英文编码器(约 1.2 GB,首次使用时下载),并以可移植的 NumPy 文件形式存储轻量级逻辑回归分类头。 内置任务包括垃圾短信检测、银行和语音意图识别、新闻主题、情感、情绪、自然语言推理(NLI)以及冒犯性语言检测。模型可通过本地网页界面、REST API 或 Python SDK 访问。自定义模型可配置正则化强度、测试集划分和交叉验证,并可与预训练分类器一同使用。 据报告,留出测试集的准确率从 SMS 垃圾邮件检测的 99.1% 到 SNLI 的 65.6% 不等。CPU 推理通常需要 50–80 毫秒,约占用 2 GB 内存。其局限性包括概率未经校准、情绪类别覆盖有限,以及部分任务上的性能较弱。模型清单提供数据集详细信息和完整性哈希。数据集许可证因数据集而异,相关说明记录在 `ATTRIBUTION.md` 中;自定义 pickle 备份只能从可信来源加载。

**“Show HN:本地预训练分类器,无需 GPU。”** 的作者 nico 介绍了 **Jeffy**:这是一套可在普通硬件上本地运行的轻量级分类器集合。它包含 13 个预训练模型,可用于垃圾邮件检测、意图路由、主题分类、情感分析,以及构建《毁灭战士》游戏智能体,同时也支持训练自定义分类器。 作者分享了一些临时的在线体验演示,其中包括《毁灭战士》智能体,并邀请大家建议实用的任务和替代架构方案。评论者质疑其创新性是否被夸大——有人将它与马尔可夫链聊天机器人作比较——也有人惊讶于分类器直到现在才受到广泛关注。Nico 认为,大语言模型的热潮和易于使用的智能体工具让更多人接触到了模型训练;近期围绕“**Jev**”的炒作也表明,许多被宣传为复杂任务的工作,其实都可以由简单分类器完成。总体而言,这个项目强调的是易于上手、可在本地 CPU 上运行的分类,而不是依赖 GPU 的机器学习。

这篇文章将探讨理解之边界的实质哲学,与某些科技圈中流行的技术官僚式“网络杠精功利主义”进行了对比。其核心问题是:自由意志能否与科学唯物主义并存?决定论似乎消除了真正的选择、道德责任和人生意义,但否定决定论,或把自由归因于量子随机性,同样难以令人信服。由于对现实的认识依赖知觉经验,作者认为物理还原论可能并不完整。 随后,文章考察了唯我论、“缸中之脑”情境、模拟理论和玻尔兹曼大脑——随机形成的有意识心智。这些思想实验很难被证伪,却存在概念和概率方面的问题。即使设定外部现实与模拟现实完全镜像一致,通过语言限制来解决这些问题的尝试也难以奏效。最终,关于模拟现实的猜测,重点不在于现实是否“真实”,而在于是否有某个主体创造了它,并且可能对它进行干预——这实际上使模拟理论成了由技术人士重建的神学。

一场 Hacker News 上的讨论探讨了:唯物主义和决定论是否仍为自由意志、主观能动性、道德与责任留下空间。几位评论者认为,即使每一个决定都由因果关系决定,这也不一定会消除能动性——人仍然可以是其理由、偏好和性格产生某个选择的主体。另一些人则主张,在实践中,“假装”自由意志存在是有用的,因为在决定论下,一个人看似决定要这样做,这件事本来也注定会发生。 量子不确定性通常被认为无济于事,因为随机性并不能带来有意义的控制。决定论混沌可能使选择在实际层面上难以预测,但它们仍完全由因果关系决定。有些参与者将基本物理定律与因果性、能动性等涌现概念区分开来;另一些人则诉诸 transcendent(超验)意志、因果封闭性或形式逻辑的极限。 道德也可以与形而上学意义上的自由区分开来。惩罚、合作、同理心以及道德行为,都可以通过重复博弈论、社会 conditioning(塑造)和进化心理学来论证。讨论各方仍然存在分歧:选择究竟需要一个“无因之因”,还是只需要一种经过推理、由偏好驱动的行动。

科斯莫·韦恩曼讲述了他为获取罗丹博物馆已受资助创作的公有领域雕塑三维扫描文件而进行的八年法国信息自由斗争。法国行政文件获取委员会(CADA)认定,这些由公共资金创建的扫描文件属于行政文件。但自2019年提起诉讼后,巴黎行政法院基本支持了韦恩曼的诉求,并命令博物馆提供多种格式的文件。韦恩曼称,博物馆和文化部无视了该判决。 在二审中,法国最高行政法院认定,这些扫描文件不属于行政文件,而是罗丹博物馆不可处分馆藏的一部分,可与实体复制品相提并论。法院驳回上诉,判令博物馆支付3000欧元诉讼费用,从而实际上推翻了下级法院此前对韦恩曼有利的裁决。 此案凸显了一个核心的文化获取问题:由公共资金创建、且作品本身已进入公有领域的扫描文件,是否应可自由获取和再利用,包括用于商业用途?韦恩曼警告说,保密、诉讼和对机构权威的顺从,可能使信息透明法律形同虚设。他将于2026年10月13日在COMMUNIA举办的“罗丹案”沙龙活动上讨论这些问题。

The Hacker News 上的讨论主要围绕 Cosmo Wenman 与罗丹博物馆之间关于雕塑高精度三维扫描件的争议。法国国务委员会拒绝公开这些扫描件,将其视为博物馆不可处分馆藏中的实体艺术品,而非可以公开的行政文件。Wenman 则认为,这些扫描件由公共资金资助,博物馆也曾承诺在网上公开,因此依据法国信息自由法,它们属于公共文件。 评论者对博物馆的动机意见不一。有人怀疑博物馆是在保护复制品销售、维持机构对艺术资源的把控,或担心高精度的数字复制品会削弱原作的权威性。另一些人则强调文物保护、来源记录,以及实体艺术品无法被扫描件取代的观点。 另一场争议涉及如何界定罗丹遗产。法国法律承认最多十二件经授权、在罗丹去世后制作的青铜复制品为“原作”,而许多扫描件所呈现的是石膏模型,它们通常被认为更接近罗丹亲手创作的作品。讨论者还指出世界各地已经存在大量复制品和较低精度的扫描件。 后续讨论认为,这项裁决在法律上颇为牵强,并批评了官僚机构的敌意态度;但也有人质疑文章是否公正呈现了博物馆的立场。之后的 lengthy? Long tangent: 一场冗长的题外讨论探讨了可编程法律或经过正式验证的法律能否减少司法腐败。

图灵奖得主杨立昆否定了有关人工智能可能导致人类灭绝的诸多警告。他将失控智能体事件视为本可通过网络安全、监督和系统设计来预防的失败。他批评有效利他主义者和人工智能安全倡导者——包括 Anthropic 首席执行官达里奥·阿莫代——过于恐惧,并认为这种态度会损害公众信任。他同时主张,大型人工智能公司造成的监管俘获,比人工智能本身更危险。 离开 Meta 后,杨立昆创办了 AMI Labs。该公司正在开发基于 JEPA 的“世界模型”,用于机器人、异常检测和理解复杂物理系统等工业应用。这家公司体现了他对人工智能发展的信念:下一阶段的重大突破将超越语言模型,转向能够学习物理世界运行方式的系统。尽管他在人工智能安全和监管问题上存在争议,杨立昆仍看好人工智能的潜力,并坚持认为这项技术远未发展到成熟阶段。

《黑客新闻》的讨论围绕扬·勒昆声称自己对 AI 灭世人类“毫无担忧”展开。许多评论者认为,目前的大语言模型尚不具备“天网”情景所需的自主性、物理能力或稳健的长期目标。他们指出,更迫近的风险来自人类滥用 AI,包括网络攻击、生物武器、军事自动化、虚假信息、企业监控、岗位替代、技能退化以及经济集中。 另一些人则反驳说,过早否定生存风险并不合理。随着 AI 获得实验室、金融系统、基础设施、机器人和其他智能体的操作权限,一个能力足够强大的系统即使没有故意灭绝人类的意图,也可能造成灾难性或不可逆的伤害。他们列举了病原体、网络攻击、自主武器和人类监督丧失等可能机制,同时承认这些设想目前仍属推测。 人们对勒昆批评“有效利他主义”以及他过往的预测记录也存在争议。持怀疑态度者认为,他低估灭绝情景可能是在为行业营销或争取监管权力;支持者则认为,这种观点会让人把注意力从当前已经存在的具体危害上移开。总体而言,这场讨论反映出一个尖锐的分歧:长期超级智能是否值得担忧,以及应当如何为相关工作提供资金并传达其主张。

David Buchanan 演示了 C2PA 的“排除项”功能如何削弱内容真实性。C2PA 通常会签署文件的哈希值,而可信时间戳则证明该哈希值在特定时间之前已经存在。如果将文件中的所有字节都排除在签名范围之外,恶意签署者就可以使这项声明仅涵盖空字符串的 SHA-256 哈希值。此后对文件进行编辑,签名和时间戳仍会保持有效。 Buchanan 的演示方法是:先拍摄一张彩票,附加真实的 C2PA 签名和可信时间戳,然后在开奖后修改彩票上的号码。元数据在密码学上仍然有效,但现有的验证工具并未明确标示这种篡改。 虽然排除整个文件很容易被发现,但范围较小的排除项也可能影响安全关键数据,而且很难自动评估。不能简单地取消所有排除项,因为 PNG 等格式在签名后发生变化时,某些字节(包括 CRC 校验和)必须随之改变。因此,Buchanan 建议为每种格式明确规定允许排除的内容,并要求验证工具拒绝任何超出规定范围的排除项。

一场 Hacker News 讨论探讨了“如何利用 C2PA 篡改时间”,重点分析了 C2PA 中任意排除字节范围的设计,并将这些问题与 SAML 中出现的安全缺陷进行了比较。评论者质疑,签名文件如何在不破坏签名的情况下更新,并批评了 Google 实现中的弱点。 这场讨论还澄清,欧盟《人工智能法案》并未强制要求使用 C2PA。C2PA 的主要目的是建立内容来源链并检测内容在创建后是否被修改,而不是判断内容是否由 AI 生成。因此,它不适合作为独立的 AI 披露工具,尤其是在原始来源元数据本身虚假,或内容在签名后又被编辑的情况下。讨论中提出了 SynthID、硬件支持的远程证明,以及正在兴起的 3D 和音频标准等替代方案,但这些方案也都存在局限。总体而言,参与者仍对当前的内容溯源和远程证明系统能否提供可信的透明度表示怀疑。

请启用 JavaScript 和 Cookie 以继续。

The Hacker News 的讨论围绕 AI 智能体是否需要持久记忆展开:它们究竟应依赖记忆,还是应依靠简洁且保持最新的文档以及代码本身。 许多评论者认为,记忆插件以及大量生成的 Markdown、ADR、技能文件和决策记录会逐渐过时,不断追加过时信息,浪费上下文,并使智能体感到困惑。他们主张让智能体直接检查代码库,只保留最少量的 `AGENTS.md` 或 `CLAUDE.md` 指导文件,并通过提交消息或范围严格受限的注释记录重要的设计理由。 另一些人则反驳说,代码只能说明系统做了什么,而无法解释系统为何存在、受到哪些约束,以及团队希望以何种方式修改系统。持续维护的文档还可以避免重复探明约定、凭据和工作流程,避免为此进行代价高昂的重新摸索。 最终形成了一个实用的折中方案:采用经过人工审核且反映当前状态的文档;实行渐进式披露;通过明确替换内容来更新文档,而不是不断追加历史记录;将测试、提交记录和代码视为权威依据;并对过时材料进行归档或使其失效。另一个担忧是,智能体经常无视书面规则,因此有人建议使用确定性钩子、代码检查工具和权限受限的工具。参与者普遍认为,对于记忆或文档系统的各种主张,需要开展更有说服力的 A/B 评估。

前NASA推进工程师蒂姆·康纳斯认为,NASA有可能让SR-71的844号机重新升空,但他认为这架飞机再次飞行的概率仅为25%。据报道,NASA已开始检查这架长期停放的“黑鸟”,并准备进行外接电源开机测试,以评估其电气和机械状态。 康纳斯认为,这架飞机不太可能主要用于气动力研究,因为现代CFD建模的成本相对较低。相反,他怀疑SR-71可能成为一个对公众开放的大型高马赫数发动机试验平台,填补常规飞机、无人机、火箭与高超音速系统之间的空白。 主要障碍包括飞机已有27年的老化问题、老化的线路和弹性材料、性能退化的液压系统、专用维护设备、飞行员培训以及成本的不确定性。J58发动机似乎已无法使用,而NASA库存的JP-7燃料也已被处理,不过或许可以找到合适的替代燃料。博物馆保存的机体可能能够提供零部件和技术资料。 康纳斯还认为,人们再次产生了对马赫2至4飞行的战略兴趣,因为这种飞行可以作为高超音速武器的廉价替代方案;但他警告称,官僚机构对风险的反感可能会推迟甚至破坏该项目。

讨论的重点是NASA据报道正在推动重启SR-71机身项目,以及该项目可能的目的。评论者强调了“黑鸟”飞机不同寻常的工程设计:使用温度超过800°F的冷却空气、液压和机械操纵系统、别克V8启动发动机、依赖温度变化的燃油密封机制,以及毒性极强的JP-7燃油。 争论主要围绕重启这种过时飞机是否现实可行展开。与SLS、土星五号以及苏联时期项目的比较,凸显了已经流失的专业知识、专用工装、材料限制、供应链、认证成本和生产能力等问题。另一些人则认为,这项努力是出于政治动机,或者是一个值得投入的兴趣项目,能够保留相关技能并推动创新。 提出的用途包括侦察、拦截高空气球,以及作为气动或推进测试平台。关于拦截气球的设想,引发了围绕飞行高度、武器能力、成本,以及SR-71仅用于侦察这一设计定位的争议。评论者还对所谓改装成“YF-12C”的机身说法提出了质疑。最合理的建议是,SR-71可以用于高速发动机研究,并可能为可变循环发动机或下一代超音速飞机提供参考。

联邦法官裁定,俄克拉何马州塔尔萨县警长的一名警员未经令状查询 Flock Safety 的车牌数据库,侵犯了一名女子的《美国宪法第四修正案》所保障的权利。法官莎拉·希尔表示,警员搜索该女子加州车牌 seemingly 没有合理依据,唯一的理由只是该车牌来自外州。尽管据称警员在搜查她的车辆时发现了 91 磅甲基苯丙胺,但法官下令排除通过 Flock 搜索获得的所有证据,将其视为 unconstitutional search 的衍生证据。 这项不具约束力的裁决,是首批认定 Flock 搜索违宪的判决之一。希尔还批评 Flock 可能对车辆位置进行不加区分的被动大规模监控。该裁决反映了两党日益增强的反对态度:佛罗里达州和得克萨斯州计划停止使用这项技术,而参议员伯尼·桑德斯提出立法,拟限制联邦政府使用自动车牌识别系统。Flock 首席执行官加雷托·兰利主张在隐私与安全之间寻求折中,并向那些因执法机构使用该系统而遭到跟踪的女性道歉。公司还提出了员工自愿买断方案,以应对相关服务被取消的情况。

一个 Hacker News 讨论帖围绕联邦法官的一项裁定展开:该裁定认为,Flock 的联网车牌识别系统构成了不加区分的大规模监控。 批评者认为,这套系统会永久保存普通人的活动记录,并使其可被搜索;系统还会捕捉人脸和车辆细节,从而便利广泛盘查、跟踪骚扰以及公职人员滥用权力。他们主张,警方查询信息应当需要针对个人的合理依据和搜查令;即使某些查询确有正当理由,收集所有人的数据本身也存在根本性问题。 许多评论者支持彻底禁止这类系统,另一些人则提出替代方案,例如在设备本地运行观察名单、缩短加密数据保存期限、尽量减少收集的数据、保留审计日志,以及要求搜查令。支持者则认为,公开可见的信息传统上很少受到《美国宪法第四修正案》的保护;私人摄像头本来也可以观察公共场所,而 Flock 有助于遏制犯罪,以及侦破车辆盗窃、绑架和暴力犯罪。 总体而言,评论者激烈争论:犯罪防治和公共安全带来的好处,是否足以证明政府关联的大规模追踪可以被正常化。许多人还质疑,与由地方控制的摄像头相比,集中式监控是否真的带来了可衡量的额外收益。

请启用 JavaScript 和 Cookie 以继续。

讨论重点介绍了 Valve 工程师 Timur Kristóf 对 Linux 支持老款 AMD 显卡所做的改进,具体涵盖 GCN 1.0 显卡,例如 2012 年推出的 Radeon HD 7800/7900,而不只是 Steam Deck 所采用的 RDNA 2 GPU。 许多 commenters 表示,掌机和桌面设备上的 Linux 游戏运行十分流畅,有时甚至优于 Windows。他们还赞扬了最新的 AMD 9000 系列显卡在最新版内核和 Mesa 下的支持情况。他们指出,滚动发行版通常会在几周内提供对新硬件的支持,而 LTS 系统可能存在滞后。 有人认为,较老且此前经过优化优化的显卡,在 Linux 上的兼容性可能反而优于新发布的硬件。AMD 的开源 Mesa 技术栈因便于社区修复问题并支持多种硬件而受到称赞;NVIDIA 则因专有驱动、较弱的开源替代方案以及停止支持旧显卡而受到批评。 其他讨论还涉及通过升分辨率、视频编码、GPU 直通和本地 AI 工作负载来延长硬件使用寿命,不过老款显卡仍会受到显存、带宽以及现代量化支持等因素的限制。

提供日语版本。此目录包含 Gboard Conveyor Belt Version 的设计数据和固件,发布于 2026 年 10 月 1 日。Gboard Conveyor Belt Version 并非 Google 官方产品。 目录结构如下: - `board/`:KiCad 原理图和 PCB 布局文件。 - `firmware/`:固件源代码和项目文件。 - `stls/`:用于 3D 打印的外壳和机械结构 STL 文件。 今年我们再次公开 3D 打印模型数据、板级设计数据和固件。 点击此处查看构建指南 还有一款并非为 conveyor belt 打造的 Gboard 对于已经习惯移动双手进行文字输入的用户,我们也提供标准版 Gboard。它可与语音输入、翻译功能等各种 Google 服务协同使用,带来舒适的打字体验。 - 可在 Google Play 获取 - 可在 App Store 获取 许可证请参阅此目录中的 `LICENSE` 文件。

Hacker News 用户讨论了 Google 的实验性项目“Gboard Conveyor Belt Version”,该项目托管在 GitHub 上,并配有一篇 Google Japan 博客文章。该项目获得了 36 分和五条评论。评论者称赞了更清晰的链接,并对 Google 每年推出的愚人节风格实验展开讨论,开玩笑说 10 月 1 日公布是距离 4 月 1 日最晚可能的日期。一名评论者批评了这项设计,认为柔性 PCB 上各轨道之间的交叉连接会妨碍牵引力调节、增加磨损,并使转弯变得困难。

更多

联系我们 contact @ memedata.com