每日HackerNews RSS

抱歉。

2026年8月5日协调世界时约06:35,一枚被废弃的SpaceX猎鹰9号火箭二级(编号2025-010D)预计将撞击月球爱因斯坦陨石坑附近。 该物体大小约相当于一栋五层建筑,于2025年1月用于发射月球着陆器。任务完成后,它一直在绕地球运行,偶尔会经过月球附近。天文学家通过望远镜数据追踪了这块碎片,并计算出了撞击轨迹,尽管太阳辐射压力带来的不确定性会随时间推移轻微改变太空垃圾的路径。 虽然从地球上或许可以看到撞击闪光或尘埃云,但这并不能保证一定会发生。该事件对人类生活没有威胁,但它凸显了日益严峻的太空垃圾管理问题。与在大气层中燃烧殆尽的近地轨道垃圾不同,撞击月球的物体会产生陨石坑并可能散布碎片。 科学界预计,月球勘测轨道飞行器(LRO)日后将拍摄到撞击地点的图像。专家建议,为防止此类碰撞,未来的太空任务应优先选择绕太阳运行的处置轨道。目前,各航天机构正越来越多地采用这一做法,以缓解日益严重的轨道污染问题。

最近 Hacker News 的一场讨论聚焦于一个追踪项目,该项目关注一枚定于 2026 年撞击月球的 SpaceX 火箭上面级。尽管这一技术话题引发了关于太空垃圾及月球表面“乱扔垃圾”伦理的争论,但讨论区同样充斥着对该网站设计的赞赏。 评论者们称赞该网站采用了“老派”风格:纯 HTML,没有 CSS、JavaScript 和广告。许多用户指出,由此生成的页面速度极快且易于阅读,与现代网页的延迟和臃肿形成了鲜明对比。 围绕移动端无障碍访问出现了一场重大的技术争论。一些人认为,由于缺乏视口(viewport)元标签导致用户必须横向滚动,该页面对移动端“不友好”;而另一些人则反驳称,这是现代移动浏览器无法自然渲染无样式文本的过错。这场讨论凸显了人们对更简单、更轻量化互联网日益增长的怀旧之情,同时也探讨了关于火箭残骸和太空管理的现实问题。

将 `git worktree` 用于自动化编程智能体是一种危险的误解。虽然它常被吹捧为隔离任务的“零成本”方案,但工作树(worktree)共享了大量版本库状态,包括钩子(hooks)、配置、贮藏(stashes)和分支引用。这意味着智能体可能会无意中触发宿主级别的 git 钩子、重写用户配置或损坏共享的贮藏条目,因为这些并非真正的隔离边界。 许多开发者因担心历史记录重复而错误地规避 `git clone`。实际上,本地克隆(尤其是使用 `--shared` 参数或硬链接时)在时间和磁盘空间上的开销与工作树基本相当——只需几毫秒的时间以及工作目录文件的空间。 区别很明确:**当由人类操作时,请使用 `git worktree`**,因为你通常希望共享分支、贮藏和配置。**当由智能体驱动时,请使用 `git clone`**。由于性能开销相同,克隆能提供必要的安全性,并防止未协调的进程篡改宿主版本库的状态。选择正确的工具不在于节省磁盘空间,而在于最大限度地减少自动化进程在困惑状态下对你的环境造成的破坏。

请启用 JavaScript 和 Cookie 以继续。

最近的一场 Hacker News 讨论围绕着一篇关于 C# 原生实现通用表达式语言(CEL)引擎的“Show HN”帖子展开。讨论话题很快从该项目的技术价值转向了对其作者身份的质疑。 评论者大多猜测该文章和代码库是“AI 生成”的,并指出了其写作风格和频繁使用“chore”作为提交前缀等特征。尽管一些用户辩称使用规范化提交(Conventional Commits)是行业标准做法,但另一些人则批评了缺乏披露的行为,认为 AI 生成的内容应当予以明确标注,以节省读者的阅读时间。 除了关于 AI 的元讨论外,技术贡献者还澄清了关于 `protovalidate` 的细节,纠正了原帖称其属于 gRPC 的说法,并指出它是由 Buf 开发的独立库。尽管对其来源存在争议,但一些开发人员仍表示有兴趣将该 CEL 实现用于保护其系统中的状态转换。

本实验探讨了智能体工程中重构所带来的经济影响。作者使用人工智能智能体构建了一个 15 万行的 Rust 应用程序,其中产生了一个庞大的 17,155 行数据访问模块。由于缺乏代码去重和模块化设计,智能体被迫处理大量冗余代码,从而推高了 token 的消耗与成本。 为了量化重构的价值,作者首先设定了实现某项特定功能的基础 token 成本。随后,他们系统性地将该模块重构为更小、逻辑更清晰的文件和函数,并测量了在每个步骤后实现同一功能所需的 token 消耗。 结果显示出一种“悬崖效应”:随着代码库变得更加模块化且易于智能体解析,执行代表性任务所需的输入 token 消耗骤降了 83%(从 159,564 个减少至 27,360 个)。 作者总结认为,尽管智能体目前在主动发起高层级架构重构方面的能力较弱,但通过“支付”重构代码所需的 token 成本,可以显著提升未来所有任务的执行效率。该实验强调,对于人工智能驱动的开发而言,保持整洁、模块化的结构是降低运营成本并提升智能体性能的关键策略。

这次讨论围绕马丁·福勒(Martin Fowler)网站上的一篇近期文章(由 Giles Edwards-Alexander 撰写)展开,探讨了人工智能时代重构代码的经济效益。 其核心观点是:重构不再仅仅是一项“长期”的维护琐事,而是人工智能辅助开发的一项即时技术前提。由于大语言模型(LLM)在上下文窗口内运行,臃肿或结构糟糕的代码会导致智能体消耗过多的 Token,从而带来更高的成本和更差的性能。因此,重构相当于一种针对 Token 的“现金流折现分析”:今天投入时间清理代码,能让未来每一次人工智能交互都变得更快、更便宜、更准确。 讨论的主要收获包括: * **人工智能作为力量倍增器:** 尽管人工智能擅长处理繁琐任务,但它缺乏高层级的“架构设计感”。人类仍然必不可少,用以引导智能体、提供全局背景并界定重构范围。 * **“代码氛围感”(Vibe Coding)的现实:** 许多开发者发现,过去被忽视的严谨、整洁的工程实践,如今已成为让人工智能保持在“正确轨道”上的必要手段。 * **指标的转变:** 开发者们开始将 Token 消耗量作为衡量代码健康状况的量化指标,这证实了简单、解耦且模块化的代码对机器和人类而言都更高效。

在构建用于提供海量 Parquet 文件的无状态 API 时,开发人员通常会使用 `LIMIT` 和 `OFFSET` 来进行数据分页。尽管 DuckDB 的优化器可以将 `OFFSET` 重写以避免二次方性能开销,但这存在风险:该优化仅在特定条件下触发,且在没有 `ORDER BY` 的情况下,当启用多线程时,结果集可能会出现静默数据损坏(丢失或重复行)。 一种更稳健且高效的方法是根据 `file_row_number` 进行筛选。通过使用 `parquet_metadata` 将请求范围与文件的内部“行组”(row groups)对齐,你可以跳过整个数据块而无需进行解压。在测试中,该方法的运行速度大约比 `OFFSET` 快 2.5 倍,且在并发处理时表现稳定。 **关键点总结:** * **检查元数据:** 使用 `parquet_metadata` 确保你的文件包含多个行组;单行组文件无法获得这些性能提升。 * **避免使用 `OFFSET` 以确保完整性:** 如果必须使用 `OFFSET`,请注意在多线程环境下它容易导致静默数据损坏。 * **优先考虑流式传输:** 分页是一种“无状态税”。如果平台允许,优先选择流式传输响应或向客户端提供预签名 URL,以完全避免手动分页带来的额外开销。

这份 Hacker News 讨论探讨了在 DuckDB 中对 Parquet 文件进行分页所面临的挑战。讨论指出,除非在唯一列上使用确定的 `ORDER BY` 子句,否则使用 `OFFSET` 和 `LIMIT` 进行分页是不可靠的。 参与者指出,即使有插入顺序的保证,分页过程中动态的数据变化也可能导致记录丢失或重复。虽然有人建议使用事务来保证一致性,但其他人指出,由于分布式系统的特性,这对 Web 或移动应用来说是不切实际的。 为了提高可靠性,用户建议放弃简单的基于偏移量(offset)的分页,转而采用“键集分页”(keyset pagination,即使用最后一条已见记录的 ID)。此外,针对 DuckDB 的特定用例,建议使用 `rowid` 伪列作为管理记录检索的潜在工具。总的来说,大家的共识是,虽然偏移量分页很简单,但在不断变化的数据集中,它容易导致数据不一致。

拒绝访问。您没有权限访问此服务器上的 "http://thereader.mitpress.mit.edu/the-lost-civic-life-of-movie-rental-stores/"。引用编号 #18.d2753617.1785427358.fa6d53e https://errors.edgesuite.net/18.d2753617.1785427358.fa6d53e

Google 推出了 **Gemini Robotics 2**,这是一项机器人智能领域的重大进步,旨在从重复的预编程任务转向真正适应性的自主行为。 这一新一代平台利用三种专用模型,使机器人能够在不可预测的环境中“思考、行动和交互”: * **Gemini Robotics 2**:一种先进的视觉-语言-动作 (VLA) 模型,提供全身控制,涵盖从复杂的人形运动到精细、灵活的物体操控。 * **Gemini Robotics ER 2**:一种具身推理模型,允许机器人与人类交流、理解周围环境并规划复杂的多步骤任务。它还引入了多个机器人团队协作的能力。 * **Gemini Robotics On-Device 2**:VLA 模型的高效本地版本,使机器人只需几小时的训练即可适应新的物理形态。 通过整合这些模型,Google 使机器人能够以空前的灵活性和独立性执行复杂的现实任务,例如打扫房间或进行协作工作。这一演进标志着机器人向能够无缝适应我们世界的方向迈出了重大一步,无论其具体外形或设计如何。

Hacker Public Radio (HPR) 是一个由社区驱动的播客,每个工作日都会发布新节目。该节目面向黑客、创客和爱好者,鼓励听众制作并贡献各种技术及爱好主题的内容。HPR 致力于营造一个建立在积极反馈和相互尊重基础上的友好交流环境。 该项目汇集了听众创作的各种节目。近期节目展示了该平台兼收并蓄的特点,涵盖的主题包括: * **技术与计算:** 播客 Shell 脚本编写、UNIX 文件合并以及安全摄像头固件调试。 * **创客项目:** “廉价黄色显示屏”(Cheap Yellow Display)项目编程,以及使用 Audacity 创作噪音音乐。 * **爱好与兴趣:** 业余无线电、C++ 编程、复古短波收听技巧,以及像《文明 5》这样的游戏攻略。 无论您是专业开发人员还是充满好奇的爱好者,Hacker Public Radio 都为您提供了一个易于参与、由社区主导的空间,供您分享知识并探索多元化的技术兴趣。

这篇 Hacker News 讨论凸显了“老派”技术社区和网络电台持久的魅力。用户们表达了对 **Hacker Public Radio** 的怀旧之情——这是一个许多人正在重新发现的长寿项目;另一些人则称赞 **SDF** (Super Dimension Fortress) 是早期计算文化的典范。 该讨论串也是分享类似资源的中心,推荐内容包括 **SomaFM**(以其 DefCon 相关内容而闻名)、**anonradio.net** 和 **Radio Paradise**。除了音乐,对话还涉及了“黑客行话”的演变,将技术术语比作一种常令局外人感到疏远的专业方言。社区还针对一个疑似 SSL 证书的问题进行了轻度的技术排障,体现了这些空间中典型的协作式问题解决方式。总而言之,这次讨论反映了人们对互联网上独立、非商业化角落的共同欣赏,这些角落将社区置于现代“科技精英”文化之上。

Certisfy 的贴纸功能支持用户将网址转换为可信且经加密验证的声明。通过在这些已签名的声明中嵌入链接,创作者和新闻工作者能够在充斥着人工智能内容的数字环境中彰显真实性。 为确保安全,这些链接可被限定于特定的来源引用(Referrer),从而防止欺诈性转载。当用户点击这些链接时,可以即时验证提供者的身份,进而对信息的可靠性做出明智判断。通过将可验证声明与网页导航相结合,Certisfy 推动构建了一个“已验证的网络”,使信任变得透明、可迁移且易于分享。

更多

联系我们 contact @ memedata.com