每日HackerNews RSS

截至2025年1月15日,全球已索引的万维网页面估计约为39.8亿个,其中荷兰语索引部分总计20.4亿个。然而,由于谷歌限制了自动数据检索,使得继续计算这些数据成为不可能,因此此类估算工作已经停止。 从历史上看,这些估算值是通过词频外推法得出的。研究人员每天向搜索引擎发送50个随机抽取的词汇,并将搜索结果与代表性的背景语料库(DMOZ)进行比对,从而估算每个引擎的索引规模。为了得出整个网络的总估算值,研究人员会将各搜索引擎之间的重叠部分从其各自索引的总和中扣除。 该项目起源于蒂尔堡大学的一篇硕士论文,后发表于《科学计量学》(Scientometrics,2016年)。此前,在雅虎(Yahoo)和Ask.com停止报告总结果数后,该项目已停止对这两者的测量。尽管该方法仍有学术记录,但由于目前持续存在的数据访问障碍,该项目已无法提供实时更新。

抱歉。

关于 新闻 版权 联系我们 创作者 广告 开发者 条款 隐私 政策与安全 YouTube 工作原理 测试新功能 © 2026 Google LLC

抱歉。

**Shoehorn** 是一款旨在通过将语言模型精确适配至特定硬件内存,从而最大化其性能的工具。与通常会浪费容量或导致加载失败的标准预设量化不同,Shoehorn 会在扣除开销后计算出确切的可用内存,并分配逐张量(per-tensor)的混合精度,以利用高达 99.99% 的预算空间。 主要功能包括: * **自定义优化:** 精确到字节,为您特定的 VRAM 或 RAM 计算出质量最高的适配方案。 * **基于浏览器的搜索:** 一个网页工具,可扫描 Hugging Face 上与您的硬件和预期上下文长度(例如 4k 到 32k token)兼容的模型。 * **无缝集成:** 使用 Rust 构建,可生成与 `llama.cpp` 生态系统兼容的标准 GGUF v3 文件。 * **易于使用:** 安装简单,本地网页界面提供预算的“卷尺”可视化效果及一键“聊天”按钮。 Shoehorn 消除了模型量化过程中的猜测,确保您能获得机器实际运行能力范围内最强大的模型。该工具为开源(MIT 许可证),可通过 Homebrew 或 Cargo 获取。

Hacker News 最新 | 过往 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 Show HN: Shoehorn – 将任意模型量化后在你的机器上运行 (notactuallytreyanastasio.github.io) 7 点,由 rhgraysonii 发布于 1 小时前 | 隐藏 | 过往 | 收藏 | 2 条评论 目前已支持 Mac、Linux 和 Windows。我包含了一个简单的图形界面,用于查找新模型并进行构建和设置。对我而言,它在处理几个模型时表现相当不错。GitHub 上的 README 和 DESIGN.md 文件详细介绍了其原理和原因,目前运行效果出奇地好。 https://github.com/notactuallytreyanastasio/shoehorn hmokiguess 15 分钟前 | 下一条 [–] 让我想起了 https://github.com/AlexsJones/llmfit 回复 mbuchel-hn 45 分钟前 | 上一条 [–] 这和 airllm 的工作原理类似吗?我想知道它在 8GB 内存预算下会如何处理像 Kimi k3 这样的量化,还是说这暂时不是你试图解决的问题? 回复 准则 | 常见问题 | 列表 | API | 安全 | 法律 | 申请 YC | 联系 搜索:

这篇文章认为 OpenAI 是一家经济上不可持续且必然面临清算的公司。作者指出,OpenAI 的商业模式从根本上是失败的:它在巨额且不断攀升的亏损中运营,并依赖于“安然式”的会计手法和具有误导性的“年度营收”指标,以掩盖其增长全靠不可持续的算力支出支撑这一事实。 论点核心在于,OpenAI 到 2030 年已承诺超过 8000 亿美元的算力支出,却找不到盈利路径。随着面临类似问题的 Anthropic 等竞争对手不断涌现,OpenAI 被困在永无止境且融资难度日益加大的恶性循环中。作者认为,OpenAI 对微软、亚马逊和英伟达等超大规模云厂商资本的依赖,创造了一种“虚假”营收的循环经济——这些公司资助 OpenAI,仅仅是为了确保它购买自家的云服务。 作者警告称,人工智能泡沫正临近破裂点。如果 OpenAI 崩溃,将引发一场波及软银等主要投资者,以及甲骨文、微软和谷歌等超大规模云厂商的系统性危机。文章最后呼吁记者和投资者停止为人工智能炒作制造共识,并为这一不可持续商业模式的必然崩溃做好准备。

这场 Hacker News 讨论探讨了 OpenAI 若倒闭可能引发的后果。各方反应两极分化,一方面看好由此带来的新竞争格局,另一方面则担忧其引发的系统性经济震荡。 一些用户推测,OpenAI 的失败将触发初创企业的“寒武纪大爆发”;另一些人则认为,企业可以通过将其基础设施平台中立化来调用其他模型,从而轻松转型。 然而,持怀疑态度的参与者警告称,这将带来严重的市场影响,并指出 OpenAI 对 GPU 和基础设施的巨大需求是芯片制造商的主要收入来源。其突然消失可能会引发连锁反应,损害投资者信心,导致数据中心扩张停滞,并迫使 AI 初创公司削减成本或提高价格。其他参与者则质疑文章作者 Ed Zitron 的动机,认为他是在通过“制造愤怒”来获取订阅量,还有人指出一个残酷的现实:在这种情况下,用户数据很可能会被高价拍卖。

arXivLabs 是一个允许合作者直接在我们的网站上开发并分享 arXiv 新功能的框架。与 arXivLabs 合作的个人和组织都认同并接受我们关于开放、社区、卓越和用户数据隐私的价值观。arXiv 始终致力于这些价值观,并仅与遵循这些价值观的合作伙伴进行合作。如果您有能为 arXiv 社区创造价值的项目构想?欢迎了解关于 arXivLabs 的更多信息。

一篇名为《代码原生生成高度可编程的 3D 资产》的新论文,介绍了一种将 3D 对象生成为结构化源代码,而非整体点云的技术。 与传统的 3D 生成式人工智能不同(传统方法产生的“大杂烩”需要人工分割和绑定才能在游戏引擎中使用),该方法创建的是模块化的“零件包”。例如,生成的洗衣机包含机门、滚筒等明确标注的组件,并预设了轴心和功能关联。这种方法通过使生成的资产能够直接使用和编辑,极大地简化了后续的工作流程。 在 Hacker News 的讨论中,该论文的合著者指出,虽然这项技术目前专注于单个资产,但潜力巨大。他估计在六个月内或许可以制作出简单的 GameCube 时代游戏,而在 9 到 18 个月内则有望实现更复杂的“自生成”元宇宙环境。该项目的代码和在线展示地址为 [nova3d.xyz](https://nova3d.xyz/)。

正在检查您的浏览器……需要启用 JavaScript

一份近期报告显示,奥克兰警察局(OPD)的一名中尉在2024年获得了493,247美元的加班费,使其年度总薪酬超过了70万美元。这在Hacker News上引发了关于公共部门问责制和潜在制度滥用的激烈讨论。 批评者认为,这些数字显示出普遍存在的“虚报工时”或监管体系失灵,并指出尽管部门人员配置有所增加,但加班支出在过去15年里仍激增了近200%。许多评论者认为,此类高额薪酬反映了透明度的缺失,并建议应对公职人员实行严格的工时跟踪和加班证明制度。 相反,一些参与者则通过强调奥克兰警察局严重的人手短缺来为现状辩护,认为警员往往被迫超时工作以维护公共安全。然而,怀疑论者对此予以反驳,指出工会的影响力以及缺乏经验证据来证明巨额加班费的增长与犯罪率的降低有关。这场讨论最终反映了公众对政府效率低下以及警察工会在市政预算中不受限制的权力的广泛不满。

发布于:2026年8月17日 与 Hacker News 头版上的那位疯子形成鲜明对比:我是如何过度设计我的书的。 我将每一章的初稿都打在 Obsidian 里,然后复制粘贴到 Word 中。完成后,将其拖放到 Box 中,那是 Manning 存储作者文稿的地方。然后我一直重复这个过程,直到全部完成。它看起来就像这样: 完成了!在这里购买!把钱给我!

Hacker News | 最新 | 往期 | 评论 | 提问 | 展示 | 招聘 | 提交 | 登录 我如何“过度简化”了我的书 (chriskiehl.com) 15 分 | goostavos 发布于 1 小时前 | 隐藏 | 往期 | 收藏 | 1 条评论 | 帮助 schnake 2 分钟前 [–] 这与我一直在构建的项目背后的理念非常接近:https://github.com/simonschnake/Mark2Tex 我在用 Obsidian 写论文时构建了 Mark2TeX。我想用 Markdown 写正文,但同时保留一个标准的 LuaLaTeX 文档来处理数学公式、引用、交叉引用等。 因此,Mark2TeX 允许我使用类 Markdown 文件,并在需要时随时切换回真正的 LaTeX。 我刻意没有尝试去构建一个完整的 Markdown/Pandoc 替代品。它本质上是一次尝试,旨在“简化”Markdown/LaTeX 之间的界限。 回复 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 申请 YC | 联系 搜索:

拆分 Git 提交 索引 | 关于 2026-08-12 现在拆分 Git 提交变得简单了,只需使用: git history split ${REF} 它会逐个代码块地询问你希望包含在第一个提交中的内容,然后弹出编辑器让你填写第一次和第二次提交的信息。没有比这更简单的了。 附注:关于拆分提交的 Stack Overflow 问题讨论的是那种陈旧且繁琐的方法。虽然第 20 个回答提供了正确的方法,但截至今日仅获得了 2 个赞,而那个使用繁琐方法的旧版置顶回答却有 2656 个赞。

这篇 Hacker News 的讨论围绕着一篇关于拆分 Git 提交的博文展开。参与者们强调了这种技巧在优化开发工作流方面的实用性。 评论中一个反复出现的主题是 Stack Overflow 上信息的过时性。用户指出,相关帖子中得票最高的答案十分繁琐,且不如当前一种未被广泛认可的更现代、更高效的方法。评论者感叹,随着工具的演进,Stack Overflow 在更新其“被采纳”答案方面显得力不从心,一些贡献者甚至认为该平台的相关性正在下降。

502 错误网关 Cloudflare

一个 Hacker News 帖子正在讨论一种病毒式传播的烹饪技术——即 Michael Chu 的网站《Cooking for Engineers》所推广的、基于表格的结构化菜谱布局。 尽管一些评论者认为这种方法很有创新性,但另一些人指出,这种组织配料和步骤的结构化方式,在许多家庭厨师中早已是一种长期存在的做法。 讨论很快从烹饪技术本身转向了对病毒式社交媒体截图中“敏感词”过度审查的辩论。用户对现代内容审核的做法表示困惑和不满,质疑为什么像“killer”(杀手)这样的词会被审查,并探讨这些措施究竟是改善了沟通还是阻碍了沟通。其他人则提供了简明菜谱速记的替代案例,例如在 Thermomix 食谱中常见的那些形式。

一项针对超过6.4万名二战后英国出生者的研究表明,在生命最初的“1000天”(从受孕到两岁)内限制糖分摄入,对一生健康都有益处。由于英国的食糖配给制度于1953年结束,研究人员得以对比配给期间和配给结束后出生的人群,从而揭示了这一因素带来的长期显著影响。 研究发现,早期糖分摄入量较低的参与者,在几十年后患肝癌、乳腺癌和前列腺癌等多种癌症的概率均有所降低。他们还表现出生物学衰老速度较慢的迹象,例如端粒更长、与压力相关的免疫蛋白水平更低。此外,研究显示早期饮食环境塑造了终身的口味偏好;经历过配给制的人群摄入糖分更少,且在成年后仍保持着更健康、更多样化的饮食习惯。 研究人员得出结论,在发育的关键窗口期,即代谢、器官和免疫系统快速形成的阶段,身体对营养摄入高度敏感。尽管该研究并不建议完全戒糖,但其结论强调了早期的饮食习惯会对细胞健康、代谢功能和行为偏好留下深远的影响,甚至可能在半个世纪后依然左右着个体的健康状况。

最近在 Hacker News 上讨论的一项研究表明,二战后英国糖配给期间出生的人,成年后患癌风险较低。这一发现暗示了生命早期减少糖摄入可能对长期健康有益。 然而,Hacker News 社区对该研究的方法论表示了强烈质疑。评论者认为,这项研究极易受到混杂变量的影响,并指出“糖配给”只是战后复杂环境中的一小部分。批评者认为,该研究未能充分考虑那个时代发生的更广泛的社会转变,例如整体饮食、压力水平、环境因素甚至父亲健康指标的变化。 许多用户表示,只有在配给时间不同的其他国家观察到类似模式时,这些发现才具有说服力。目前,评论者的共识是,将糖摄入限制与癌症发病率降低联系起来可能是一种过度简化,外部群体效应才是导致观测数据的真正原因。

更多

联系我们 contact @ memedata.com