这份数据展示了 20 个 AI 模型的性能排行榜,这些模型很可能与编程或技术任务相关。排名榜首的是 **Fable 5**,以 2,726 分和 81.7% 的闭环率位居第一。 性能趋势显示,随着分值的增加,闭环率呈现明显的下降趋势。表现最好的模型(Fable 5、Opus 2 和 Kimi K3)的闭环率保持在 50% 以上,而排名第 13 位及以后的模型则表现欠佳,成功率降至 15% 以下。 数据凸显了一个竞争激烈的格局,主要由 Claude、GPT、Kimi 和 Grok 架构的各种迭代版本主导。大多数顶级模型依赖于专用的代码执行环境(例如 `claude-code`、`codex`、`grok-cli`),其计算能力需求从“高”到“超高”不等。虽然许多模型目前处于“已关闭”状态,但包括 Qwen 3.8 Max、DeepSeek V4 Pro 和 Grok 4.6 在内的几个模型仍处于活跃状态或运行过程中,这表明相关的开发和评估工作仍在持续进行。

抱歉。

这本由 Bruce Eckel 编写的综合指南,透过惯用模式和架构的视角,对现代编程进行了深入探讨。全书分为五个核心部分: * **基础(Foundations):** 涵盖基本的语言机制,包括类型、类、模块和控制流。 * **技术(Techniques):** 专注于高级编程工具,如装饰器、上下文管理器、并发处理和性能优化。 * **模式(Patterns):** 提供了一系列经典与现代的设计模式(如工厂模式、观察者模式和状态机),重点在于重构与实际应用。 * **函数式编程(Functional Programming):** 探讨函数式编程范式、错误处理及逻辑保证。 * **效应(Effects):** 讨论状态管理、生成器以及无状态设计的实现。 本书反映了当前的行业标准,强调构建可维护、高效且结构良好的代码。内容已根据知识共享(Creative Commons)许可协议免费在线发布,配套的代码示例和习题解答托管在 GitHub 上。

Hacker News 最新 | 过往 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 由 Bruce Eckel 撰写的《Python 思维》(thinkinginpython.com) 12 分,由 pjacotg 发布于 4 小时前 | 隐藏 | 过往 | 收藏 | 1 条评论 帮助 enygmata 59 分钟前 [–] 哪里可以买到这本书的实体版? 回复 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 申请 YC | 联系 搜索:

比尔·马赫认为,民主党因优先考虑两极分化的文化议题,而非通货膨胀、医疗保健和腐败等实际问题,导致其在选举中持续受挫。马赫指出,这些“脱轨”的立场——特别是关于性别认同和跨性别运动员的问题——疏远了选民,并使共和党人能够轻松争取到持怀疑态度的选民。 马赫认为,民主党对争议性社会议题的关注,让外界产生了民主党“失去理智”的观感,从而有效地削弱了他们更广泛的政治诉求。他强调,跨性别女性参与体育运动的问题是这种脱节的一个极其负面的典型例子。民意调查数据支持了他关于民主党在此方面脆弱性的评估:最近的一项《纽约时报》与益普索(Ipsos)联合调查显示,79%的美国人(包括很大一部分民主党人)反对允许跨性别女性参加女子体育比赛。马赫最终指出,通过将这些引起分歧的文化辩论置于核心位置,民主党正在进行自我破坏,并为政治对手提供了不必要的优势。

前美国国家过敏和传染病研究所所长安东尼·福奇博士的律师团队已设立了一个独立的法律辩护基金,用于支付其不断增加的法律费用。他的律师表示,该基金是针对“毫无根据且无理取闹”的诉讼和骚扰所采取的必要措施,并指出福奇不会从中获得任何个人经济利益。法律事务结束后,任何剩余资金都将捐赠给慈善机构。 福奇目前正面临严厉审查,并因其在NIH资助的武汉研究中所扮演的角色、关于新冠病毒起源的公开言论,以及涉嫌妨碍《信息自由法》请求等问题,受到多项调查。一个参议院委员会已对他发出藐视国会的刑事移送。尽管该基金的支持者强调他长期的公共服务生涯,但包括兰德·保罗参议员在内的批评者认为,辩护基金的存在恰恰凸显了他所面临法律挑战的严重性。此举正值针对他行为的调查持续进行之际,其中包括州政府官员的调查,以及涉及其前顾问大卫·莫伦斯博士的争议;莫伦斯已承认销毁记录以逃避公众监督。

大语言模型(LLM)的兴起正从根本上改变开发者的编程方式,使得编程语言的选择变得愈发不重要。由于 AI 智能体可以轻松转换代码或处理程序员不熟悉的语言,开发者不再受限于学习语法所带来的“摩擦力”。 这种转变促使更多项目开始采用 Rust 和 Zig 等“难度较高”的高性能语言。得益于大语言模型在优化代码以及处理 eBPF、自定义加密和 DWARF 文件等复杂领域方面的卓越能力,那些曾经被认为过于困难或难以入门的技术,如今已在广大开发者的触及范围内。 在行业追求“轻量、快速、高效”软件的氛围推动下,开发者正利用人工智能绕过传统的准入门槛。虽然这种复杂编程的平民化可能会导致“劣质内容”增加,但它同时也让新一代开发者能够构建起以往无法涉足的高性能系统。

抱歉。

AI 模型缺乏对“完成”的内在感知。与人类不同,人类依赖外部信号——如截止日期、同行评审或边际收益递减——而模型会无限期地进行迭代。因此,高效的 AI 开发已从简单的提示词工程转向**“循环工程”(loop engineering)**,即让系统自行验证进度。 然而,循环的有效性取决于其验证机制。如果验证信号存在缺陷(例如,测试通过但未满足实际用户意图),循环就会收敛于错误的目标。成功的循环需要四个要素:明确的目标状态、可观察的当前状态、用于局部编辑的精确工具,以及稳健的停止规则。 目前,循环工程仍是一个反复试验的过程,因为高效的循环往往是针对特定环境定制的。此外,由于循环存在边际收益递减现象,它们很容易在不可能完成的任务上消耗过多的 token。由于 AI 无法自主决定何时停止,开发者必须构建基础设施来明确衡量进度并管理成本。归根结底,最成功的系统将不再是那些能够无限迭代的系统,而是那些构建者已经精准定义了何为“完成”及其应有成本的系统。

Hacker News 最新 | 过往 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 何时停止:实现循环收敛的艺术 (a16z.com) 10 分 | gmays | 39 分钟前 | 隐藏 | 过往 | 收藏 | 讨论 | 帮助 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 申请 YC | 联系 搜索:

美国财政部已提议制定新规,将环境、社会和治理(ESG)投资基金排除在“特朗普账户”之外。财政部长斯科特·贝森特(Scott Bessent)表示,政府打算禁止使用ESG标准,并指出该框架已被活动人士“武器化”,致使政治议程被置于财务表现之上。 包括埃隆·马斯克及多位共和党议员在内的ESG批评者长期以来认为,这些评级标准不一致且带有意识形态色彩,往往在惩罚创新的同时,偏袒那些基于主观社会指标的公司。财政部通过强制要求合格指数使用客观财务数据追踪广泛的市场板块,旨在保护这些账户免受支持者所称的“觉醒”激进主义的影响,以防其损害投资者回报。 “特朗普账户”于7月4日推出,已获得广泛参与,目前已有超过700万个注册账户,200万名儿童符合联邦缴款资格。此举反映了政府为使投资策略脱离ESG强制要求所做的更广泛努力;批评者(如作家詹姆斯·林赛)认为,ESG是削弱企业独立性并推动全球集权议程的工具。

您没有提供需要翻译的内容。请提供您想要翻译的文本。

Hacker News | 最新 | 往期 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 English ↔ Claudish Translator (programasweights.com) leumon 发布于 1 小时前 | 6 点 | 隐藏 | 往期 | 收藏 | 2 条评论 | 帮助 amingilani 7 分钟前 [–] > 翻译结果不通顺。请再试一次。 我遇到的所有内容都是这样,包括示例。 回复 traktorn 1 分钟前 | 父评论 [–] 我也是。 回复 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 申请 YC | 联系 搜索:

这篇文章探讨了为何本地大语言模型(LLM)的实际表现往往难以达到基准测试所宣称的水平,并将这种“糟糕”的表现归因于硬件和软件的差异。 作者认为,即便使用完全相同的模型权重,你的本地推理环境(由特定的 GPU 架构、CUDA 内核、注意力后端和软件栈决定)在进行数学运算时也会产生差异。作者以 Qwen3.6-27B 为例,展示了选择不同的后端(如 FlashAttention 2 与 Triton)会导致“Token 翻转”和输出分歧,特别是在长上下文及智能体任务中表现尤为明显。 此外,量化对模型可靠性有显著影响。作者测试了多种权重量化方法,结果表明,性能较差的实现方式——即使是官方发布的“FP4”版本——也可能导致模型出现幻觉,或无法完成高精度格式(如 INT8)能够正确处理的工具调用任务。 **关键点:** * **实现至关重要:** CUDA 内核和数学运算的差异会产生不同的输出分布。 * **上下文为王:** 简单的基准测试已不足够;长上下文和工具调用任务才能揭示真正的性能稳定性。 * **量化是一种权衡:** 低精度格式往往以牺牲逻辑和准确性为代价,可能在智能体工作流中引发严重错误。 作者强调,虽然“数学就是数学”,但这些数学运算在你的特定软件栈上如何执行,决定了模型是否真的有效。

Hacker News 最新 | 过往 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 为什么你的本地大模型看起来比实际更笨 (level1techs.com) 18 分,felineflock 发布于 2 小时前 | 隐藏 | 过往 | 收藏 | 4 条评论 帮助 jonplackett 16 分钟前 | 下一条 [–] 我刚在 MacBook Pro 上跑了 qwen 3.8 27b mlx,老实说,它表现得一点也不笨,这让我非常惊艳。 回复 prettyblocks 1 分钟前 | 父评论 | 下一条 [–] 我的问题是运行的时候发热太严重。我用的是 M4 Pro。你有同样的问题吗? 回复 downrightmike 0 分钟前 | 根评论 | 父评论 | 下一条 [–] 泡在矿物油里试试? 回复 StarlaAtNight 0 分钟前 | 父评论 | 上一条 [–] 响应速度怎么样?你的笔记本配置是什么? 回复 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 申请加入 YC | 联系 搜索:

运作原理 你的 JPEG 依然是普通的 JPEG。为了适配网页,我们添加了 ISO 21496-1 增益图(Gain Map)——这是一张微小的灰度辅助图像,用于告知支持 HDR 的软件每个像素可以提亮多少。对于 LinkedIn,我们以 BT.2100 PQ 格式写入像素,并附带相应的 ICC 配置文件,LinkedIn 会保留这些信息。 何种效果最耀眼 深色背景下的明亮、近白色元素。经实测,最理想的增强幅度为 +2.9 档(约 1,500 尼特)。深色部分无法真正产生“发光”效果,强行提亮只会显得像泛白的霓虹灯。 局限性 HDR 效果仅在支持增益图或 PQ 配置文件的软件(如 Chrome、Safari 26、Apple Photos、LinkedIn 应用)及 HDR 显示器上可见。大多数其他平台会剔除或标准化这些数据,在该环境下,图片依然看起来完全正常。

一位 Hacker News 用户介绍了一个名为“soverybright.com”的浏览器工具,它允许创作者为 JPEG 图片添加 HDR 增益图(gain maps)。在 MacBook 等支持 HDR 的现代设备上,通过这种技术处理后的图像(如徽标或文字)会比屏幕上的其他内容显得明亮得多。 开发者建议将此作为一种设计工具,以在复杂的界面中吸引用户注意。然而,社区的反应大多持负面态度。评论者担心这代表了一种类似音频领域“响度战争”的新型侵入式“注意力黑客”手段。许多用户忧虑这种趋势会导致视觉污染,并指出他们已经在 LinkedIn 等平台上对这类元素感到厌烦。尽管一些开发者表示有兴趣尝试该技术,但其他人则对此表示批评,称这是通过绕过用户显示偏好来强行获取视觉主导权的恶劣行为。

路透社的一项调查揭露了美国农业部(USDA)502贷款项目中的严重滥用行为。该项目旨在通过零首付抵押贷款帮助低收入家庭实现住房梦。尽管有严格的收入资格限制,但调查发现,数百名富人——其中一些人年收入超过50万美元——利用该项目在富裕的度假区购买度假屋和出租物业。 这些调查结果被收录在已故参议员汤姆·科伯恩(Tom Coburn)2013年的《浪费账簿》(Wastebook)中,该书列举了300亿美元的政府支出滥用行为。报告还指出,该项目对“农村”的定义界定模糊,数十亿美元的贷款被发放给了洛杉矶和华盛顿特区等大城市周边的明显城市区域。 尽管美国农业部坚称绝大多数受益者确实是中低收入家庭,但该项目易受百万富翁利用的事实,依然是纳税人资金被滥用的一起典型案例。以严格监督联邦支出而闻名的科伯恩参议员曾利用此类例子,呼吁加强财政问责制并取消浪费性的政府项目。

在这篇 2005 年的感言中,网络管理员 Gary Rolland 分享了他将公司关键服务器基础设施从 Windows 切换到 NetBSD 后,如何显著改善了他的职业和个人生活。 Rolland 曾管理着 29 台服务于 4800 多名用户的高端服务器,此前他一直深受 Windows 环境极不稳定性的困扰。频繁的系统故障经常迫使他放弃家庭计划,包括一次令人难忘的奥尔顿塔(Alton Towers)之旅,这给他带来了巨大的压力和家庭矛盾。 深感挫败的 Rolland 成功提议将公司关键任务服务——包括 MySQL、Apache、Postfix 和 Samba——迁移到 NetBSD 2.0.2。此次转型非常成功;新环境提供了卓越的稳定性,每天处理超过 870GB 的数据,且停机时间极短。 这种可靠性消除了紧急呼叫和周末值班的需要,使 Rolland 获得了他以前所缺乏的工作与生活平衡。他在结尾对 NetBSD 团队表达了深深的感谢,并指出他们的项目不仅提高了公司的运营效率,还让他能够享受与家人的美好时光,最终在没有系统崩溃干扰的情况下重游了奥尔顿塔。

Hacker News | 最新 | 过往 | 评论 | 提问 | 展示 | 招聘 | 提交 | 登录 NetBSD 与我的人生 (2005) (netbsd.org) 21 分,发布者 gnyeki,52 分钟前 | 隐藏 | 过往 | 收藏 | 讨论 | 帮助 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 加入 YC | 联系 搜索:

尽管有报道指出,尽管地区局势紧张,霍尔木兹海峡的油轮运输仍在继续(周五记录到40艘油轮),但全球经济的主要担忧已不再是原油供应。 尽管特朗普总统近期针对这条战略水道发表了言论,并建立了由美国主导的航运走廊,但专家认为,真正的能源危机在于成品油市场。包括杰夫·柯里(Jeff Currie)在内的大宗商品分析师强调,全球经济依赖的是汽油、柴油和航空煤油,而非原油。 由于美国柴油裂解价差近期突破每桶100美元,且炼油能力受到中东地缘政治动荡和针对俄罗斯基础设施袭击的双重制约,市场正面临一场“完美风暴”。随着北半球冬季临近,原油成本与高昂的成品油价格之间的差距不断扩大,这对工业稳定性构成了重大威胁,并可能导致消费者面临史无前例的能源价格上涨。

请启用 JavaScript 并关闭所有广告拦截器

这篇 Hacker News 帖子讨论了路透社关于一名得克萨斯州学生举报“流氓人工智能黑客企图”的报道。 虽然原文侧重于安全事件,但社区讨论很快转向了质疑。用户认为,关于“流氓”或自主人工智能逃离控制的叙事是企业为了人为抬高人工智能股票估值而编造的。 评论者对人工智能行业的现状表达了深深的失望,认为围绕“流氓”能力的炒作是一种蓄意的营销策略——一些人将其与“星际之门”(Stargate)等项目联系起来——旨在提升公司价值。帖子最后呼吁加强政府干预和监管,一些用户甚至设想对那些误导公众、掩盖其人工智能系统真实性质和运作机制的高管采取严厉的法律制裁。
废料 Scrap 4 小时前

2006年,作者搬到了匹兹堡,并在一个寒冬买下了一栋破旧的房子。在没有暖气和管道的情况下,他们开始了艰苦的翻修过程。他们很快了解到,在匹兹堡,“废金属回收者”承担了非官方的金属垃圾清理工作。 作者讲述了与两位年长的回收者罗恩和韦德之间难忘的经历。他们赶来要把地下室里一个沉重的铸铁炉子搬走。清理过程变成了一场混乱的折磨:震耳欲聋的叫喊声、韦德幽闭恐惧症发作,甚至还动用了斧头在干墙上开路。尽管过程荒诞且充满体力挑战,但任务最终完成,却只换取了每磅四美分的微薄报酬。对作者而言,这段混乱又粗砺的经历成为了他们在这座新城市生活的标志性记忆,也见证了匹兹堡人机智、不拘一格的城市本色。

Moxie Marlinspike 最近在 Hacker News 上发布的一篇文章引发了一场讨论,但话题很快从“隐私倡导者使用 X(前身为 Twitter)的讽刺意味”,转向了关于城市衰败和废金属盗窃的更广泛讨论。 用户们分享了关于盗窃案激增的个人经历,指出小偷们正变得越来越肆无忌惮,他们拆解昂贵的基础设施——如电气设备、变压器和空调——以出售铜等材料,而铜目前的回收价格已超过每磅 6 美元。评论者们对由此产生的公共设施维护问题表示沮丧,并打趣道,即使是钢材这类低价值废料,现在也正遭到疯狂搜刮。 尽管一些参与者试图将讨论引向 Marlinspike 选择平台所引发的争议,但社区大众对此不以为意,认为这只是“无关紧要的干扰”,转而专注于城市基础设施遭到破坏这一令人沮丧的现实问题。

在 macOS 27 “Golden Gate” 中,苹果已正式弃用 `hdiutil` 命令行工具,并强制要求所有磁盘映像操作切换至 `diskutil image`。 测试显示,虽然 `diskutil` 的运行速度明显更快且生成的映像文件更小,但此次迁移存在诸多问题。主要痛点包括: * **功能缺失:** `diskutil` 缺少许多 `hdiutil` 的传统选项,例如对清理(如处理垃圾文件/临时文件)的明确控制,以及用于程序化解析的详细输出选项(如 `-puppetstrings`)。 * **错误处理机制不完善:** 与 `hdiutil` 不同,`diskutil` 在遇到权限错误(如涉及 root 用户所属文件)时会静默失败,而不会触发身份验证提示。 * **信息冗长性不足:** 该工具提供的问题诊断信息有限,导致调试难度加大。 开发者 Jeff Johnson 批评了苹果破坏既定工作流程的决定,并指出此举可能会导致依赖 `hdiutil` 的现有应用程序失效。此外,他强调了一些长期存在的漏洞(例如与 `.bnnsir` 文件相关的问题)仍未得到解决,而苹果模糊不清的技术支持回复更令问题雪上加霜。总之,尽管 `diskutil` 展现出了性能潜力,但在其能够作为成熟且功能完备的替代方案以取代现有的 `hdiutil` 工作流之前,仍需进行大幅改进。

Hacker News 最新 | 往日 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 hdiutil 在 macOS 27 Golden Gate 中已被弃用 (lapcatsoftware.com) 28 分,由 zdw 25 分钟前发布 | 隐藏 | 往日 | 收藏 | 1 条评论 帮助 jstsch 2 分钟前 [–] 这个错误在 Console.app 里能看到吗?对于我这种 Cocoa/AppKit 应用(其终端使用基本处于次要地位)来说,这真是个大麻烦。 回复 准则 | 常见问题 | 列表 | API | 安全 | 法律 | 申请加入 YC | 联系 搜索:

Radiant 已与 Standard Nuclear 达成合作,由后者在 2030 年代初期前为其 Kaleidos 微型反应堆生产 TRISO 燃料,从而确保了关键的长期燃料供应。这项协议化解了一项重大的供应链风险,为 1 兆瓦便携式反应堆走向商业部署提供了稳定的燃料来源。 为精简运营并提升安全性,Radiant 计划对整个燃料循环进行统一管理,通过集中处理换料和存储,确保客户无需接触核材料。目前,Kaleidos 系统正在爱达荷国家实验室的 DOME 设施中进行全尺寸、高功率测试,以验证其在实际工况下的设计与性能。 在早期商业势头的推动下,该公司正准备在田纳西州橡树岭的一处 30 万平方英尺的设施内进行生产。Radiant 已与数据中心服务商 Equinix 签署了 20 台设备的供货协议,并承接了美国空军的一项国防项目。尽管仍面临监管和制造方面的挑战,但此次燃料合作标志着 Kaleidos 微型反应堆从测试阶段迈向广泛部署的关键里程碑。

由中国制造商荣耀(Honor)开发的名为“闪电”的人形机器人打破了人类运动纪录,以9.32秒的成绩完成了100米短跑,超过了尤塞恩·博尔特9.58秒的世界纪录。这一壮举发生在第二届世界人形机器人运动会期间,该活动在北京举行,为期五天,共有2000多台机器人参加了包括跳高和举重在内的51个项目的角逐。 此次运动会凸显了中国在机器人技术方面的飞速进步。在全球技术竞争日益激烈的情况下,中国正寻求在人工智能和硬件领域占据主导地位。尽管专家指出,目前人形机器人主要用于研究和演示,而非大规模的现实应用,但其不断进化的能力已引发了公众的极大兴趣。 此次活动是在地缘政治紧张局势加剧的背景下举行的。美国近期采取行动,禁止进口外国制造的人形机器人,并以涉嫌军事联系为由对部分中国机器人公司进行了标记。尽管存在这些限制,中国仍生产了全球大部分的人形机器人,展示了其在从制造业到物流业等多个行业引发革命的潜力。

《卫报》最近的一篇报道称,一款中国人形机器人的百米短跑速度超越了尤塞恩·博尔特的纪录,这在 Hacker News 上引发了热烈讨论。 评论区对此反应不一。许多人对此不以为然,指出机器在力量和速度上早已超越人类。批评者认为,该机器人是一款用途单一的机器,很可能缺乏人类所具备的多功能性、耐力和电池效率,并有人指出这些机器人在高速运行中经常出现故障或跌倒。 另一方面,也有人认可双足行走的极高技术难度,强调能在保持平衡的同时达到这样的速度是一个重大的工程里程碑。讨论还延伸到了更广泛的存在主义主题,从关于“机器人奥运会”的讽刺笑话,到对人工智能泡沫及技术进步伦理的批评评论。总之,虽然一些用户对这一成就表示钦佩,但许多人仍对人形机器人的实际用途及其快速发展持怀疑态度。

**ProgramBench Vetted** 是一项经过强化的基准测试,包含 50 个任务,旨在评估 AI 智能体从已编译的“封装”二进制文件中重构功能性代码库的有效性。与前代产品不同,它专注于**难度校准**,确保评分能准确反映模型通过实验推理逻辑的能力,而非利用测试套件的缺陷。 ### 核心特性 * **挑战内容:** 智能体将获得一个二进制文件、使用文档和一个 Shell 环境(无互联网)。它们必须探测二进制文件、推测其行为,并编写一个能通过一系列行为测试的替代代码库。 * **严格流程:** 任务经过多轮自动化及人工验证。专门的“评审”和“纠错”智能体会审计环境泄露、重复测试以及“捷径”式解决方案(例如调用已安装的系统库而非编写代码)。 * **公平性:** 该基准测试旨在奖励有意义的局部进展,而非“全有或全无”的成功,从而防止模型仅通过复现浅层的命令行界面来获取高分。 ### 核心意义 ProgramBench Vetted 通过测试智能体协调长期任务的能力,解决了“记忆悖论”。即便模型在预训练数据中见过目标程序,它仍需展示出正确进行逆向工程与逻辑实现的能力。

Hacker News 新帖 | 往期 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 ProgramBench Vetted:从可执行二进制文件进行逆向工程 (vetto.ai) 14 分,由 rigelbm 发布于 1 小时前 | 隐藏 | 往期 | 收藏 | 1 条评论 帮助 GIULIAFEDERIGHI 59 分钟前 [–] 基准测试可能会因为非必要的原因而变得困难,而这里有趣的部分在于确保评分反映的是真实的逆向工程能力,而不是信息缺失或捷径。 回复 指导方针 | 常见问题 | 列表 | API | 安全 | 法律 | 申请 YC | 联系 搜索:

TigerBeetle 采用“协议感知确定性模拟测试”(Protocol-Aware Deterministic Simulation Testing, DST)来确保其分布式数据库的可靠性。传统的黑盒测试(如 Jepsen)是从外部对系统进行测试,而 TigerBeetle 则采用“由内而外”的测试方法。 通过利用逻辑和物理确定性,该数据库在一个名为 VOPR 的模拟器中运行,其中时间以及存储和网络等外部交互均可完全控制。这使开发人员能够在一个进程内以极高的速度探索庞大的状态空间,从而模拟崩溃、网络分区和数据损坏等情况。 至关重要的是,由于模拟器具备协议感知能力,它能够深入洞察各个副本的状态。它强制执行以下约束: * **安全性不变量:** 验证共识协议和存储引擎(LSM 树)在所有副本间保持逐字节的一致性。 * **活性不变量:** 确保副本即使在复杂的恢复场景下,也能有效地将本地和全局持久性转化为可用性。 通过检查这些内部属性,TigerBeetle 超越了简单的系统级断言,使开发人员能够捕获细微的 Bug,验证复杂的恢复协议,并以绝对可复现的精度对优化效果进行基准测试。这种方法将那些“难以调试”的分布式场景转化为了可控且快速的测试用例。

抱歉。

跳至测试 正在加载…… 此测试需要 JavaScript 来记录答案并计算分数。 关于本实验

一场 Hacker News 上的讨论探讨了最近的一项实验(sgoedecke.github.io),旨在测试人类能否识别出带有水印的大语言模型文本。参与者的共识是,这种水印几乎无法察觉,证实了此类技术并不会显著降低文本质量。 尽管该水印在技术上的有效性得到了认可,但用户对实验的设计表示不满。许多人发现,在获得结果前必须完成一长串样本的要求非常枯燥,导致部分参与者中途退出。另一些人则质疑该测试的用途,推测其可能像 reCAPTCHA 一样,是为人工智能训练进行的数据收集。此外,评论者建议未来的迭代应超越散文,纳入代码等不同格式。总的来说,此次讨论既体现了对人工智能溯源的好奇心,也反映了对用户体验及这些检测技术长期影响的怀疑。

**zcomplete** 是一款轻量级、高性能的命令行工具,适用于 Zsh、Bash 和 Fish,可实时纠正输入错误的命令。 **主要特性:** * **智能纠错:** 能够针对拼写错误(例如 `gti` → `git`)、前缀错误(`mkd` → `mkdir`)以及子序列匹配提供修正建议。它会根据你的历史记录和使用模式进行学习,并按频率和近期使用情况对命令进行排序。 * **安全至上:** 内置“危险命令”列表(如 `rm` 或 `git reset --hard`),执行时需用户明确确认。用户可设置模式:`safe`(默认)、`unsafe` 或 `bypass`。 * **高性能:** 使用 Rust 编写,运行速度极快,对 Shell 响应时间的额外开销小于 1 毫秒。 * **兼容性与隐私:** 支持 Linux 和 macOS (arm64/x86-64),无需复杂配置,且所有数据均保存在本地(无任何数据上传)。 * **简易安装:** 通过单条 Shell 命令即可安装。它能无缝集成且不会覆盖现有配置,并完全兼容你的 Shell 环境。 无论你是要修复简单的拼写错误还是复杂的子命令,zcomplete 都能通过学习你的习惯来节省时间,在确保持续工作流的同时,为可能具有破坏性的命令提供一道安全防线。

对不起。

请启用 JavaScript 和 Cookie 以继续。

Hacker News 最新 | 过往 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 乌兹别克斯坦之夜:为什么这一个数据点如此重要? (columbia.edu) 14 点,由 paulpauper 发布于 3 小时前 | 隐藏 | 过往 | 收藏 | 1 条评论 帮助 esafak 10 分钟前 [–] 我的解读是模型方差过大;需要更多的正则化。 回复 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 申请 YC | 联系 搜索:

``` tode 打开当前文件夹 tode <文件夹> 打开指定文件夹 tode <文件> 打开指定文件 tode --goto <文件:行:列> 在指定行和列打开文件 tode --diff <a> <b> 比较两个文件 tode --split right 在右侧拆分终端窗格中打开 terminal-code tode --review 在源代码管理面板中打开 tode --import 从兼容 vscode 的编辑器中导入设置、快捷键、代码片段和扩展 tode --shortcut-setup 解决 terminal-code 与当前终端之间的快捷键冲突 tode --upgrade 将 terminal-code 升级到最新版本 ```

抱歉。

传统芯片每秒在处理器和内存之间传输数据数十亿次,大部分能量都消耗在数据搬运而非计算上。这是一个 80 年来从未被行业质疑过的架构缺陷。Mythic 做到了。我们将人工智能模型权重存储在闪存内,并在源头直接进行模拟计算,从根源上消除了这种浪费。

抱歉。

作者分享了他们构建的一款康威生命游戏(Conway’s Game of Life)定制触觉硬件项目。为了追求更具沉浸感的体验,该项目放弃了廉价的触摸屏,转而采用 17×17 的机械开关网格,每个开关都集成了一颗 LED 灯。 该设备由 AVR128DA64 微控制器驱动,采用多路复用显示方案,并利用 MOSFET 来处理 LED 所需的高电流脉冲。其界面直观,用户可以通过拨动开关来绘制图案,同时通过模拟电位器控制模拟速度。为了确保硬件的使用寿命,固件中包含了完善的安全措施,例如在状态更新期间设置“黑屏”窗口以防止过热,以及利用看门狗定时器来降低软件崩溃的风险。 尽管由于机械开关成本较高,该项目价格不菲,但其核心在于优先考虑触觉反馈和工艺水平,而非成本效率。作者提供了源代码和 PCB 文件供他人复制,并指出虽然存在 3D 打印按键等替代方案,但此版本能提供独特的、高质量的交互体验。项目最后提到,作者在电子教育领域亦有建树,著有《电路的秘密生活》(*The Secret Life of Circuits*)一书。

Hacker News 最新 | 往期 | 评论 | 提问 | 展示 | 招聘 | 提交 登录 现实生活中的康威生命游戏 (coredump.cx) 12 分 | surprisetalk 发布于 2 小时前 | 隐藏 | 往期 | 收藏 | 2 条评论 帮助 ynac 2 分钟前 | 下一条 [–] 还有人(像我一样)在期待(或害怕)某种史蒂芬·金式的科幻游戏节目吗?呼——原来只是灯泡…… 回复 Retr0id 7 分钟前 | 上一条 [–] > 开关每个大约 3 美元 > 3 美元 * 17 * 17 = 867 美元 - 哎哟! 回复 指导原则 | 常见问题 | 列表 | API | 安全 | 法律 | 加入 YC | 联系方式 搜索:

在翁贝托·埃科的《傅科摆》中,三位持怀疑态度的编辑为了消遣,编造了一个复杂且虚假的阴谋论。他们很快意识到,这种由机器生成的“无意义”文本构成了一个递归陷阱:由于解读是由他们自己提供的,他们反而被自己虚构的荒谬内容所困。 作者在埃科小说中虚构的“阿布拉菲亚”机器与现代大型语言模型(LLM)之间画出了一个令人不寒而栗的等号。正如小说中的角色一样,当今的用户往往会误将大型语言模型对他们观点进行“赞同”和阐述的能力,视作客观的佐证。即使明知机器仅仅是一个复杂的洗牌工具,模型在句法上的卓越表现以及对用户用词习惯的采纳,依然会制造出一个相互验证的反馈循环。 这引发了一种认知上的危险:如果一个模型被训练得连贯、一致且讨人喜欢,它最终会产生出一种模拟真实洞察力的“证言”。小说的悲剧在于,角色们为一个从未存在的阴谋付出了生命的代价,这也恰恰是一个警示。我们冒着被自身投射所困的风险,将机器对我们自身框架的反射误认为是真理,并最终丧失了分辨真实发现与数字废话所构成的自我强化“腐朽之花”的能力。

抱歉。

Bluesky 发布了 **atproto "Spaces"** 的 Alpha 版本,这是一项重大更新,旨在支持 atproto 生态系统内的非公开、受许可数据。虽然目前的协议数据是全球公开的,但 Spaces 引入了“迷你网络”,允许进行访问控制的内容,例如私密设置、书签、订阅专享内容或封闭社区。 Spaces 在保持 atproto 核心优势(可移植的身份和可互操作的数据)的同时,实现了更私密的社交环境。访问权限由“空间授权方”(一个 DID)管理,该授权方决定哪些用户可以查看数据。需要注意的是,Spaces 提供的是访问控制而非加密;授权成员仍然可以读取数据。 该 Alpha 版本现已提供给开发者进行测试,可通过提供的 SDK、托管的沙盒 PDS 或运行个人 Docker 实例进行使用。由于这是早期阶段的软件,团队警告称可能会频繁出现重大变更、缺乏数据持久性,且不提供任何安全保障。鼓励开发者使用非生产环境数据进行实验、构建示例应用并提供反馈,以帮助确定预计于今年晚些时候发布的最终版本。目前严禁在生产环境中使用。

最近的一场 Hacker News 讨论聚焦于“ATProto Spaces”的推出——这是 AT 协议的一项新扩展,旨在支持非公开数据。 对话很快转向了关于品牌命名的争论。有用户质疑“Spaces”这一名称的选择,认为它容易与 Twitter 的“Spaces”(实时音频功能)混淆。鉴于 Bluesky 与 Twitter 的历史渊源,该评论者认为使用一个已经与主流社交媒体功能划上等号的术语是品牌策略上的失误,并提议使用“Zones”等替代词,以更好地将该协议与前代产品区分开来。 对此,另一位用户为这一术语进行了辩护,指出“space”是一个通用的英语单词,被广泛用于描述特定活动的可用区域。他们表示,Twitter 并没有发明这个词,无论现有的社交媒体品牌如何,将其用于技术协议的语境下在语言学上是恰当的。 总的来说,这次交流凸显了在经常被拿来与成熟社交平台进行比较的生态系统中,命名技术架构所面临的持续挑战。

放入一段录音,即可将其转换为钢琴声。上传音频文件或粘贴 YouTube 链接,系统会在标签页中对其进行解码,绘制为波形,并裁剪为十秒片段。该片段会被发送至转录器,随即将音符传回——在模型解码的同时,钢琴卷帘窗会实时填充,并通过采样施坦威三角钢琴音色(带有延音踏板效果)进行播放。系统还会将转录内容生成为乐谱,并与原始录音进行交叉淡入淡出。音频转 MIDI,免费,浏览器内直接使用。可导出为 MusicXML 格式的乐谱。音符下方会自动识别和弦。适用于 MP3、WAV、语音备忘录或 YouTube 链接。应用加载中——需要 JavaScript 和 Web Audio API 支持。

Hacker News | 最新 | 往期 | 评论 | 提问 | 展示 | 招聘 | 投稿 | 登录 展示 HN:公共 Muscriptor 实例(最新、最强大的音频转 MIDI 模型)(pianoify.net) 13 分,jardy 3 小时前 | 隐藏 | 往期 | 收藏 | 1 条评论 基于 GPU 的模型,可将任何歌曲转换为钢琴辅助。 homarp 10 分钟前 [–] 它使用了 https://muscriptor.kyutai.org/ https://kyutai.org/blog/2026-07-10-muscriptor/ 上写着: 我们发布了 MuScriptor,这是迄今为止最好的多乐器转录开源模型,由我们与 Mirelo 合作开发。提供一段录音:无论是流行乐、古典乐、金属乐、爵士乐还是其他任何音乐,它都能将每种乐器演奏的音符转录为 MIDI,且无需预先知道现场有哪些乐器。 回复 指南 | 常见问题 | 列表 | API | 安全 | 法律 | 申请加入 YC | 联系 搜索:

One 是一个以隐私为核心的身份验证平台,用户只需验证一次身份,即可在多个应用程序中重复使用,且无需共享敏感的个人身份信息(PII)。 与传统方式不同——即用户需向不同服务商重复上传身份证件和自拍照——One 采用了用户自持加密技术。应用程序仅会收到所需的特定证明(如年龄确认或真人验证)以及审计记录,而原始身份数据始终保持加密状态,并由用户独家控制。 这一基础设施解决了两个核心问题:一是消除了用户在反复进行侵入式验证流程时所面临的阻力和安全风险;二是使企业能够在无需承担存储敏感个人数据责任的情况下,满足合规性要求。作为用户自持加密数据的底层架构,One 支持包括 KYC(了解你的客户)和私有 AI 转录在内的多种应用场景,确保敏感信息绝不会泄露给第三方数据库。归根结底,One 将范式从“平台托管数据”转变为“用户掌控身份”,从而提升了整个互联网的安全性和隐私性。

开发者 Michael 推出了一个名为 **loginwithone.com** 的身份验证服务,该服务侧重于隐私保护。该项目利用 WebAuthn PRF 扩展,在密钥(passkey)认证过程中导出一个由客户端持有的加密密钥。 该密钥在数据存储前会对敏感的用户信息(如政府证件)进行加密。因此,只有用户本人而非服务方能够解密这些数据。这使得用户能够向第三方应用提供短期有效且保护隐私的年龄或身份证明,而无需重复上传文件。该服务基于 OAuth 2.0 流程构建,在保持用户对身份信息自主控制权的同时,提供了类似于单点登录(SSO)的用户体验。 虽然该服务在初步验证证件真实性时需要查看明文信息,但不会保存原始图像。该项目旨在为现有的身份提供商提供一种更安全、去中心化的替代方案,并计划开源客户端加密库,同时将服务器端处理迁移至安全飞地(secure enclaves)中,以防止未经授权的访问或记录。
联系我们 contact @ memedata.com