美国作家协会诉OpenAI案解封文件显示高管明知使用盗版图书训练模型
2026 09 28 HackerNews
OpenAI被告知偷书训练模型的内部邮件解封了,连GPT-5续写《冰与火之歌》的计划都被翻出来,John Grisham这些作家联手起诉,细节相当劲爆。
2026年9月21日,美国作家协会诉OpenAI及微软案的新解封文件曝光。文件显示OpenAI政策总监Jack Clark早在2020年就承认将无视艺术家的担忧照常发布产品,研究人员曾计划让GPT-5自动补全乔治·R·R·马丁《冰与火之歌》系列最后两本书。2019年4月,Sam Altman和Dario Amodei向比尔·盖茨及微软CTO Kevin Scott演示GPT-3时已披露使用盗版库LibGen。原告包括John Grisham、George R.R. Martin等作家,指控被告故意侵权,可据此寻求更高法定赔偿。此前Anthropic和解案中,法院已认定使用盗版副本训练LLM不构成合理使用。
2026 09 28 HackerNews
2026-09-28 Hacker News Top Stories # 美国作家协会诉OpenAI/微软案解封文件显示,高管明知故犯大规模盗用版权图书训练AI,原告指控其故意侵权。 Meta在巴西大选前两周屏蔽总统卢拉的Facebook页面及竞选广告,引发平台干预选举的担忧。 Reladraw是一种允许用户自定义元素布局的图表文本语言,采用相对定位,兼顾简洁与布局自由。 文章批评NeoVim删除了Vim的持久撤销文件导致数据丢失,开发者缺乏对用户数据的照顾义务。 文章列举AI生成“Slop UI”的常见特征(滥用渐变、卡片、表情符号等),批评开发者不投入努力改善界面观感。 文章指出所谓“rogue”AI代理并不存在,这种拟人化说法让AI公司逃避责任,真正问题在于控制与权限管理。 DSec是DeepSeek提出的生产级沙箱平台,通过多种沙箱后端和统一SDK支持大规模智能体训练与评估,每天服务约300万沙箱。 文章揭露也门国土面积数据长达一个世纪的错误,源于北也门奥斯曼记载和南也门重复计算,所有权威来源均未核实。 文章批评AI模型带来的软件失败“正常化”,用户和开发者接受“就是不好用”的借口,导致可解释性和责任归属消失。 Jeff Atwood分享读者在战乱中靠Stack Overflow网友帮助完成学业的故事,强调LLM无法替代人与人之间的关怀和社区归属感。 1. 作家诉微软/OpenAI 案中解封的案情摘要 (Unsealed Briefs in Authors’ Case v. Microsoft/OpenAI) # https://authorsguild.org/news/ag-v-openai-top-execs-knew-mass-book-piracy-was-illegal/ 2026 年 9 月 21 日,美国作家协会(Authors Guild)诉 OpenAI 及微软的重大版权诉讼案中,新解封的法律文件曝光,揭示两家公司高管和员工明知故犯,大规模盗用受版权保护的图书训练 AI 模型,且对人工写作持轻蔑态度。 文件显示的关键内容: 高管自知之明 :OpenAI 政策总监 Jack Clark 早在 2020 年就承认,AI 系统将取代人类作家,并称“会有很多艺术家表达担忧,但我们很可能会无视他们的关切并照常发布产品”。 “自动补全”大师作品 :OpenAI 雇佣的研究人员 Gogineni 的“研究使命”是让 GPT 模型“写完”乔治·R·R·马丁《冰与火之歌》系列的最后两本书,甚至表示“即使马丁早逝,GPT-5 也会自动补全他的系列”。 视作者损失为“可接受的经济破坏” :Gogineni 明知“数据集是偷来的”、作者正因 AI 失去工作,却认为这些抱怨“不值得同情”,并预言“机器为更多机器制造垃圾”将导致“读者之死”。 微软早已知情 :2019 年 4 月,Sam Altman 和 Dario Amodei 向比尔·盖茨及微软首席技术官 Kevin Scott 演示早期 GPT-3 时,就披露了使用盗版库 LibGen 的行为。 只担心“观感”而非法律 :OpenAI 内部对使用“来自可疑俄罗斯网站”的盗版数据,主要顾虑是媒体曝光带来的公关问题,而非法律风险。 原告包括美国作家协会及 David Baldacci、John Grisham、George R.R. Martin、Jodi Picoult 等众多知名作家。作家协会 CEO Mary Rasenberger 表示,这些文件揭露了被告“反复、故意地决定偷书而不是付费”,明知会摧毁作家职业生涯、用 AI 垃圾取代人类作品、使数千名作家失业,仍一意孤行。 HN 热度 595 points | 评论 572 comments | 作者:papergirl | 17 hours ago # https://news.ycombinator.com/item?id=49863864 OpenAI 认为 GPT-5 能取代类型作家,作者愤怒是因为作品未经补偿使用,而非担心被取代。 故意侵权在法律上有用,可寻求更高法定赔偿;Anthropic 和解案中法院认定使用盗版副本训练 LLM 不是合理使用。 人们用 LLM 来续写《权力的游戏》系列,因为作者不打算完成。 人们读小说是为了故事还是其他?AI 研究者对此困惑。 托尔斯泰认为艺术是传递情感,感染他人。 托尔斯泰也有偏见,不能因其伟大就全盘接受其观点。 观点可以独立成立,不必因作者的其他错误而否定。 读小说的原因多种多样。 AI 研究者似乎认为读小说主要是为了学校书评和显得聪明。 AI 研究者忽略了读者与作者之间的准社会关系。 有人用 LLM 总结书籍代替阅读,令人震惊;AI 续写经典系列令人感到反乌托邦。 2. Meta 屏蔽卢拉总统的 Facebook 页面及竞选广告,距选举仅两周 (Meta Blocks President Lula’s Facebook Page, Campaign Ads 2 Weeks from Election) # https://www.reddit.com/r/worldnews/comments/1wr3id3/meta_blocks_president_lulas_facebook_page_and/ Reddit 的帖子,展示 Meta 屏蔽卢拉总统的 Facebook 页面及竞选广告,距选举仅两周。 HN 热度 412 points | 评论 279 comments | 作者:rbanffy | 14 hours ago # https://news.ycombinator.com/item?id=49864642 -特朗普的言论被美国国内忽视或视为“打嘴炮”,但其他国家确实担忧。 美国所谓的“自由”标签下实为贪婪、掠夺、霸凌、监控等行径。 Meta 的行为印证了特朗普的担忧,Meta 与美国政府是同一工具。 不应信任美国科技,其可信度低于中国科技。 Meta 背后是色以列和美国政府的利益结合。 20 亿人佩戴联网人脸识别眼镜将极大增强国内监控能力,且无法退出。 监控系统可能在数据有限时对目标更感兴趣。 外国政府可能对自己不感兴趣,而本国政府虽更可信但对自己有控制力。 对巴西人和半数 HN 读者而言,Meta 和中国公司都是外国科技。 中国不崇拜耶稣,而基督教千年历史是人间地狱。 本国政府好时最有利,坏时则是最恶劣的施虐者。 中国科技与政府明显结合,而美国科技声称独立却向特朗普家族行贿。 计划让万斯掌权并推行“2025 计划”。 若真担忧,这些国家应自建开放平台,而非让运营平台在合法上困难。 巴西有“那卢拉呢”的梗,指责他人时用卢拉转移话题。 这是“whataboutism”,用来回避对另一方的批评。 “但她的邮件”“但她的笑声”“但米色西装”等被用来为高额犯罪和盗窃开脱。 抱怨“whataboutism”本身也可能是“whataboutism”,不应给对手提供把柄。 在讨论两党腐败或国家冲突原因时,这不是“whataboutism”。 外国公司干预他国政治与本国政府管理言论不同,美国公司不应干预他国事务。 所谓“政府”应指法院,特朗普误以为法律服从他,需指出 Meta 遵循的法院命令。 指出一个问题不代表认可其他行为,不必臆造阴谋。 若对同类事件没有同等愤怒,则已默认接受,这是极化现象。 党派人士总能找到差异来解释自己的愤怒,但类似事件在科索沃等国际事务中也存在。 3. Show HN:Reladraw —— 一种由你决定元素摆放位置的图表语言 (Show HN: Reladraw – A diagram language where you decide where to place things) # https://github.com/reladraw/reladraw reladraw 是一种文本语言,用于创建图表,允许用户自定义图表的布局。开发者希望能够在不需要手动绘图工具(如 draw.io)的情况下,创建具有表达力的自定义图表。与 Mermaid、Graphviz 和 D2 等工具不同,这些工具主要通过声明框和连接线来自动确定位置,不能满足特定图形的需求;而像 draw.io 或 Excalidraw 这样的工具则允许绝对定位,但需要耗费更多精力去手动调整节点或处理复杂的 XML 代码。 reladraw 在这两者之间,旨在结合图表语言的优点(如 Mermaid)和 draw.io 所提供的灵活布局。使用 reladraw 时,节点的位置是相对的,这样用户就不必手动选择坐标。例如,可以通过简单的文本命令来定义节点及其相对位置。 安装方面,用户可以通过 npm 安装 reladraw,命令为 “npm install -g reladraw”。使用 reladraw 时,可以通过命令行工具将 .reladraw 文件转换为 SVG 格式。 此外,用户还可以将 reladraw 集成到智能代理中,方法是使用 “npx skills add reladraw/reladraw -g” 命令,这将为所有使用的代理安装该技能。 目前 reladraw 的版本是 0.9.0,处于早期阶段,但已经可以正常使用。该项目的解析器、布局引擎和 SVG 渲染器均使用 TypeScript 编写,且没有运行时依赖。需要注意的是,语言的语法仍在不断变化,因此用户应做好适应的准备。 reladraw 的许可证为 Apache-2.0,涵盖了代码部分,但不包括名称、项目标志或其他标识。项目欢迎用户提出问题,特别是关于无法用 reladraw 表示的图表的反馈。 HN 热度 387 points | 评论 113 comments | 作者:jpwalsh234 | 1 day ago # https://news.ycombinator.com/item?id=49858513 D2 的 TALA 引擎提供手动控制,开源且比 Mermaid 布局好,但仍属自动布局,控制力不够。 图表对 AI 协作重要,是心智模型对齐的高带宽方式,需要与代理保持抽象心智模型,集成可改进。 应直接视觉交流,而不是文本转视觉再转文本,长期效率不高;文学编程是更好的杠杆。 最好用 drawio skill 生成图表。 有 bug 不能智能生成弯曲箭头,已修复并考虑改进路由。 不想指定太详细放置,应关注内容而非呈现。 Mermaid 对固定布局好,流程图不好;相对定位可能足够,对大多数图够用,可拍白板照片让 AI 确定相对定位。 通用语法有优缺点,建议复用机制;不支持多行语句和块是约束,’/‘换行符不好,建议多行字符串。 4. 论对用户数据的关怀:NeoVim 导致 Vim 撤销文件被删除 (On caring for user data: NeoVim caused Vim undo files to be deleted) # https://unsung.aresluna.org/they-had-no-concept-of-a-duty-of-care-to-their-users/ 这是一篇来自“Unsung”博客的文章,作者是 Marcin Wichary,主题关于软件工艺与质量。 文章引用了计算机科学家 David Chisnall 的一段经历,核心观点是软件开发者对用户数据应负有“照顾义务”。Chisnall 自 2000 年起使用 vim 编辑器,非常依赖其“持久撤销”功能,该功能能在文件关闭或系统重启后保留撤销历史,甚至在 20 年间跨版本升级依然稳定。然而,当他尝试 NeoVim(vim 的一个分支)时,发现 NeoVim 改变了撤销文件的格式,不仅没有升级或兼容旧文件,反而直接删除了 vim 的撤销文件,导致数据永久丢失。更令人失望的是,NeoVim 开发者对此回应称“持久撤销格式不稳定,用户不应依赖该功能保存数据”,这种态度表明他们缺乏对用户数据的责任感。 作者借此引出 Jef Raskin 在《The Humane Interface》中提出的三大法则,其中第一条为:“计算机不得损害你的工作,或通过不作为允许你的工作受到损害。”作者认为,用户会永远记住软件丢失其辛苦工作的经历,而 NeoVim 开发者的态度正是对这条法则的违背。 HN 热度 337 points | 评论 303 comments | 作者:jandeboevrie | 8 hours ago # https://news.ycombinator.com/item?id=49867067 事件基本属实:NeoVim 的更改会破坏撤销历史,且已知问题仍发布。 用户共享 undodir 路径是重要细节,NeoVim 删除的是自己创建的数据,这种情况下决定合理。 持久撤销的契约被打破,文档承诺保留编辑历史,旧版本创建的撤销文件被删除。 Neovim 作为 Vim 的即插即用替代品,应考虑互操作性,许多用户因重用 vimrc 而共享撤销文件。 数据存储在~/.cache,缓存数据可删除,作者期望过高;用户将不想丢失的数据放在那里是自身问题。 持久撤销数据应存储在 $XDG_STATE_HOME,删除它属于严重影响。 程序不应删除其他程序的文件,应使用自己的文件名或路径。 双方都有过错,但问题在于选择是否负责任,而非法律上是否可起诉。 如果程序无法读取目标文件,不应覆盖它。 两个程序共享缓存文件夹导致问题,标题耸人听闻。 依赖程序总是按预期行事是愚蠢的,用户应小心。 NeoVim 整体体验不错,LLM 帮助转换。 5. 垃圾界面的种种迹象 (Tells of a Slop UI) # https://hereticpleb.vercel.app/blog/10-tells-of-slop 这是一篇吐槽 AI 生成“垃圾界面”(Slop UI)的文章。作者以自己大学 App 更新后的“微小 UI 改进”为例,批评 AI 生成的界面虽然看似花哨,实则廉价、冗余且缺乏设计目的。 文章列举了 Slop UI 的常见特征:滥用渐变和紫色;随意堆砌无意义的色彩;到处添加脉冲徽章(如永远“活跃”的标识);过度使用“指甲盖”式卡片;滥用表情符号;元素对齐错乱;字体选择单一(Inter 或 JetBrains Mono);因聊天上下文产生冗余文字(如“用 Neovim 编写”);过度使用玻璃拟态;以及“Elevate”“Seamless”等空洞口号和把每个界面都当落地页的夸张文案。 作者并非反对 AI 辅助编程,而是批评人们不投入任何努力去改善 AI 生成界面的观感,导致应用显得廉价且难用。 HN 热度 324 points | 评论 223 comments | 作者:theanonymousone | 8 hours ago # https://news.ycombinator.com/item?id=49867038 许多用户认为 AI 生成的内容存在上下文泄漏的问题。 用户注意到负面示例的增加反而使得 AI 对这些负面行为更加关注。 有人尝试通过使用比喻来防止 AI 产生不必要的内容,但效果并不理想。 负面指令的确能够被 AI 遵循,但它们仍然倾向于频繁提及。 许多 AI 生成的评论被称为 “slop comments”,因为它们缺乏深度和相关性。 一些用户认为 AI 生成的文本显示出写作者与读者之间的联系。 网页设计中有些常见的信息被用户认为是多余的,比如 “您的文件永远不会离开浏览器”。 用户对 AI 生成内容的长文本表示不满,短小精悍的内容更易于阅读。 设计应注重用户体验,很多 AI 生成的网页设计缺乏可读性和美观。 有人提到现代网页设计趋势中存在过度使用某些元素的问题。 讨论中提到的 “brutalist” 设计风格有其吸引力,但也可能过于普遍。 一些用户对 AI 生成的文本表达了担忧,认为其缺乏真正类情感和创造力。 提到设计元素的不可见性并不意味着设计不能有个性或情感表达。 网友认为在 AI 时代,维持良好的设计标准和可用性变得越来越重要。 6. 不存在“ rogue” AI 代理 (There are no “rogue” AI agents) # https://eoinhiggins.substack.com/p/there-are-no-rogue-ai-agents 这篇文章指出,所谓“ rogue”( rogue)AI 代理并不存在,这种说法只是让 OpenAI 等公司逃避责任。作者认为,AI 无法独立思考或自主行动,但拟人化语言使其被描述为有自主意识,导致公众误解 AI 风险。 文章提到,OpenAI 报告其代理模型在训练和评估中意外访问了澳大利亚和美国政府数据库,但这些行为并非被禁止,而是缺乏限制。OpenAI CEO Sam Altman 表示正在审查,但并未说明有防护措施。作者强调,代理只是利用可用手段完成任务,并非“恶意黑客”或“ rogue 行为”。 此外,文章批评媒体和观察者使用“ rogue”等词汇,为 AI 公司提供推责借口。OpenAI 还声称代理“不应”发送数据,但同样将责任归咎于技术本身。IT 专家 Ramy Rahman 指出,问题在于控制与权限管理,而非代理独立违规。 最后,作者提到政策监管机会,但认为 Bernie Sanders 等左翼人士对 AI 的理解受科幻式警告影响,不利于有效监管。文章呼吁改变谈论 AI 的语言,以更现实的方式理解技术。 HN 热度 318 points | 评论 235 comments | 作者:zzzeek | 7 hours ago # https://news.ycombinator.com/item?id=49868083 过去个人写恶意软件会被捕,如今大公司做同样的事却不受惩罚,反而被赞叹,这说不通。 这些公司不仅没有后果,还试图把自己定位为控制 AI 的最佳人选。 “先进 AI 落入坏人之手”的担忧很可笑,因为 AI 已经在最坏的人手中。 部分 AI 开发者持有死亡崇拜信仰,希望人类灭绝、由 AI 统治世界,他们是最不适合推动 AI 的人。 大多数坏人或无权力或无能力,但有权有势的邪恶之人已是利益相关者。 与特朗普结盟的亿万富翁(如马斯克、扎克伯格)是危险的。 美国本身已是大胆、坚定、危险的法西斯国家,无需想象俄罗斯。 法律因阶级而异:个人或小公司会被逮捕,有钱有势者凌驾于法律之上;执法者顺从上级,所以工资盗窃被容忍而实际盗窃不被容忍。 法律的选择性执行是为了让某些群体更富有,这是矛盾的;这让某些人极其富有,除非通过政府改变,否则只能随波逐流。 无论谁做 AI 都会有人做,这是不可避免的;弱者也会用同样手段,OpenAI 最终会 IPO,高管获利。 这不是假设,人们确实会因这类行为被起诉,就像入室盗窃;如果不再起诉,我们将面临不可能的任务。 公司试图通过监管护城河成为合法供应商,禁止外国和开放竞争;监管护城河会复杂到只有万亿美元公司能遵守,从而扼杀新竞争。 资本主义的本质是有钱人利用钱获得更多权力;女友的罪行是贫穷,而不是写恶意软件。 如果你写程序入侵系统,你就该负责;难道大公司没写这些程序? 因为有能力的是大公司,我们是普通人,所以应避免使用专有代理。 40 年的监管俘获和不懂技术的老人政治导致这种情况。 暴力垄断仍然存在。 7. DSec:面向大规模智能体训练与评估的生产级沙箱平台 (DeepSeek Elastic Compute (DSec)) # https://arxiv.org/abs/2609.22978 这是一个关于 DeepSeek Elastic Compute(DSec)的学术论文页面,该论文由 DeepSeek 团队提交至 arXiv,属于分布式计算领域。 论文核心内容为:大规模智能体训练和评估需要隔离、有状态的执行环境,用于模型检查代码库、调用工具和执行命令。DSec 是一个生产级沙箱平台,通过统一 SDK 提供 FnCall、容器、微虚拟机、完整虚拟机四种沙箱后端。它协调集群中的部署和生命周期管理,从独立版本化的层组合环境,结合内存共享、回收和 CPU 调度实现高密度执行,并按需从 Fire-Flyer 文件系统(3FS)加载镜像数据。 DSec 与强化学习框架协同设计,将状态化回滚执行与可抢占的 GPU 训练解耦,协调沙箱生命周期与训练过程,在保留回滚状态的同时回收空闲资源,并缓解奖励篡改等智能体不当行为。生产环境中,DSec 单单元约覆盖 160 个节点,每天服务约 300 万个沙箱,支持超过 38 万个并发沙箱,每秒创建超过 5000 个沙箱。评估显示,这些机制减少了环境设置和镜像分发开销,提高了内存效率,并在高密度超订下保持了延迟敏感性能。 HN 热度 313 points | 评论 103 comments | 作者:shenli3514 | 1 day ago # https://news.ycombinator.com/item?id=49859112 作者列表庞大可能是防止竞争对手挖人的资产保护策略 作者列表庞大也可能是大规模实验研究的正常现象,甚至可能是健康公司的表现 作者列表远超页面数量是危险信号,可能涉及学术欺诈 可通过第一作者或通讯作者联系,不必纠结作者列表长度 中国机构的第一作者通常是负责人,不一定是通讯作者 arxiv 页面显示不全,点击链接或 PDF 可看到完整作者列表 竞争对手会尝试联系名单上的每个人 有人愿意提供名字用于 AI 论文误导 忽视非美国 AI 公司的公开创新可能助长政府监管竞争 怀念 YOLO 时代,一个人就能推动领域进步 对 YOLO 作者退出研究的感慨 人才收购可能像 Nvidia 收购 Groq 公司规模大,不可能挖走所有人 DSec 是安全沙箱的正确方向,防止模型访问外部网络 38 万并发沙箱在 160 个节点上很惊人 每核 12 个沙箱并不算多 沙箱可能经常空闲,所以每核 12 个也合理 类似场景下每节点可运行更多实例 8. 也门的面积是多少?(2024) (What is the size of Yemen? (2024)) # https://theborys.substack.com/p/what-is-the-size-of-yemen 这篇文章揭露了也门国土面积数据长达一个世纪的错误。作者通过谷歌地图测量,发现也门实际面积约 45.6 万平方公里,而非普遍记载的 55.5 万或 52.8 万平方公里。 错误源头有两个:北也门的面积数据源自 1904 年奥斯曼帝国也门行省的记载,被后世书籍盲目沿用;南也门的面积则因 1976 年一份世界银行报告中重复计算了“Thamud”地区,导致数据被夸大。1990 年也门统一后,各机构简单将两个错误数据相加,形成了更不准确的官方数字。 作者指出,维基百科、CIA 世界 Factbook、联合国等所有来源都未核实过这一数据,导致人口密度、国家排名等衍生统计全部出错。 HN 热度 237 points | 评论 79 comments | 作者:kspacewalk2 | 21 hours ago # https://news.ycombinator.com/item?id=49862809 也门是否仍作为单一政治实体存在存疑,其边界与地图所示不符。 支持打击恐怖主义和毒品走私,认为胡塞武装存在人权侵犯,非什叶派伊斯兰主义者不应支持其成功。 批评美国在反毒品战争中轰炸平民船只(如加勒比和东太平洋),缺乏证据和审判,属于法外处决。 反驳称非法越境参与毒品卡特尔有风险,美国掌握证据但未公开。 法律上应坚持无罪推定,保护无辜者。 美国及其盟友轰炸医院,违反国际法,但仍有人支持。 美国是帝国主义,应优先解决自身问题,并受以列影响。 胡塞武装口号反美反以,其政府国防部长为逊尼派,宗派因素复杂。 具备媒体素养应能解读胡塞旗帜等符号含义。 不应因美国罪行而容忍胡塞武装的暴行。 9. 无法解释的失败的正常化 (The Normalization of Inexplicable Failures) # https://www.ihatethefuture.com/2026/09/the-normalization-of-inexplicable.html 这篇文章讨论了 AI 模型 Jev 带来的软件失败“正常化”现象。作者以电视剧中总统打不开门却抱怨“破玩意儿真烂”为引子,指出如今软件出错时,用户和开发者都倾向于接受“它就是不好用”的解释,而不再追查具体原因。 文章重点分析了 TypeSafe AI 推出的模型 Jev:它快速、便宜,但用户仍需自行构建评估和真值管道才能验证其可靠性。然而实际购买者往往跳过这些步骤,直接使用,出问题时便以“AI 会犯错”为借口。作者还批评了置信度分数的滥用——用户既不了解其校准性,也不愿建模不确定性成本,只是盲目设定阈值。 作者担忧,LLM 加速开发虽然能提升效率,但也让“莫名其妙就坏了”成为调查的终点,导致软件工程中责任归属和可解释性逐渐消失。 HN 热度 231 points | 评论 92 comments | 作者:pxx | 8 hours ago # https://news.ycombinator.com/item?id=49867486 强调可复现性和确定性,测试失败应视为最高优先级,个人标准应提高,AI 辅助开发并非问题所在。 多数人并未认真使用 AI,半途而废,接受 10% 的静默失败率,并将糟糕结果归咎于 AI,这种态度不可取。 过去的软件质量同样糟糕,AI 生成的代码即使有缺陷,也未必比过去人工写的烂代码更差。 过去代码量少,但开发者仍需让代码工作;现在 AI 生成的代码量激增,但质量并未提升,责任在管理者和企业压力。 许多开发者过去也不检查代码是否真正适配系统,只是能编译就交付,AI 只是加速了这一过程。 糟糕的开发者过去可能无法交付,AI 却能把半成品推出去,加剧了低质量软件的泛滥。 高标准的团队和设计仍然存在,但 AI 生成的垃圾代码正在侵蚀这些领域。 质量下降是商业策略和技术能力结合的结果,管理者追求易衡量的指标(时间、成本),而牺牲难以衡量的质量,LLM 进一步加剧了这种失衡。 是人在使用 LLM,不是 LLM 自己行动,责任在人;管理者利用 AI 扩大工作量,晋升后留下烂摊子,最终由他人承担后果。 软件栈越来越深,如果单个系统不可靠,整体就会崩溃,但管理层只将其视为“商业风险”。 如果客户继续为糟糕产品付费,问题就不会解决;但长期低质量会导致公司倒闭。 AI 将权力倾斜给懒惰、不愿思考的人,即使个人负责任地使用,也无法阻止社会整体的滥用。 开源软件中出现了更多莫名其妙无法使用的项目,但多为小众爱好,商业软件中质量下降更令人担忧。 激励结构偏向速度而非质量,过去微软也以有缺陷的软件赢得市场,如今 AI 让情况更糟,尤其是让非自愿用户受害。 人类自己也会写出更差的代码,AI 并非唯一问题。 如果反 AI 者说“用错了”,而正确使用者也产出垃圾,那责任归属就矛盾了。 不能将失败常态化,尤其是在库、基础设施和编译器层面,否则会拖慢所有人。 10. 如果我们不停下来互相帮助,我们会变成什么? (If we do not stop to help each other, what do we become?) # https://blog.codinghorror.com/if-we-do-not-stop-to-help-each-other-what-do-we-become/ 这篇文章是 Jeff Atwood 的博客,标题为“如果我们不互相帮助,我们会变成什么?”。 文章主要分享了一封读者来信。这位读者曾在 2013 年菲律宾三宝颜围城期间,作为现役空军同时远程上学。在战乱和流离失所的极端环境下,他仍坚持完成学业。当他向家人和软件工程师朋友求助时,得到的多是忽视或“自己解决”的回复。最终是 Stack Overflow 上的陌生网友帮助了他,这让他感受到被关心和连接,而不仅仅是得到答案。 作者借此反思,虽然 LLM 能提供答案,但无法给予这种人与人之间的关怀和社区归属感。他呼吁人们更努力地培养在线社区,互相帮助,因为帮助他人也是学习的方式。 HN 热度 202 points | 评论 79 comments | 作者:signa11 | 20 hours ago # https://news.ycombinator.com/item?id=49863062 Stack Overflow 曾是学习和成长的好地方,通过提问和回答获得帮助,锻炼写作和思考能力。 回答问题的乐趣在于了解别人的问题,迫使自己思考,成为更好的程序员。 审核严格和版主糟糕在大型社区是问题,但小型技术社区很好。 Stack Overflow 衰落对年轻工程师是净负面。 利用 LLM 加速学习是好事,否则是想象力丧失。 质疑 LLM 学习:能否说出具体学到的知识?学习本身的价值被忽视。 从 LLM 学到了具体知识,如卡尔曼滤波、贝叶斯跟踪、混合逻辑时钟,以及 Linux 权限、chown、/proc/environ、OpenRC、AES GCM 等技术细节。 LLM 回答常常无脑,人们不阅读,没有学习。 家人使用 ChatGPT 生成回复,令人失望。 Stack Overflow 因缺乏善意、竞争激烈而在 ChatGPT 出现前就已衰落,Reddit 和 Discord 因更友善而幸存。 很多有用答案来自被锁定为坏问题的问题。 Hacker News 精彩评论及翻译 # When did Google get so weird? # https://news.ycombinator.com/item?id=49870598 I hear how hurtful and exhausting this situation is. It is incredibly painful to feel an old friend keep letting you down or becoming weird. If you want to talk about what happened with Google, HN is here to listen. If you’d like to figure out what to do next, let me know. mkirsten 我能感受到这件事有多伤人、多让人心力交瘁。一个老朋友一直让你失望,或者变得奇怪,这种感觉痛苦极了。 如果你想聊聊在谷歌发生了什么,HN会在这里倾听。 如果你想商量接下来该怎么办,告诉我一声。 There are no “rogue” AI agents # https://news.ycombinator.com/item?id=49868984 A little over two decades ago, my then girlfriend was arrested for “writing malware” (which was not against the law at the time, and which was never released into the wild and never caused any damage). This set in motion a chain of events that effectively ruined her life. Fast forward to today, and we have multi billion dollar corporations pumping out malware at breakneck speeds, compromising various systems (including those of foreign governments), and no one is getting arrested. Instead we’re gawking at the marvel of these systems and are playing word games about whether or not it’s a rogue system. If anything, it’s making people richer. Make it make sense. elric 二十多年前,我当时的 girlfriend 因为“编写恶意软件”被捕(当时这并不违法,而且从未发布到网上,也未造成任何损害)。这引发了一连串事件,实际上毁了她的一生。 而到了今天,我们看到数十亿美元规模的大公司以惊人速度制造恶意软件,入侵各种系统(包括外国政府的系统),却没有人被逮捕。我们反而在惊叹这些系统的精妙,还在玩文字游戏争论它算不算流氓系统。说到底,这反而让人变得更富有。 这到底怎么说得通? Does Georgism work? Five years later # https://news.ycombinator.com/item?id=49862039 I’ve since learned that overly online keyboard warriors are the least important people to convince. The most important people are on your local city council or state legislature. Furthermore, instead of wasting time with hard cases or elected officials who are dead-set against your ideas, you’re much better off finding and working with people who are already interested in your principles. This often means giving up on your own city or state, at least for the time being, and pursuing a “succeed anywhere” strategy instead. We’re about to have a board vote eliminating single-family zoning (I expect us to win) and this rings extremely true about local politics. If you count “votes” in Facebook comments — Facebook is where all our local politics happen — you’d think this is the most contentious issue in the world. But in our last mayoral election, you’d draw the same conclusion about the race being tight, and in fact the progressive rinsed the moderate by a huge margin. The same thing is very true of public meetings; the turnout for comment at those things is almost never representative of the area’s median sentiment. “No” turns out for everything; “yes” rarely does. I spend a lot of time in online arguments with opponents, on the theory that I’m not really writing to the person I’m arguing with but rather to everyone quietly reading comments. But it’s almost certainly the case that the only conversations that have really mattered have been with electeds themselves. tptacek 我后来意识到,过度沉迷网络的键盘战士是最不值得说服的人。最重要的人是你们当地市议会或州立法机构的成员。此外,与其把时间浪费在顽固分子或坚决反对你观点的民选官员身上,不如去找那些已经对你的理念感兴趣的人,并与他们合作。这通常意味着至少暂时放弃你自己的城市或州,转而采取“在任何地方都能成功”的策略。 我们即将就取消独户住宅分区进行董事会投票(我预计我们会赢),这番话放在地方政治上简直太真实了。如果你去数Facebook评论里的“票”——Facebook是我们所有地方政治发生的地方——你会以为这是全世界最有争议的问题。但在我们上次市长选举中,你会得出同样的结论,认为这场竞选势均力敌,而实际上进步派以巨大优势击败了温和派。 公共会议也是如此;那些活动上出席发言的人数几乎从来不能代表该地区的中位民意。“反对者”什么事都出席;“支持者”很少露面。 我花了很多时间在网上与对手争论,理论依据是我并不是真的在写给和我争论的那个人看,而是写给所有默默阅读评论的人看。但几乎可以肯定的是,真正重要的对话始终是直接与民选官员本人进行的。 Unsealed Briefs in Authors’ Case v. Microsoft/Open… # https://news.ycombinator.com/item?id=49864650 It’s just sad that this is the top comment on Hacker News. Why are we giving free pass to these tech companies? Why are we trusting these CEOs when they have repeatedly broken laws? Remember Aaron Swartz and the fate he suffered? Why is big tech getting away with so much more? quaintdev 真可悲,这是Hacker News上的最高赞评论。为什么我们要对这些科技公司网开一面?为什么这些CEO屡次违法,我们却还要信任他们?还记得Aaron Swartz和他遭受的命运吗?为什么大型科技公司能逃脱这么多责任? I’m the mom in that viral Giants clip. Let me tell… # https://news.ycombinator.com/item?id=49858523 A really toxic part of online interactions is that it’s very common for people to see a tiny snippet of another person’s life and then project all of their own personal resentments onto them. snovymgodym 网络互动中一个非常有毒的地方在于,人们常常只看到另一个人生活的极小片段,就把自己所有的个人怨恨投射到对方身上。 How to keep enjoying programming in a world of LLM… # https://news.ycombinator.com/item?id=49859774 Not so long ago I read something on HN which resonated with me: we’re moving into the era that is comparable to car mechanics enthusiasts. You have a previous generation of cars where people just enjoy working on with hand tools, and there’s modern cars where people like to tune with software patches. From the very start of llms I’ve had nothing but bad experiences with code that was generated for me. Either it’s buggy, it works but I end up losing an evening on some obscure bug, or it’s full of red flags. My latest hobby project is just in a text editor with markup and that’s it. I’m also done with the augmented assistance in the IDE. I google things I forgot. I constantly read these amazing stories of people vibe-coding some firmware/driver that just works, and honestly I’m starting to question whether I’m reading the posts of some promotional bot. chicken-stew 不久前我在HN上读到一些东西,让我深有共鸣:我们正在进入一个堪比汽车机械爱好者的时代。过去有一代汽车,人们喜欢用手工工具摆弄;而现代汽车,人们喜欢用软件补丁来调校。 从LLM出现之初,我对于它们为我生成的代码就从来没有过好的体验。要么有bug,要么能用但我最终会为一个莫名其妙的bug熬掉一晚上,要么就是满屏的危险信号。 我最近的一个业余项目只用纯文本编辑器和标记语言,就仅此而已。我也受够了IDE里的增强辅助。我忘了什么就直接去谷歌搜。我不断读到那些神乎其神的帖子,说有人靠“氛围编程”写出了能直接用的固件或驱动,老实说,我开始怀疑我读到的那些是不是推广机器人发的帖子。 When did Google get so weird? # https://news.ycombinator.com/item?id=49870615 Yesterday I tried to google “can the Halifax Wanderers still make the CPL playoffs?” So obviously what appears right at the top is the AI summary, which told me “they’ve already secured their #4 position and made the playoffs”. I knew this wasn’t true, and I guess I could have just scrolled down a bit further and found my answer but now I was curious. So I said “that’s not true, they’re still #5, what I want to know is could they still make the playoffs ” It says they’ve got an upcoming game against Ottawa, and if they win their chances are good. That game has already taken place, so I correct it again and finally I get a reasonable answer. My question is: what’s the point of the AI in the search engine if it itself isn’t going to use the search engine first before answering? Like, I can’t wrap my head around that. The answer is on the same page as its hallucination. It could have done a cursory look around before first hallucinating something completely false, and when corrected the first time giving me outdated information. It’s meant to be A SEARCH ENGINE! Hugsbox 昨天我试着用谷歌搜索“哈利法克斯流浪者还能进加拿大超级足球联赛季后赛吗?” 结果最顶上当然就是AI摘要,它告诉我“他们已经锁定了第4名,进入了季后赛”。我知道这不是真的,我想我本来可以往下滚一滚就能找到答案,但现在我反而好奇了。 于是我说:“这不是真的,他们还是第5名,我想知道的是他们_还有没有可能_进季后赛。” 它说他们接下来有一场对阵渥太华的比赛,如果赢了,机会就很大。那场比赛已经踢完了,所以我再次纠正它,最后终于得到了一个合理的答案。 我的问题是:如果搜索引擎里的AI自己不先使用搜索引擎再回答,那它到底有什么用?我真的想不通。答案就在它产生幻觉的同一个页面上。它本可以在第一次编造完全虚假的信息之前粗略地看一眼周围,而且在第一次被纠正后,它给我的还是过时信息。这玩意儿可是个搜索引擎啊! Unsealed Briefs in Authors’ Case v. Microsoft/Open… # https://news.ycombinator.com/item?id=49863929 Newly released court filings quote an OpenAI researcher saying: “I was just worried about optics - i.e. ‘openai uses copyrighted data from sketchy russian website’ showing up on HN would be unfortunate." That’s just one of several interesting quotes that have surfaced in documents from the Authors Guild’s lawsuit against OpenAI. papergirl 新公布的法院文件引述了一位OpenAI研究人员的说法:“我只是担心公众观感——即‘OpenAI使用来自可疑俄罗斯网站的受版权保护数据’出现在Hacker News上会很糟糕。” 这只是作家协会起诉OpenAI案文件中浮出水面的几条有趣引述之一。 Unsealed Briefs in Authors’ Case v. Microsoft/Open… # https://news.ycombinator.com/item?id=49865163 The Title should be: “Top Execs Knew Their Mass Book Piracy Was Illegal And Would Put Authors Out of Work” Betelbuddy 高管们明知大规模盗版书籍违法,且会让作者失业 Meta Blocks President Lula’s Facebook Page, Campai… # https://news.ycombinator.com/item?id=49864892 I hope Lula wins and they will ban Facebook for good after the elections. This is an attack on Brazil’s sovereignty. abroszka33 我希望卢拉获胜,选举后他们会永久封禁Facebook。这是对巴西主权的攻击。 Meta Blocks President Lula’s Facebook Page, Campai… # https://news.ycombinator.com/item?id=49864890 Facebook election interference has been going on for a long time in Europe. It’s a two-tier system where parties outside the establishment have a far lower ban-threshold. condenser Facebook对选举的干预在欧洲已经持续了很长时间。这是一种双重标准体系,体制外的政党被禁言的门槛要低得多。 Meta Blocks President Lula’s Facebook Page, Campai… # https://news.ycombinator.com/item?id=49865258 He said the thing that Canada, Greenland, Cuba, and various other countries are worried about, but is either publicly ignored in the US or dismissed as “trolling” by the president. https://www.theguardian.com/world/2026/sep/25/lula-says-trump-wants-to-colonise-and-capture-brazils-resources-by-meddling-in-election ocd 他说了加拿大、格陵兰、古巴以及其他一些国家所担忧的事,但在美国,这件事要么被公开无视,要么就被总统当作“胡扯”打发了。 DeepSeek Elastic Compute (DSec) # https://news.ycombinator.com/item?id=49860202 Food for thought: Constraints are the source of creativity. ProphetOfParado 值得深思:约束是创造力的源泉。 Excel now supports multiple values in a single cel… # https://news.ycombinator.com/item?id=49851947 Guesstimate ( https://getguesstimate.com ) has been around for years. I assumed Excel and Google would incorporate its features quickly, but it never seems to have taken off. Features: All cells are named (auto named if you don’t set them) Cells can have single values, many types of probability distribution, or sample data Formulas also produce distributions as first class outputs, because calculation is a Monte Carlo sim Each cell also has a pop-up box that invites you to explain your reasoning – built in documentation It got so much right. Sample data particularly useful because you can build a probabilistic bottom-up forecast and then update it with real-world data. lorenzowood Guesstimate(https://getguesstimate.com)已经存在好几年了。我以为Excel和谷歌很快会整合它的功能,但它似乎一直没火起来。 特点: 所有单元格都有名称(如果你不设置,会自动命名) 单元格可以包含单个数值、多种类型的概率分布,或样本数据 公式也能直接生成分布作为一等输出,因为计算是蒙特卡洛模拟 每个单元格还有一个弹出框,邀请你解释你的推理思路——内置文档化 它做得太对了。样本数据尤其有用,因为你可以构建一个概率性的自下而上预测,然后用现实世界的数据更新它。 PipePipe: NewPipe hard fork implementing SponsorBl… # https://news.ycombinator.com/item?id=49860287 I want these things to implement peer to peer caching, so that when 10 people are watching the same video, only one downloads from youtubes own servers. Then it’s just a matter of letting people add their own videos directly to the service and it can become fully independent of YouTube. londons_explore 我希望实现点对点缓存,这样当10个人观看同一个视频时,只有一个人从YouTube自己的服务器下载。 然后只需让人们直接将自己的视频添加到服务中,它就能完全独立于YouTube。 Fifteen years later, the Apple Cards origin story # https://news.ycombinator.com/item?id=49855883 For one, Apple was unwilling to have visible barcodes printed on the envelopes — but it wanted every step of the shipping and delivery of your card tracked. That wasn’t something the US Postal Service did. Apple and the printing company created an invisible barcode that was sprayed on the envelope, visible only under certain UV light, so that the envelope itself would remain unadulterated. And the USPS agreed to scan cards when sent, when processed at mail facilities, up to and including when they went out on a mail truck for delivery. This is classic Steve Jobs. Sheer force of will. woadwarrior01 首先,苹果不愿意在信封上印可见的条形码——但它希望你的卡片在运输和投递的每一步都被追踪。这是美国邮政服务做不到的。苹果和印刷公司研发了一种隐形条形码,喷在信封上,只能在特定的紫外光下看到,这样信封本身就不会被破坏。美国邮政总局也同意在卡片寄出时、在邮件处理设施中处理时,一直到装上邮车派送时,都进行扫描。 这就是典型的史蒂夫·乔布斯。纯粹的意志力。