Gemini 3.8 Flash 与 3.8 Flash Cyber

Gemini 3.8 Flash and 3.8 Flash Cyber

发布时间: 2026-09-02

链接: https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

谷歌推出Gemini 3.8 Flash及面向网络安全的Gemini 3.8 Flash Cyber两款新模型。3.8 Flash定位为更智能的"工作马"模型,通过执行更多推理步骤和迭代调用工具来提升软件工程与自主智能体任务表现,在DeepSWE v1.1等基准上超越前代及竞品,但可能因token消耗增加而推高实际成本。3.8 Flash Cyber则聚焦漏洞检测与自动修复,在CyberGym基准得分86.2%,跨20种编程语言漏洞发现成功率超70%,Chrome安全团队用其生成的正确补丁数量是大型商业模型的2.6倍。Cyber版通过新的Fairwind计划仅向政府机构、关键基础设施运营方等受信任防御者开放,并配备CodeMender智能体。两款模型API定价相同,均为每百万输入token 0.75美元、输出3.75美元。

评论要点:

评论者认为旧型号正逐步淘汰,新型号供应充足,不存在缺货问题。另一观点强调,若谷歌想保持竞争力,必须推出世界模型,否则难以在AI领域取胜。还有评论指出,该工具与Claude Code等类似,都带有“危险跳过权限”标志,可自动批准所有操作,这引发了对安全性和自主决策风险的担忧。分歧主要在于:一是对产品迭代节奏的看法不同,二是对技术方向(世界模型)的必要性存在争议,三是对权限控制机制的安全隐患持不同态度。

HackerNews


关于LWN订阅价格的一点说明

A note on subscription prices from LWN

发布时间: 2026-09-02

链接: https://lwn.net/Articles/1090585/

描述:

LWN宣布自2002年采用订阅模式以来第二次上调订阅价格,涨幅约20%,以匹配美国消费者物价通胀。新的月度订阅价格分别为:Starving hacker 6美元、Professional hacker 11美元、Project leader 19美元、Maniacal supporter 55美元,团体订阅同步上调。文章说明涨价前购买的订阅仍按原有效期执行,公告前已生效的月度订阅将在未来六个月按旧费率计费。LWN表示涨价是为了维持运营稳定,此前曾借此雇佣编辑并改进网站功能,同时承认近年订阅增长停滞,正寻求长期扩大订阅用户群。

评论要点:

有评论者指出LWN在无JavaScript环境下保持可访问性,这限制了使用Anubis等典型工作量证明方案,因此需要更多爬虫应对。另一用户作为订阅者表示欣慰,看到HN社区积极响应并有人订阅续费,强调LWN文章质量高,是其每日必访网站之一。还有人开玩笑称愿意订阅纸质版,呼应了LWN坚持无JS访问的立场。分歧在于技术方案选择:一方认为应引入更复杂的反爬机制,另一方则支持LWN为可访问性牺牲部分防护的取舍。

HackerNews


我可以选择退出我的输入或输出数据被用于训练吗?

Can I opt out of my input or output data being used for training?

发布时间: 2026-09-02

链接: https://help.mistral.ai/en/articles/455207-can-i-opt-out-of-my-input-or-output-data-being-used-for-training

描述:

该文章是 Mistral AI 官方帮助文档,说明用户输入和输出数据(如对话、文档等)可能被用于模型训练,但用户有权随时选择退出。文章详细列出了不同平台的退出方法:Vibe 用户可在管理面板的隐私设置中关闭"允许使用交互数据训练模型"开关,移动端则在设置→数据与账户控制中取消勾选"启用数据共享";Mistral Studio 和 API 用户需在管理面板的隐私菜单中关闭"匿名改进数据"开关。文档特别提醒,Vibe 与 API 的退出开关相互独立,需分别配置。企业版 Vibe 用户默认已退出训练,普通用户默认参与训练但可随时退出。

评论要点:

评论者质疑AI公司“不训练用户数据”的承诺是否涵盖对数据的简单再加工,认为这类保证可能流于表面。同时,有人指出美国科技巨头常利用政府干预规避外国监管,罚款难以真正落实,背后涉及数据与情报利益。分歧在于:一方相信技术方案(如tinfoil.sh)能从根本上解决隐私问题,使训练数据争议失去意义;另一方则强调法律执行受地缘政治掣肘,企业承诺与监管实际效果存在落差。

HackerNews


Muse Spark 1.3

Muse Spark 1.3

发布时间: 2026-09-02

链接: https://developer.meta.com/ai/models/muse-spark/

描述:

无法获取文章内容:该外链无法访问或没有可用正文。

评论要点:

有评论认为“瞄准更远”意味着应设定更高目标,而另一观点则关注将现有Claude技能和循环设计迁移到新框架的难易程度。分歧集中在编码基准测试中,模型本身与外部工具(harness)各自贡献多少,有人质疑基准成绩可能高估了模型能力。另有声音反驳称,实际应用中Anthropic的模型并不落后,暗示基准差异可能源于测试方法而非真实性能。

HackerNews


康懋达64于1982年9月1日发布

Commodore 64 released September 1, 1982

发布时间: 2026-09-02

链接: https://dfarq.homeip.net/commodore-64-released-september-1-1982/

描述:

这篇文章回顾了Commodore 64于1982年9月1日发布的历史,其名称源于64KB内存,是首款售价低于600美元且配备64K内存的电脑。文章探讨了实际上市时间与发布日期的差异,指出早期生产曾因质量控制问题外包给日本Kentron公司,最终该机型成为史上最畅销的电脑,销量约1230万台。文章还分析了C-64的持久生命力,包括其16色图形、8个精灵和灵活的SID三声道音效芯片等设计取舍,以及作者个人成长经历和该平台在2025年以FPGA主板形式重新投产的遗产。

评论要点:

有评论者回忆了从IBM 5150克隆机入门,后来接触C64并学习Basic编程的经历,对这台机器怀有深厚感情,并打算在44周年时重温旧游戏。另一位自称“90后”的评论者则因身处农村,1994年只能使用MS-DOS的Tandy 1000和Franklin ACE(苹果II克隆机),反而庆幸自己经历了类似“X世代”的计算机童年,认为这让他更懂命令行和底层原理,比那些直接使用Mac或Windows的同龄人理解更深。分歧在于:前者将C64视为个人计算机文化的启蒙象征,侧重怀旧与情感联结;后者则强调硬件落后带来的技术认知优势,隐含对图形界面时代“速成”用户的不屑。两者都认可早期计算机教育的价值,但对“理想入门方式”的评判标准不同——一个看重体验本身,一个看重技术深度。

HackerNews


三个网站为AI生成了215,128个“最佳软件”页面。Perplexity引用了它们

Three sites made 215,128 “best software” pages for AI. Perplexity cites them

发布时间: 2026-09-02

链接: https://trellner.com/reports/manufactured-sources-behind-ai-recommendations/

描述:

该报告调查了Perplexity在380个软件类别中推荐产品时所引用的来源。研究者通过OpenRouter向perplexity/sonar及sonar-pro各发起380次查询,共获得7,534条引用,其中59.8%指向Tranco排名10万以外的域名,23.4%甚至不在前百万之列。报告发现,第三大引用来源guideflow.com是某厂商的营销博客,而wifitalents.com、worldmetrics.org和gitnux.org三个疑似同属一个运营方的网站,自2023年12月起生成了215,128个机器生成的"最佳软件"页面,其首页HTML标题直接标注为"Facts & Grounding Page",明显面向检索模型而非人类读者。报告同时指出,这些站点在"项目估算软件"等同一类别上给出相互矛盾的排名,且存在未渲染的模板变量,暗示内容为批量生成。

评论要点:

用户选择Perplexity是为了避免被单一供应商锁定,而反方则讽刺这种选择,认为用户可能根本不会技术操作,暗示依赖AI工具不如掌握基础技能。另一条评论则批评用其他大模型作为基准评分器,认为它们会带有不可预见的偏好,导致评估结果难以理解。分歧在于:一方强调工具选择的战略自主性,另一方质疑用户能力并担忧评估方法的客观性。

HackerNews


最大暗物质探测器捕获单个奇异粒子

Biggest dark matter detector spots a single weird particle

发布时间: 2026-09-02

链接: https://www.science.org/content/article/world-s-biggest-dark-matter-detector-spots-single-weird-particle

文章报道了全球最大的暗物质探测器LUX-ZEPLIN(LZ)在南达科他州地下约一英里处探测到一个无法用已知背景信号解释的异常粒子事件。该事件发生在2023年6月,来自220天数据中,统计显著性为2.6西格玛,约有0.5%的概率来自已知背景过程,尚未达到5西格玛的发现标准。若确为暗物质WIMP所致,其质量至少为质子质量的200倍,且暗示暗物质与普通物质的相互作用比最简模型更复杂。研究团队在2026年TeV粒子天体物理会议上公布了结果,论文已提交Physical Review Letters,未来更多数据将验证这一发现。

评论要点:

有网友质疑暗物质的存在,认为这可能是数学在宇宙尺度上失效或缺少常数所致,但缺乏具体依据。另一观点则从物理机制反驳,指出若暗物质能像普通物质那样自相互作用,其分布会类似气体,无法形成观测到的星系外围引力晕,因此暗物质必须几乎不参与电磁和自相互作用。整体上,讨论聚焦于暗物质性质与数学模型的可靠性,分歧在于直觉怀疑与基于观测的物理推断之间的张力。

HackerNews


谷歌避免广告技术业务拆分

Google avoids a breakup of its ad tech business

发布时间: 2026-09-02

链接: https://www.nytimes.com/2026/09/02/technology/google-ad-tech-remedies.html

美国弗吉尼亚州联邦法官莱奥妮·布林克马裁定,谷歌无需出售其广告交易平台AdX,拒绝了司法部此前提出的结构性拆分要求,但接受了双方提出的大部分行为性补救措施。此前布林克马已于2025年4月认定谷歌在出版商广告服务器和广告交易市场存在非法垄断,司法部主张谷歌不可信、必须剥离AdX,而谷歌辩称拆分技术复杂且会损害客户。此次裁决是联邦法院连续第三次拒绝拆分大型科技公司,此前谷歌在搜索案中免于出售Chrome浏览器,Meta也免于剥离Instagram和WhatsApp。谷歌仍面临互操作性、数据共享等行为限制,并计划就垄断认定提起上诉。

评论要点:

评论者认为美国政府体制分裂、缺乏长远规划,总统更迭频繁导致政策难以连贯,而拆分大型科技公司会削弱美国对华竞争所需的规模优势,尤其在政府不愿大规模投资的情况下,私营巨头是维持资本开支的关键。另一观点则强调民主制度应保障公民直接权力,而非仅依赖选举代表,并批评当前政府腐败严重,政策受短期利益驱动。

分歧集中在两点:一是政府干预与市场自由的关系,一方主张政府应克制拆分企业,让公司匹配中国长期战略;另一方则质疑政府能力,认为结构性腐败和短视使任何干预都不可信。二是对民主本质的理解,一方视代议制为有效治理,另一方认为其导致权力被让渡,背离了自治理念。整体上,评论围绕美国制度效能、企业角色及对华竞争策略展开激烈争论。

HackerNews


荷兰央行将部分黄金从美国和加拿大转移至伦敦

Dutch central bank moves share of gold from U.S., Canada to London

发布时间: 2026-09-02

链接: https://nltimes.nl/2026/09/02/dutch-central-bank-moves-share-gold-us-canada-london-cites-instability

描述:

荷兰央行(DNB)于今年3月至8月间将约86吨黄金从美国纽约和加拿大渥太华转移至伦敦,理由是应对日益加剧的地缘政治动荡、强化危机应对能力。伦敦是全球实物黄金的主要交易中心,存放在那里的黄金在危机中可更快变现。其中约59吨通过在纽约出售并在伦敦购回完成转移,另有27吨经荷兰泽斯特金库转运至伦敦。转移后,荷兰黄金在纽约的占比从31.3%降至18.5%,加拿大从19.7%降至18.5%,伦敦占比升至32.1%,成为最大存放地,荷兰本土仍持有30.8%。荷兰央行行长表示此举旨在增强韧性与准备,尽管预计不会真正动用这些黄金。

评论要点:

有评论者以讽刺口吻提议将美国势力扩张至智利和火地岛,称当地矿藏丰富且渴望“疯王”带来的自由,显然是在影射美国对委内瑞拉的干预政策。另一条评论则聚焦黄金流向,指出一年前媒体曾报道相反趋势,质疑当前报道缺乏长期数据支撑,暗示美国黄金回流说法可能被片面呈现。还有评论补充具体交易细节,称59吨黄金在美售出后于伦敦回购,另有27吨从美国转至荷兰,再转至伦敦,强调物理转移路径清晰。分歧在于:一方将地缘政治干预视为荒谬延伸,另一方则对黄金流动叙事的真实性存疑,认为报道可能选择性呈现短期数据。

HackerNews


走出洞穴

Exit the Cave

发布时间: 2026-09-02

链接: https://turtlespace.blog/p/exit-the-cave

描述:

这篇文章以“洞穴”隐喻探讨了独自苦练与真实世界检验之间的张力。作者结合自己高中摔跤经历指出,人们常把可测量、可控制的努力(技术、体能)误当作决定成败的关键,却回避了无法控制的真实对抗。他引用丹·盖博的名言说明第三回合靠的是“心”,并反思自己其实是在避免失败而非追求胜利。文章主张,任何有价值的追求都需要“垫子”般的真实检验,与其在洞穴中无限打磨,不如勇敢地公开行动、接受现实反馈。

评论要点:

关于瓶颈与复杂性的讨论,评论者认为技术进步并非线性,而是不断遇到新瓶颈,且存在复杂度上限,如LLVM规模的项目难以快速生成。同时,克隆现有软件成本极低,可能削弱缺乏网络效应的服务竞争力。另一观点则质疑将“坚持苦干”归为男性特质,认为这种描述不恰当,并引用女性作者的经历佐证。

关于婚姻与健康的关系,有评论强烈反驳“婚姻无益”的结论,援引美国卫生部的综合研究指出,婚姻与更好的健康结果相关,且这种关联部分源于婚姻本身而非单纯的选择效应,但承认并非每段婚姻都必然带来改善。分歧在于对因果关系的解读:一方强调数据支持婚姻的积极影响,另一方则可能质疑其普适性或方法论。

HackerNews


我没有智能手机

I Don't Have a Smartphone

发布时间: 2026-09-02

链接: https://ploum.net/2026-09-02-i_dont_have_a_smartphone.html

描述:

作者以“我没有智能手机”作为应对商家强制安装App的借口,并列举了要求用户装App所隐含的十项假设(拥有设备、电量、存储、网络、Google账号等),指出这些假设极易失效。实际上作者使用Mudita Kompakt电子墨水手机、备用FairPhone 3及抽屉里的旧OnePlus 5,以尽量摆脱Google与Meta依赖,但银行、学校等场景仍迫使保留备用方案。文章批评社会将Google、Meta账号视为默认前提,并质疑欧洲政客忽视现有去中心化替代方案。

评论要点:

部分用户抱怨银行等机构要求提供国外结婚证书时,流程繁琐且依赖智能手机,怀念过去用Linux电脑就能轻松处理。另有观点强调不应刻意隐藏设备性能,反对为追求“弱机”假象而购买高配硬件。还有人将智能手机视为人类历史上最具腐蚀性的发明,认为其通过预测文本和算法推送削弱人的自主性,形成依赖,但承认自己选择非虚拟的“恶习”作为替代。分歧集中在技术便利与自主性牺牲的权衡,以及是否应主动抵制智能设备对日常生活的渗透。

HackerNews


衰老的大脑会将记忆混杂在一起,而非仅仅遗忘它们

Aging brains blend memories together instead of just forgetting them

发布时间: 2026-09-02

链接: https://studyfinds.com/aging-brains-blend-memories-together-instead-of-forgetting-them-study-finds/

这项由纽约州立大学宾汉姆顿分校 Ian McDonough 教授团队开展、发表于《Cerebral Cortex》的研究发现,记忆衰退并非单纯遗忘,而是大脑将不同记忆"混同"在一起。研究人员让约60名18至74岁的受试者在MRI扫描下完成面孔与物体/场景的配对记忆测试,结果显示从20-30岁到50多岁,记忆准确率大幅下降,中年即成为记忆功能的重要转折点。与预期相反,年长者在犯错时海马体反而表现出强烈的记忆模式再激活,这种本应促进记忆的神经活动却与错误相关联,说明老化大脑在检索时倾向于将相似记忆融合,而非简单地丢失信息。

评论要点:

有评论者调侃60岁对“超级天才”的定义变成“排便规律”,引发对年龄歧视的批评,认为这种玩笑不合时宜。另一条评论则指出,无论年龄大小,记忆本身常被重构为“合理的故事”而非精确记录,并以“大猩猩穿过球场”的著名实验为例。还有用户怀旧称当年《无尽的任务》画面惊艳,远超《Meridian 59》,但如今回看却觉粗糙,如同早期DivX视频相比VCD虽好,现在却满是块状和低分辨率。分歧在于:一方聚焦于年龄相关幽默的冒犯性,另一方则强调记忆主观性及技术怀旧中的失真,而非直接争论定义本身。

HackerNews


GrapheneOS称Pixel 11终究支持MTE

GrapheneOS says Pixel 11 has MTE support after all

发布时间: 2026-09-02

链接: https://grapheneos.social/@GrapheneOS/117194007157499435

描述:

无法获取文章内容:该外链无法访问或没有可用正文。

评论要点:

评论者围绕Pixel手机的系统体验展开争论。一方认为原生系统预装应用过多、Gemini功能侵入性强,电源键被占用且通知频繁,整体显得臃肿,相比之下GrapheneOS更简洁。另一方则反驳称预装应用属正常谷歌套件,电源键可设置改回,且任何手机原生系统都难以与定制系统比轻量,购买主打AI功能的手机却抱怨AI集成不合逻辑。分歧集中在“系统是否过度预装”与“对厂商默认功能的接受度”上,前者强调用户控制权,后者认为抱怨缺乏现实基础。

HackerNews


Paint.net 5.2 alpha 现已支持在 Linux 上运行

Paint.net 5.2 alpha now runs on Linux

发布时间: 2026-09-02

链接: https://forums.paint.net/topic/134562-paintnet-52-alpha-build-9739/

Paint.NET 5.2 Alpha(build 9739)首次加入了对 Wine/Linux 的"极度实验性"支持,开发者 Rick Brewster 在论坛公布了这一版本。该版本升级到 .NET 11,并新增了 8 种效果。要在 Linux 上运行,需使用便携版、Wine 11.14 以上版本、安装 DXVK,并以 /wine 参数启动,该参数会关闭 UI 动画、Composition 和 Direct2D 原生渲染,改用内部从零逆向重写的托管 Direct2D 实现。这段约 18 万行的兼容层代码主要由 AI(Claude)在约三周内编写完成,开发者坦言其未经充分人工审查、远未达到生产可用标准,社区对此反应褒贬不一。

评论要点:

评论者普遍认为Bluesky并未摆脱Twitter的毒性,只是换了一种形式。有人指出,用户从Twitter迁移时带来了原有的对抗性文化,甚至通过截图“洗白”仇恨内容,导致平台仍充满争吵。另一观点则强调,Bluesky的“静音列表”功能虽能屏蔽特定群体,但无法阻止用户间接传播争议内容,实际效果有限。分歧在于:一方认为平台本质未变,只是换了个环境;另一方则暗示Bluesky的社区氛围比Twitter更糟,因为用户更“大声”且乐于攻击他人。整体上,评论者一致批评Bluesky未能解决社交媒体的根本问题,但对其严重程度和归因存在差异。

HackerNews


我想过一种NPC式的生活

I wanna live an NPC life

发布时间: 2026-09-02

链接: https://signalundefied.bearblog.dev/i-wanna-live-an-npc-life/

描述:

这篇文章重新解读了“NPC式生活”的意义。作者认为,NPC并非失去自主权或旁观他人人生,而是像游戏中的铁匠一样,无论周围发生什么(如屠龙、被偷窃)都毫不在意,只专注于做好自己的事。作者指出,这本质上是一种“不在乎”的终极心态,与斯多葛哲学相通。文章主张不必追求成为主角,可以开无聊的车、做无聊的工作、下班后什么都不做,只凭内心感受而非义务去行动。当不再执着于当主角时,才能真正活出自己的人生。

评论要点:

评论围绕“NPC”隐喻展开,一方认为玩家(或掌权者)通过让NPC保持贫困、病弱和愚昧来维持控制,并以此讽刺现实中的系统性压迫。另一方则反驳并非所有人都认同这种“奋斗至上”的价值观,暗示存在不同的生活选择。还有评论者从个人体验切入,指出自身惰性已深至连想做的事都难以启动,且长期疲惫,即使无所事事也感到耗竭,这反映了对“NPC”状态的一种切身共鸣或无奈。分歧在于:一方强调外部结构性压制,另一方则聚焦个体内在的无力感,而“并非为奋斗而生”的立场则介于两者之间,质疑了单一成功叙事的普遍性。

HackerNews


Quasar 438B:欧洲领先的人工智能模型

Quasar 438B: Europe's Leading AI Model

发布时间: 2026-09-02

链接: https://multiversecomputing.com/resources/introducing-quasar-438b-europe-s-leading-ai-model

描述:

文章介绍Multiverse Computing发布的旗舰推理模型Quasar 438B,这是该公司首个大型模型,支持英语和西班牙语,在Artificial Analysis Intelligence Index上得分43,为欧洲模型最高分,领先Mistral Medium 3.5(30分)和NVIDIA Nemotron 3 Ultra(38分)。该模型面向企业级智能体与编码场景,500 token响应含思考时间仅需15.3秒,在长上下文推理(AA-LCR 75.0)和终端任务(Terminal-Bench 69.3)上表现突出,可通过CompactifAI API使用。

评论要点:

有评论质疑一家欧洲初创公司仅凭“亲欧”表态就能获得欧盟资金,认为其资质不足。另一条评论反驳称,该公司CEO曾在巴黎与Axelera宣布合作,团队实力强,且入选EIC Accelerator项目,该项目比YC更难进入,暗示其含金量被低估。此外,有评论对“up to”被误解为范围表示强烈不满,认为这是基本语义理解问题。分歧主要围绕欧盟资金获取标准、初创公司实际水平评估,以及语言表述的严谨性。

HackerNews


OpenAI和Anthropic回应零漏洞后,curl曝出六个CVE

Six curl CVEs after OpenAI and Anthropic came back with zero

发布时间: 2026-09-02

链接: https://aisle.com/blog/aisle-discovered-six-curl-cves-after-openai-and-anthropic-found-zero

描述:

文章介绍AISLE公司宣称其自主AI系统在分析curl代码库时发现六个CVE漏洞,而此前OpenAI Codex Security和Anthropic Mythos两大前沿AI系统对同一代码库报告零发现。六个漏洞均被评为低严重性,包括OpenSSL provider释放后使用、OpenSSL固定绕过、原生CA存储连接复用等,已在curl 8.22.0中修复并归功于AISLE的Stanislav Fort。文章强调这是对当前生产代码的真实分析而非基准测试,并引用Linux稳定版维护者Greg Kroah-Hartman的评论,称在Linux上也观察到类似现象,以此支持其"系统优于模型"的论点。

评论要点:

评论者认为curl漏洞多为低危,批评相关报道夸大其词,属于营销炒作。另一观点则强调,即便如curl这般高质量代码库仍出现释放后使用等问题,恰恰证明C语言内存安全缺陷难以根除,即便是顶尖程序员也难避免,因此主张转向Rust等内存安全语言或采用运行时检查工具。分歧在于对C语言安全性的根本判断:一方认为漏洞严重性被高估,另一方则视其为语言缺陷的必然结果,并以此论证替代方案的必要性。

HackerNews


检查文件是否由Claude创建

Check if a file was made with Claude

发布时间: 2026-09-02

链接: https://claude.com/check-content

描述:

该页面介绍 Anthropic 推出的“检查内容是否由 Claude 生成”工具。Claude 会以两种方式标记其生成内容:文本在写作中嵌入水印,文件则附带内容凭证(即加密签名的来源元数据)。该工具仅识别文件中的内容凭证,以判断 Claude 是否参与了文件制作,采用开放的 C2PA 行业标准,可读取 .png、.jpg、.svg 等支持格式。工具不会上传或存储用户文件,只在设备本地读取嵌入凭证,且不包含任何用户身份信息。若要检测文本水印,则需使用目前仅向符合欧盟法律要求的组织开放私有预览的 Detection API。

评论要点:

离线验证工具一旦放开频率限制,输入模糊测试就能轻易击穿它。水印若真能遏制AI欺诈,HN上早该有更多支持声音了,但现实是它只增加监控却缺乏实际威慑力。元数据注入这类做法,本质上是在扩大监视范围,而非解决问题。分歧在于:一方认为技术验证必须配合严格限流与深度检测,另一方则质疑水印和元数据只是表面文章,无法应对对抗性输入,反而助长隐私风险。

HackerNews


纽约市学校禁用Mamdani AI

Mamdani Bans AI in NYC Schools

发布时间: 2026-09-02

链接: https://www.nytimes.com/2026/09/01/nyregion/ai-ban-schools-nyc.html

纽约市长佐赫兰·曼达尼(Zohran Mamdani)与教育总监卡马尔·塞缪尔斯(Kamar Samuels)于2026年9月1日宣布,全市公立学校将对2-K至八年级学生实施为期一年的生成式人工智能使用禁令,涉及约60万名学生,并全面禁止各年级使用陪伴式聊天机器人。该政策被描述为美国最广泛的学生端AI禁令,同时配套推出屏幕时间限制建议(三至五年级每日30分钟、六至八年级45分钟)。高中学生则采取不同路径,约5%的学生可参与五个经审核的AI试点项目(如Quill、Edia等),在教师监督下限量使用,所有高中生每年还将接受两次各45分钟的AI素养课程。教师仍可运用AI进行备课与行政工作,残障学生辅助技术等可获豁免。市教育部门将成立跨利益方联盟,在学年内评估政策效果并发布后续建议。

评论要点:

这句引言确实点出了AI辅助学习的本质局限。有观点认为,AI能提供答案,但无法替代学习者主动构建知识的过程,就像“知识只能被学会,不能被传递”所暗示的——工具再强大,若缺乏内化,仍只是信息搬运。

分歧在于对AI角色的定位:一方视其为“压力测试”工具,认为它能通过模拟真实问题帮助验证理解;另一方则反驳,AI生成的场景缺乏现实复杂性,如同《星际迷航》的幻想设定,无法真正暴露认知漏洞,更别提培养实践能力。还有评论者结合自身经历指出,AI难以弥补学校未教、经验未及的数学盲区,说明其辅助价值受限于用户已有的知识框架。总体来看,争论焦点并非AI是否有用,而是它能否替代真实学习中的试错与深度思考。

HackerNews


Perplexity三分之一的引用不包含其引用的数字

A third of Perplexity's citations don't contain the number they're cited for

发布时间: 2026-09-02

链接: https://hausresearch.com/reports/perplexity-citation-audit/

描述:

这份由Haus Research发布的报告审计了Perplexity两个搜索模型在310个关于210家科技公司的事实问题中生成的1,826条引用,发现34.7%的引用指向无法打开或完全不含所引句子中任何数字的页面;按声明而非引用计,872条含数字的声明中有14.4%失败。失败主要源于两类:约16%的引用被登录墙、付费墙或403拦截,以及约16%可打开的页面并不包含所引数字。报告还发现约四分之一被引URL从未被Wayback Machine存档,且sonar与sonar-pro两个模型表现相当,均明显优于仅列出文末参考列表、无法逐句审计的GPT-4.1。

评论要点:

有用户指出发帖者账号已两年多未活动,且历史内容与当前话题无关,怀疑账号被盗。多数评论认同这一判断,并补充证据:两个网址同日注册、领导团队照片存在AI修饰痕迹且人数相同、LinkedIn上查无此人,这些细节明显是伪造。有人担忧此类虚假信息制作成本低、识别难度大,若稍加改进(如延长域名年龄、使用常见姓名、变换风格)将更难被识破。另有评论好奇此类内容如何获得高赞,质疑机器人刷票是否已失控。整体分歧不大,主要围绕账号是否被盗及虚假信息防范难度展开。

HackerNews


寓言5.1世界建模

Fable 5.1 World Modeling

发布时间: 2026-09-02

链接: https://github.com/PhiloLabs/fable51-worlds

描述:

该仓库介绍了一个名为 Fable 5.1 的世界建模项目,通过自主 Claude 智能体集群对真实地点进行端到端的研究、建模与质检,最终以纯 Three.js 应用形式在浏览器中呈现可探索的旧金山联合广场及周边街区。项目不使用游戏引擎或专有 3D 瓦片,所有建筑、店面、招牌、树木与红绿灯均由开放数据和公开参考影像生成,包含 453 个 OSM 建筑轮廓、129 个具名店面、220 名行人、109 辆车辆以及 Apple 与 Nintendo 两个可进入的室内空间。制作流程涵盖侦察研究、离线资源生成、运行时组装与基于 Playwright 的相机匹配质检,代码与生成资源采用 MIT 许可。

评论要点:

作者详细介绍了用程序化运动系统驱动3D模型的过程,强调所有运动参数均可调试,并附有交互页面供调整路径和速度。评论者对此持肯定态度,但调侃称“很快会进入训练数据”,暗指技术可能被AI学习。另一评论者则指出“世界建模”一词被误用,认为这并非LeCun所言的深度机器学习领域,而只是“氛围编程”在游戏3D世界上的应用,与前沿世界模型或自动驾驶技术无关。分歧在于对“世界建模”概念的理解:作者侧重具体实现,评论者则区分了学术定义与业余实践。

HackerNews


泊松圆盘采样

Poisson Disk Sampling

发布时间: 2026-09-02

链接: https://stripeacross.com/posts/poisson-disk-sampling/

描述:

这篇文章介绍泊松盘采样问题及其算法。文章先说明随机放置物体需保证最小间距的问题,随后讲解Bridson在2007年提出的经典算法,通过网格划分与环形区域采样高效生成泊松盘分布。作者提出两项改进:一是利用父点信息排除环形区域中必然过近的角度范围,二是通过调整距离采样指数c来平衡点密度与随机性,并给出经验公式。文章还讨论动态半径实现图像点画效果,以及Scott Mitchell提出的无需拒绝采样、兼具最大性与均匀性的新算法。

评论要点:

低差异序列与低差异集合的关键区别在于前者可生成无限点,后者则针对固定点数优化,且预先知道点数时通常能获得更低的差异度。评论者指出已有研究尝试将低差异特性与蓝噪声结合,并提及PixelPie作为GPU实现案例。另有实践者反映,在着色器中难以逐像素实现Bridson算法,因其依赖活动列表,最终改用哈希单元加抖动的方式替代。

HackerNews


优步裁员10%的员工

Uber is laying off 10% of staff

发布时间: 2026-09-02

链接: https://www.uber.com/us/en/newsroom/simplerfasteruber/

描述:

Uber首席执行官达拉·科斯罗萨西在致员工的公开信中宣布,公司将进行大规模组织调整,裁减约10%的员工。调整措施包括精简管理层级、合并碎片化团队(如将餐饮、零售和直营三个配送运营团队合并)、优化全球办公地点布局,并大幅收紧远程办公政策,未来仅约1%的员工可远程工作。科斯罗萨西表示,此举旨在简化组织、加快决策速度,并将节省的成本重新投入增长、创新和自动驾驶等未来领域。

评论要点:

有观点认为“decimated”一词常被误用,例如体育比赛中说“球队被歼灭”并不符合其原意(原指罗马军队每十人抽一人处决),这种用法在逻辑上说不通。另一观点则从职场角度切入,指出顶尖人才因公司承诺屡屡落空而随意离职,导致团队元气大伤,并质疑管理者为何留不住人。分歧在于:一方聚焦语言精确性,批评口语化滥用;另一方则借“歼灭”隐喻组织信任崩塌,强调现实管理问题而非词语本义。两者虽都涉及“损失”,但前者关注语义规范,后者侧重职场生态与承诺失信。

HackerNews


SteamdDB加入Nexus Mods

SteamdDB Joins Nexus Mods

发布时间: 2026-09-02

链接: https://www.nexusmods.com/news/15597

Nexus Mods 于2026年9月2日宣布收购SteamDB,这一消息由双方官方声明确认。SteamDB由Pavel "xPaw" Djundik和Marlamin于2013年创立,长期独立追踪Steam游戏价格、玩家数量、更新记录等数据,但创始人因独自维护网站而面临严重倦怠,自今年1月起开始寻找合适的接手方。Nexus Mods表示收购旨在为SteamDB提供资源、开发能力和长期稳定性,网站将继续保留原名、品牌和社区,短期内功能不变,所有现有免费功能保持免费。Nexus Mods计划利用SteamDB的海量历史数据来追踪玩家安装模组时的游戏版本,并逐步组建专职团队改善其基础设施与安全性。不过,由于Nexus Mods自身在2025年6月已被Chosen收购,部分玩家对此次交易后的潜在付费化和商业化表示担忧。

评论要点:

评论者指出,Nexus Mods对模组内容施加政治限制,而Steam允许发布符合当地法律的内容,无需迎合平台管理者的政治立场。SteamDB作为记录Steam发布内容的工具,应保持中立和准确,不应受Nexus Mods控制后出现审查倾向。

另一观点强调,通过将网站托管在英国以外可规避《在线安全法案》约束,并质疑SteamDB当前是否已受此影响。分歧在于:一方认为平台审查源于政治立场,另一方则聚焦于法律管辖地的选择对内容自由的影响。

核心争议是Nexus Mods收购SteamDB后,是否可能滥用控制权,导致其记录不再忠实反映Steam实际发布内容,从而损害数据透明性。

HackerNews


把垃圾埋了就行

Just Bury Your Trash

发布时间: 2026-09-02

链接: https://www.worksinprogress.news/p/just-bury-your-trash

描述:

这篇文章来自Works in Progress,作者Alex Chalmers和Rob Wiblin挑战了"垃圾填埋是最差处理方式"的普遍观念,提出现代填埋场其实是清洁、廉价且环保的选择。文章通过数据论证一次性用品往往优于可重复使用产品(如棉布袋需重复使用173次才能胜过塑料袋),并指出回收过程本身消耗大量能源且污染率高,许多塑料回收反而得不偿失。作者认为金属回收值得保留,但多数情况下应将资金投向碳捕集等更有效的环保措施,而非昂贵的回收体系。

评论要点:

有评论指出,文章提到的“减少污染”效益与核废料深埋处理无关,且核能使用会消耗更多能源,反而加剧污染。另一观点认为,随手丢弃的垃圾主要是易拉罐、一次性杯子和食品容器,而非超市购物袋,暗示文章对垃圾来源的归类存在偏差。分歧集中在核能的环境外部性评估和垃圾类型的具体界定上。

HackerNews


使用Immich节省Google Photos费用:打造你的个人照片存储空间

Saving money on Google Photos with Immich: Your own personal photo storage

发布时间: 2026-09-02

链接: https://www.markpitblado.me/blog/saving-on-google-photos-with-immich-your-own-personal-photo-storage/

描述:

这篇文章介绍如何用开源自托管应用 Immich 替代付费的 Google Photos,以节省每月订阅费用。作者详细说明了在闲置电脑上通过 Docker 安装 Immich 的步骤,包括创建 compose.yml 和 .env 配置文件、启动服务、获取局域网 IP 地址,以及通过浏览器或手机应用访问和上传照片。文章还讨论了存储容量限制、照片备份方案(如外接硬盘、Backblaze 云备份或带 RAID 的 NAS),并指出如需远程访问或与他人共享照片,还需配置反向代理或 Cloudflare 隧道等额外工作。

评论要点:

有人主张彻底放弃实体相册,改用电子相框轮播,认为更省空间且符合现代需求;另有人强调自建家庭实验室的价值在于实现云存储无法替代的功能,如Plex媒体整合和智能家居统一管理,但明确表示若仅为替代云存储则性价比不高。分歧点集中在存储方式上:一方倾向轻量化的商业方案(如PhotoSync),看重其加密功能;另一方则坚持自建方案虽需投入维护精力,却能提供不可替代的定制化体验。此外,评论者自认是“不情愿的管理员”,对维护时间感到负担,但认可初始配置后维护成本可控,并对Thread和Matter协议改善物联网生态抱有期待。

HackerNews


意大利伦理银行冻结A/I账户,同时谴责其背后的制裁

Banca Etica Suspends A/I's Account While Condemning the Sanctions Behind It

发布时间: 2026-09-02

链接: https://sabot.media/post/banca-etica-statement-english

描述:

无法获取文章内容:该外链无法访问或没有可用正文。

评论要点:

有评论认为该帖是典型的“比烂”式论证,逻辑上站不住脚。另一观点则指出,这种指责可能适得其反,促使相关方转向更隐蔽的金融工具,反而增加执法追踪难度。还有人强调,法律原则的真正考验在于保护“坏人”的正当程序权利,并举米兰达案和该隐为例,主张无罪推定和公平审判应适用于所有人,即便对象令人反感。分歧集中在:是批评其论证方式,还是担忧实际后果,抑或坚持程序正义的普适性。

HackerNews


WebLLM:高性能浏览器端LLM推理引擎

WebLLM: high-performance in-browser LLM inference engine

发布时间: 2026-09-02

链接: https://github.com/mlc-ai/web-llm

描述:

WebLLM 是 MLC LLM 的配套项目,一个基于 WebGPU 硬件加速的高性能浏览器内大语言模型推理引擎,所有计算均在浏览器本地完成、无需服务器支持。它完全兼容 OpenAI API,支持流式输出、JSON 结构化生成、函数调用等功能,并原生支持 Llama、Phi、Gemma、Mistral、Qwen 等系列模型,也可集成 MLC 格式的自定义模型。项目提供 npm/CDN 安装方式,通过 MLCEngine 接口加载模型并调用聊天补全,支持 Web Worker、Service Worker 及 Chrome 扩展以优化性能,并提供多种缓存后端与可选的 SRI 完整性校验。

评论要点:

每条浏览器会话都会下载500MB至1GB的模型文件,面向用户的前端需明确提示这一数据消耗。Firefox在Linux上默认关闭WebGPU,需手动在about:config中启用,原因是Linux图形驱动栈差异大且攻击面更广。Edge用户需同时启用“不安全WebGPU”和“强制高性能GPU”才能让独立显卡出现在适配器列表中,仅靠前者只能获得软件模拟的SwiftShader。

HackerNews


Gemini 3.8 Flash 与 3.8 Flash Cyber

Gemini 3.8 Flash and 3.8 Flash Cyber

发布时间: 2026-09-02

链接: https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

描述:

谷歌发布Gemini 3.8 Flash与3.8 Flash Cyber两款模型,这是六周内第三次Flash版本更新。3.8 Flash定位为最智能的"工作马"模型,在软件工程、智能体任务和多步推理上较3.7 Flash显著提升,在DeepSWE v1.1等基准上超越多数更大规模的前沿模型,定价与3.7 Flash相同(每百万输入0.75美元、输出3.75美元),但可能因更多推理步骤而消耗更多token。3.8 Flash Cyber则是谷歌最强大的网络安全模型,具备前沿级漏洞检测与自动修复能力,在CyberGym基准上超越更大模型,内部跨20种编程语言漏洞发现成功率超70%,CWE-Bench补丁通过率达47.2%;Chrome安全团队发现其生成的正确补丁是其他商业模型的2.6倍。该模型通过新的Fairwind计划向政府、关键基础设施运营者等650多家受信任防御方开放,并优先投资于漏洞修复而非攻击性利用能力。

评论要点:

“Uncensored”模型实为移除拒答机制的权重修改版,需自行部署硬件运行,如Kimi K3每小时租用成本约60美元,但可同时支持约100个会话。有观点指出Fable 5.1同样存在拒答率,且推理能力被明显削弱。

另有用户反馈,从VertexAI切换到OpenRouter后速度提升2至3倍,但认为这种差异可能具有相对性。

关于“cyber”一词,有评论提醒1999年其含义与当下截然不同,暗示语境变迁可能影响对技术术语的理解。整体讨论聚焦于模型部署成本、性能对比及术语时代差异,未出现明显分歧,更多是补充性信息。

HackerNews


Show HN:ZSvirt —— 轻量级、可扩展的开源虚拟化平台

Show HN: ZSvirt – A lightweight, scalable open source virtualization platform

发布时间: 2026-09-02

链接: https://github.com/ZSvirt/zsvirt

描述:

ZSvirt 是一个由 ZStack 支持的开源虚拟化平台,将企业级 ZSphere 虚拟化引擎引入开源社区,提供轻量、可扩展的虚拟机管理与运行能力,避免厂商锁定。平台采用模块化架构,涵盖计算、网络、存储虚拟化以及管理平面、扩展服务和运维工具,强调异步、无状态、插件化扩展与工作流引擎设计。用户可通过 Web UI、RESTful API(含 Terraform 及多语言 SDK)或 CLI 管理虚拟机、集群、存储和网络,并内置 VMware 在线迁移、OVF 导入与 VMDK 上传等迁移工具。项目以 GPL v3.0 许可开源,提供 qcow2/OVA 镜像便于在虚拟机中快速试用。

评论要点:

ZSvirt的网络配置偏向底层,VLAN和NAT需通过命令行或配置文件手动调整,学习曲线较陡;而Proxmox提供图形化界面和向导,管理更直观。若追求快速上手,Proxmox更省心,但ZSvirt在精细控制上有优势。

单节点实验室中,ZSvirt官方最低要求(如4GB内存)仅够运行轻量VM,若同时跑多个系统建议至少16GB内存和SSD存储。实际负载下,内存和I/O瓶颈比CPU更明显,高配更稳妥。

嵌套虚拟化下运行OVA,内存需求会翻倍,建议至少8GB起步,且需开启硬件辅助虚拟化。若宿主机本身资源有限,直接安装物理机更可靠,嵌套环境易出现性能损耗和兼容性问题。

HackerNews