谷歌 DeepMind 发布了 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,这是一系列快速且成本低廉的模型,擅长 HTML/JavaScript 生成,基准测试接近 Opus 5 水平,智能得分为 59,相当于 Opus 5 中等版本。 此次发布以低成本提供高性能 AI,提升软件工程、智能体工作流和网络安全任务,使先进模型对更多开发者和企业变得可及。 Gemini 3.8 Flash 支持多模态输入(音频、视频、文本),具备可自定义的工作量级别以平衡质量、成本和延迟,生成 HTML 任务约需 1.8 美分、13 秒;Flash Cyber 变体专注于自主发现漏洞并生成补丁。
2026 年 9 月 2 日,谷歌成功抵御了美国司法部试图强制拆分其广告技术业务的诉讼,从而避免了被迫出售,尽管其广告技术收入持续下降。 此结果标志着对大型科技公司反垄断执法的重大限制,表明即使在广告技术领域拥有相当市场力量也不一定会触发强制剥离,这影响了谷歌的收入来源以及投资者对该行业的信心。 谷歌的广告技术业务去年收入约为 300 亿美元,占 Alphabet 总收入的约 8%,但已连续 16 个季度下降,利润贡献不到 1%;法院的补救措施并未实施全面拆分,而是包括司法部宣布的一些胜利性措施。
调查发现,三个网站生成了超过 215,000 篇 AI 撰写的“最佳软件”页面,被 Perplexity AI 引用为来源,暴露了其推荐管道中大量机器生成的垃圾信息。 这表明低质量的 AI 生成内容可能削弱 AI 驱动答题引擎的可靠性,可能向依赖其引用的用户传播错误信息。 这些页面是为 SEO 垃圾而生产的;Perplexity 的引用系统会检索、排名并提取段落后再引用,而现有的 AI 检测工具难以可靠地识别此类内容。
本文深入分析了 2010 年全航澳洲航空 A380 发动机故障,探讨了着陆距离软件计算、涡轮盘无约束碎片以及飞机设计如何避免人员伤亡。
一位 Reddit 用户发布了关于免费获得电脑并每周获得 200 美元以保持设备 24/7 运行的オファー。评论者警告说,该方案符合已知的朝鲜 IT 工人骗局,旨在窃取数据。 该帖凸显朝鲜国家资助的 IT 工人继续通过被盗身份渗透远程就业市场。这对个人和公司构成网络安全威胁,凸显了在远程招聘中保持警惕的必要性。 该オファー要求收件人将实体电脑放在自己地点并保持开机,承诺每周支付 200 美元。评论者指出,使用受害者的姓名和地址是一个危险信号,这与朝鲜 IT 工人骗局一致,后者依赖被盗身份和 AI 生成的简历来获取访问权限。
Meta 发布 Muse Spark 1.3 模型,引发关于其生成质量提升、定价及使用 Meta AI 工具的伦理影响的讨论。
Mistral AI 更新了其帮助文章,说明用户可以随时选择退出其输入和输出数据用于模型训练。文章澄清,此类数据可能默认被用于训练计划,除非用户主动选择退出。 此澄清回应了开发者和组织对大语言模型隐私的日益关注,强调了用户同意和对用于 AI 训练数据的控制的重要性。这会影响对 AI 提供商的信任,并可能影响隐私敏感工作负载的采用决策。 帮助文章指出,诸如对话、文档和其他用户提供内容的输入和输出数据可能被纳入 Mistral 的模型训练计划,但用户保留完全控制权,可随时通过仪表盘设置选择退出。此退出选项适用于所有层级,包括免费、团队和企业版。
作者在其博客文章《I wanna live an NPC life》中表达了对过上 NPC 般生活的向往。 该帖子在 Hacker News 社区引发共鸣,引发关于代理、逃避主义和心理健康的哲学讨论,凸显游戏隐喻如何影响个人视角。 博客文章引用了庄子寓言,评论中提到了《上古卷轴 5:天际》、勒古恩的《天堂之鹰》以及对逃避主义的批评。
最近的一项脑成像研究发现,老年人倾向于将独立的记忆融合成混合的回忆,而不是简单地遗忘它们。 了解这种记忆混合机制有助于解释衰老中的认知变化,并可能启发设计更好的人工智能记忆系统以避免不必要的干扰。 该研究纳入了 61 名参与者,其中 30 至 50 岁的人数很少,且注意力测量与年龄或观察到的脑模式无关,表明混合效应独立于注意力负担。
2026 年 9 月 1 日,纽约市学校宣布禁止在课堂上使用人工智能工具,理由是担心依赖 AI 会阻碍学生的学习发展。 此禁令凸显了教育创新与确保学生培养基础思考能力之间日益增长的紧张关系,可能影响其他学区对课堂技术的政策。 该政策适用于所有 AI 驱动的软件,包括生成式 AI 聊天机器人和写作助手,禁止在学校时间内用于教学活动。
stripeacross.com 的博客文章详细解释了泊松盘采样算法的直觉、实现要点,并提供了调试可视化、Observable 笔记本和蓝噪声应用的链接。该文章最近发布并在 Hacker News 上引发了讨论。 泊松盘采样在计算机图形学和程序生成中广泛用于生成均匀分布、自然外观的点模式,对游戏、模拟或纹理合成的开发者具有重要价值。文章的实用见解和相关资源有助于从业者更有效地实现该技术。 文章强调了 Robert Bridson 的 O(n) 泊松盘采样算法,讨论了活动列表的必要性,并提到了诸如哈希单元格并在其中抖动的替代方法,以实现着色器友好的实现。还提到了蓝噪声概念,并提供了 Observable 笔记本的链接以进行交互式探索。
SteamDB,一个流行的 Steam 统计和追踪网站,已被 Nexus Mods 收购,正如 Nexus Mods 新闻和 SteamDB 博客所宣布的。此次收购最近被揭露,引发了对该站点未来方向的讨论。 此次收购引发了对 SteamDB 未来独立性、可能的盈利化以及数据隐私的担忧,特别是考虑到其依赖可能被 Valve 限制的私有 Steam API 接口。这也凸显了爱好者项目被大型平台吸收的趋势。 根据 SteamDB 发布的 FAQ,SteamDB 将保持免费,现有免费功能不会被移至付费墙后,个人数据也不会被出售。该站点将保留其自身身份、品牌和社区,其浏览器扩展也将继续免费且可用。
Anthropic 现在发布了 Claude 消费者应用的详细系统提示词,包括变更历史以及新增禁止复制歌词的规则。 这种透明度使开发者和研究者能够看到 AI 安全措施如何演进,提供了版权感知提示的具体例子。 Claude Fable 5.1 的更新提示词新增了详细条款,禁止复制歌词、诗歌或书籍段落,改为提供描述或分析,并以 1929 年为公共领域作品的 cutoff。
作者在三周内使用反向工程的移动应用方法抓取了约 59.4 亿条 TikTok 视频和 32.3 亿个用户资料,随后将完整视频数据集上传至 Hugging Face,并提供了逐步教程和代码(需付费获取)。 这个规模巨大的数据集为短视频内容的机器学习模型训练和评估提供了前所未有的资源,有望推动推荐系统、计算机视觉和社交媒体分析的研究。但由于可能违反 TikTok 服务条款,其合法性存疑。 该数据集包含约 59.4 亿条视频条目(约 4 TB),托管在 Hugging Face 的 kuben‑developer 账户下;完整的抓取代码和详细说明可在 tiktok‑api.seeksocial.io 获取,需支付少量费用。作者指出 TikTok 提供 24 个无需账户即可访问的公开端点,但通过逆向工程获取这些数据可能违反其服务条款。
文章解释了 PostgreSQL 中的 NULL 值如何在 SQL 表达式和查询中导致意外结果,展示了 NULL 在算术、比较和条件逻辑中传播的各种情况。 理解 NULL 的行为对开发者和数据库管理员至关重要,可以避免因 SQL 三值逻辑导致的微妙错误、错误聚集和应用逻辑缺陷。 文章指出 NULL 在算术运算中会传播导致结果为 NULL,比较则产生 UNKNOWN;同时介绍了使用 COALESCE 或 IS NOT DISTINCT FROM 来缓解问题的方法,并警告 ORM 常把 SQL NULL 等同于语言特有的 null 值,这是一个常见的陷阱。
文章讨论了如何超越简单的 lambda 表达式,构建更高层次、特定领域的函数来提升函数式编程的抽象程度,并展示了可读性与显式性之间的权衡。 提高抽象程度有助于编写更具表现力和可维护性的代码,减少样板代码,但也可能掩盖底层操作,影响团队成员的上手和调试。 文章将一系列 map/filter/reduce lambda 链与单个领域特定函数(如 calculateDamage)进行对比,指出虽然后者读起来像一个故事,但它隐藏了中间的数据转换过程。
Fable 5.1 World Modeling 项目使用 Anthropic 的 Claude Fable 5.1 模型群自动生成可在浏览器中探索的、基于开放数据的 3D 重建,并将其打包为普通的 Three.js 应用。 它展示了前沿 AI 模型如何加速游戏的程序化内容生成,可能降低手动资产创建成本,同时也引发了关于 AI 生成资产质量、优化和实际可行性的讨论。 生成的模型为高多边形且未经优化,项目依赖 Claude Fable 5.1 代理而非更便宜的 Opus 5,输出为普通的 Three.js 应用,未使用传统游戏引擎。
LUX-ZEPLIN(LZ)暗物质探测器观测到一个无法由已知背景解释的单个异常粒子事件。 如果得到证实,此事件可能指向标准模型以外的新物理,但研究人员强调需要更多数据来排除波动或仪器效应。该结果凸显了探测器前所未有的灵敏度,并使暗物质搜索保持活跃。 该多余表现为在位于桑福德地下研究设施约 1.5 km 深的 7 吨液氙双相时间投射室中的一个高于预期背景的事件。合作正在收集更多数据并进行交叉检查,以确定该事件是真实信号还是罕见的背景波动。
Paint.NET 已经开发了一个内部的、干净室反向工程的 Direct2D 实现,用于 WINE,主要由 AI 助手 Claude 生成,通过 /wine 标志触发。代码位于 PaintDotNet.Windows.Direct2D1.Managed.dll。 此举消除了 Paint.NET 在 Linux 上通过 WINE 运行的主要兼容性障碍,展示了大规模 AI 辅助代码生成在重新实现复杂遗留 API 中的潜力,也凸显了“振动编码”(vibe coding)在专业项目中的兴起。 该重写包含约 180,000 行 AI 生成的代码,审查程度远低于 Paint.NET 剩余约 700,000 行的代码库,需要大量人工监督以处理资源管理和 COM 引用计数。它通过反向工程的公式实现了 Direct2D 的内置效果库。
Anthropic 宣布了 Claude Fable 5.1,在全新的 Terminal-Bench-Science 0.1 基准上获得 52.6% 的得分,较 Fable 5 的 24.7% 有所提升。Simon Willison 还测试了该模型在五种推理级别下生成骑自行车的鹈鹕 SVG 的能力。 科学基准得分的跃升表明 Claude Fable 5.1 在处理复杂、长时间任务时的推理能力得到提升,预示着更强大的 AI 代理在科研和编程领域的潜力。鹈鹕测试则展示了推理力度如何影响输出风格和成本,提供了对模型行为的洞察。 Claude Fable 5.1 提供五种推理级别(低、中、高、xhigh、max),且无法关闭推理;在低和中等级别下,鹈鹕提示未产生任何推理令牌,而高级别使用了 2,612 个输出令牌,成本约为 13 美分。其 Terminal‑Bench‑Science 基准得分从 Fable 5 的 24.7% 提升至 52.6%。
作者报告称,2019 年需要两个月才能完成的肺炎检测模型如今只需约十分钟,通过 standardcompute.com 以约 200 美元使用可负担的前沿模型即可完成。 此例凸显前沿 AI 模型的快速进展如何大幅降低复杂医疗 AI 任务的时间和成本,从而可能加速研究和临床应用。 作者将原来的两个月工作与目前的十分钟流程进行对比,指出运行 Luna 模型一个月的费用相当合理,并通过 standardcompute.com 在开放权重模型与前沿模型之间智能路由,费用约为 200 美元。
文章《Exit the Cave》讲述作者独自徒步进入熔岩洞穴,在一个黑暗的小凹槽里关掉手电筒,安静地坐着,思考内在动机与外部认可的关系。 该文引发高互动,表明许多读者在创意和职业追求中也寻求内在价值,凸显了向自我认可转变的更广泛文化趋势。 作者描述在洞穴约一英里处发现一个小凹槽,关掉手电筒,只听见水滴声和自己的呼吸,并在感觉被古老岩石埋没时落泪。
康懋达 64 家用电脑于 1982 年 9 月 1 日正式发布,标志着其首次面向消费者推出。 其发布使康懋达 64 成为有史以来最畅销的台式电脑型号,塑造了早期家用电脑市场,并激发了一代程序员和游戏爱好者的兴趣。 康懋达 64 配备 MOS Technology 6510 8 位 CPU,主频约 1.023 MHz,内存 64 KB,配有自定义 VIC‑II 图形和 SID 声音芯片,初售价为 595 美元。
Meta AI 发布了 Muse Spark 1.3,这是其专有多模态推理模型的更新版本,面向长时程代理和编码工作流。 此次发布表明 Meta 持续投资于扩展闭源多模态模型以处理复杂代理任务,为开发者提供了更强大的高级 AI 工作流选择。 Muse Spark 1.3 在 Artificial Analysis 智能指数上得分 62,远高于中位数 17,评估时生成了 1.2 亿个 token,并在 OpenRouter 和 Command Code 上提供 API、定价和基准测试。
WebLLM 是一个开源的 JavaScript 框架,可通过 WebGPU 在浏览器中直接运行大型语言模型以实现 GPU 加速,但该项目目前已过时,并面临模型下载大小大、浏览器支持有限等实际限制。 它展示了客户端私有 AI 应用的可行性,但社区反馈指出其重大缺点限制了实际使用,促使开发者转向如 Transformers.js 之类的更活跃的替代方案。 WebLLM 结合 WebGPU、WebAssembly 和 Web Workers 运行 LLaMA、Gemma、Mistral 等模型,但用户反映模型下载大小在 500 MB–1 GB 之间,自 Gemma 2 以来未更新,且在 Linux 上的 Firefox 和 Chromium 中 WebGPU 不可用。
此版本新增了 gemini-3.8-flash 模型,提供低、中、高三种思考级别,并修复了未记录已解析模型版本的异步错误。 它使使用 llm-gemini 包装器的开发者能够访问谷歌最新的 Gemini Flash 模型,并提升异步 API 调用的可靠性,有赖于及时模型响应的应用将受益。 思考级别可通过该包装器配置,异步修复由 Charlie Tonneslan 贡献(GitHub
一位 MachineLearning Reddit 用户表示,他们后悔自愿审稿 AAAI 论文,感觉付出没有得到回报且令人沮丧,同时也提到从中获得了一些个人学习。 该帖凸显了学术同行评审负担加重及缺乏互惠的问题,引发了关于评审规范如何影响研究者积极性和社区健康的讨论。 该评论者提到只审阅了几篇论文,认为这些论文未达到接受标准,但因而接触到了不熟悉的主题并提高了批判性阅读能力。