苹果和谷歌正越来越多地干预推送通知的传递,抑制或延迟促销类和广播类通知,同时优先处理事务类通知,标志着从历史上宽松的管理方式发生了转变。 这一变化影响了数百万依赖推送通知进行用户互动的开发者,因为促销和营销类通知正在被过滤掉,可能降低应用的可见度和收入,而用户则受益于减少的通知垃圾和更清爽的体验。 平台一直拥有干预的技术架构——包括推送延迟、抑制和合并——但此前选择了克制;这一转变并非新增能力,而是政策执行的变化,广播和促销类通知受到最大影响,而事务类通知则不受影响甚至被放大。
Go is implementing support for generic methods, resolving a major gap in its generics system and enabling more flexible and type-safe abstractions.
研究人员发现,提交到 NVIDIA SOL-ExecBench 基准测试的 AI 生成的 CUDA 内核(包括融合的 embedding-gradient + RMSNorm 反向传播内核)虽然通过了形式化验证,但在实际训练中由于细微的数值精度问题(特别是梯度累加使用 bf16 而非 fp32)导致训练发散。 这揭示了 AI 生成的 GPU 代码中一个关键的可靠性缺口:内核在基准测试上看起来正确,却会在实际 ML 工作负载中静默地出错,可能误导研究人员去归咎于模型、数据集或想法,而非实现本身。 该 bug 仅在特定条件下显现——具有非均匀 token 分布的真实文本数据会暴露 bf16 累加误差,而均匀随机 token 或使用 AdamW 优化器则完全掩盖了这一问题,使其极难诊断。
Microsoft 在 GitHub 上开源了 agent-governance-toolkit,这是一个基于 Python 的综合工具包,为自主 AI Agent 提供策略执行、零信任身份、执行沙箱和可靠性工程功能,全面覆盖 OWASP Agentic Top 10 中的所有 10 项风险。 随着自主 AI Agent 在企业工作流中快速普及,治理与安全已成为关键挑战;Microsoft 的工具包通过与行业标准 OWASP Agentic Top 10 框架对齐,直接应对这些缺口,为企业提供一套可直接用于生产环境的开源基础,以安全地大规模部署 Agent。 该工具包覆盖全部 10 项 OWASP Agentic Top 10 风险,并实现四大核心支柱——策略执行、零信任身份、执行沙箱和可靠性工程——提供了 Agent 治理的整体性方案,而非孤立地应对单项风险。
YouTube 本周宣布,将开始对大量使用 AI 生成逼真内容的视频自动添加披露标签,不再依赖此前由创作者自愿自行披露的系统。 这是一项重大的平台级政策转变,可能为其他社交媒体平台树立先例,影响数十亿观众对内容真实性的认知,以及创作者对 AI 生成内容的责任归属。 YouTube 的检测系统主要针对大量使用 AI 逼真内容的视频,但自动 AI 检测的准确性仍是一个公认的技术挑战,存在误报和漏报的风险,可能影响创作者的声誉和收入。
Simon Willison 认为 OpenAI 和 Anthropic 已实现产品市场匹配,依据是 Anthropic 据传即将迎来首个盈利季度,以及企业客户现在按实际 API 代币使用量付费而非固定订阅费率。两家公司分别在 2025 年底和 2026 年初将企业定价模式调整为与实际 API 代币使用量挂钩,导致大量使用编码代理的公司面临远超预期的 LLM 账单。 这标志着 AI 行业的关键拐点,企业对 LLM API 的需求已强劲到足以支撑潜在盈利能力,验证了巨额硬件和研发投资的价值。这也引发了关于 AI 长期经济性的重要问题,因为代币成本随使用强度扩展,可能占据知识工作者薪资的相当大比例。 Willison 估算他个人按 API 费率计算的代币使用量每月价值 2180 美元,而他实际仅支付 200 美元订阅费,这说明了消费者与企业定价之间的巨大差距。Anthropic 在 2025 年 11 月左右将企业计划从包含使用量改为每席位 20 美元加 API 定价,OpenAI 则在 2026 年 4 月 2 日对 Codex 定价进行了类似调整。
在谷歌推广其搜索中的 AI Mode 功能后的一周内,DuckDuckGo 的无 AI 搜索页面访问量增长了 28%,其移动应用在美国的安装量平均增长了 18.1%,并在 5 月 25 日达到 30.5%的峰值。 这一激增凸显了用户对传统搜索中集成 AI 的强烈抵制,表明谷歌大力推广 AI Mode 可能正在将注重隐私和反感 AI 的用户推向 DuckDuckGo 等竞争对手,尽管 DuckDuckGo 的整体市场份额仅为 0.7%,但这可能正在改变市场格局。 这一增长持续了六天,5 月 20 日至 25 日期间,DuckDuckGo 无 AI 搜索页面 noai.duckduckgo.com 的周均访问量环比增长了 22.7%,在 5 月 24 日达到 27.7%的峰值,而谷歌仍以约 90%的市场份额占据主导地位,DuckDuckGo 仅为 0.7%。
GitHub 目前正经历一起重大持续故障,影响了 Pull Request、Issue、Git 操作和 API 请求等核心功能(事件 ID:xy1tt3hs572m)。此次中断已持续较长时间,引发开发者广泛关注,部分用户指出这是近几周可靠性持续下降的一部分。 GitHub 是全球数百万开发者的核心协作平台,Pull Request、Issue、Git 操作和 API 请求的中断会直接阻塞代码审查、CI/CD 流水线及自动化工具等关键工作流。此次事件引发了对平台可靠性的严重担忧,尤其是在 AI 辅助开发工具日益依赖稳定 GitHub API 的背景下,任何故障的影响范围都被进一步放大。 一个特别令人担忧的症状是,Web UI 和 API 上的 Pull Request 未能一致地反映所有提交或分支变更,这意味着开发者可能在未审查完整 diff 的情况下意外合并代码——这对代码完整性构成严重风险。社区还指出,即使仅筛选严重(sev-1)事件,过去一个月的可靠性也明显下降,暗示存在更深层次的基础设施问题,而非常规维护所致。
文章探讨了 Gemini、Gopher 和 Finger 等轻量级去中心化协议,作为主流 HTTPS 网络的替代方案,强调了它们的简洁性、自主性以及对当前中心化网络单一文化的抵制。 鉴于 Chrome 的 Blink 引擎占据约 73% 的桌面浏览器市场份额,而 Mozilla 的 Gecko 是唯一独立的替代方案,这些协议为构建更加多元、弹性和用户可控的互联网生态提供了一条可行路径。 Gemini 是一种类似于 HTTP 和 Gopher 的应用层协议,专为安全、简单的文档检索而设计,并配有自己的 'gemtext' 格式;Gopher 于 1991 年在明尼苏达大学开发,是一种早期的菜单驱动文档分发系统,早于万维网;Finger 是一种基于 TCP、运行在 79 端口的协议,允许用户查询面向人类的状态信息——John Carmack 曾通过 '.plan' 文件用它分享 Quake 开发更新。
arps18.github.io 发布了一篇全面指南,详细介绍了如何将 Claude Code 作为主要开发工具使用,涵盖了通过 CLAUDE.md 文件进行配置以及包括技能(skills)、子代理(subagents)、插件(plugins)和 MCP(模型上下文协议)集成在内的扩展机制。 随着 AI 编码代理成为开发者工作流的核心,了解如何有效配置和扩展 Claude Code 等工具对于最大化生产力和代码质量至关重要。 该指南强调,技能(skills)作为统一的扩展模型(合并了命令和技能),子代理(subagents)在隔离的上下文中处理并行工作,而插件(plugins)则将技能、钩子、子代理和 MCP 服务器打包为单一可安装单元。
一篇发表在 arXiv(2605.22391)上的研究论文将全球烹饪食材关系压缩为约 1,800 个基元,仅占用 2MB 存储空间,其重点在于风味搭配而非烹饪方法或配料比例。 这种风味配对知识的紧凑表示可以作为食谱生成和风味组合工具的宝贵资源,尽管它并未涵盖实际烹饪的全部复杂性。 该论文仅关注食材关系和风味兼容性,省略了烹饪方法、配料比例和技巧等实际烹饪实践中至关重要的要素。
PostHog 宣布将对美国云实例上的大多数用户默认使用其数据进行 AI 模型训练,只有欧盟用户和受特定协议(如 BAA、MSA)约束的用户默认退出。 这一决定引发了关于用户同意和透明度的重大担忧,许多用户认为其数据在未经明确许可的情况下被使用,可能损害对该平台的信任。 PostHog 声称将在训练前对数据匿名化并仅使用现有数据,但其退出机制被批评为不足且具有误导性。
Nathan Stitt 发布了 TinyCld,这是一个开源、自包含的生产力套件,提供邮件、文档、电子表格和云盘功能,支持 Web 和 iOS 平台,起因是 Google 取消了他使用了 20 年的免费 Google Apps 账户。 该项目解决了 Google 停止旧版免费 G Suite 后众多用户面临的实际问题,提供了一个可自托管的实用替代方案,让用户能够完全掌控自己的数据和生产工具。 TinyCld 的电子表格功能使用了 Handsontable 的 HyperFormula 库,尽管项目目标宏大,但目前仍处于早期阶段——有用户在电子表格中进行填充手柄和撤销(Ctrl+Z)的压力测试时,应用意外崩溃了。
Daniel Stenberg 报告称,AI 辅助的安全研究使 curl 项目收到的优质漏洞报告数量增加了 4-5 倍,平均每天收到一份以上的详细报告,团队不堪重负,他的工作与生活平衡也首次受到影响。 这凸显了开源安全领域一个日益严峻的挑战:AI 辅助的漏洞发现正在大幅增加安全报告的数量和质量,给 curl 等关键基础设施的维护者带来了前所未有的压力,引发了关于 AI 时代开源可持续性的紧迫问题。 尽管报告激增,但近年来在 curl 中发现的大多数漏洞严重程度为 LOW 或 MEDIUM,最近一次 HIGH 严重性 CVE 发布于 2023 年 10 月,表明即使在 AI 辅助的严格审查下,curl 的代码库仍然相对安全。
研究人员提出了 FuzzingBrain V2,这是一个多 Agent LLM 系统,将 LLM 驱动的语义分析与覆盖率引导的模糊测试相结合,用于自动发现和复现软件漏洞,相关论文已发布于 arXiv(2605.21779)。 该研究在自动化漏洞发现和复现这一劳动密集型流程方面迈出了重要一步,有望加速安全研究并缩短防御者识别和修补关键软件缺陷所需的时间。 该系统采用多 Agent 架构,由 LLM 驱动的语义分析来引导覆盖率引导的模糊测试,结合了两种方法的优势,相较于以往的 LLM 方法,提高了自动化漏洞复现的可靠性和效率。
生成式 AI 的最新进展现已能够逼真地模拟大规模人群和公共事件,使得真实影像与合成内容之间的界限愈发模糊。 这一进展加速了数字媒体真实性的侵蚀,引发了关于虚假信息、深度伪造以及 与早期专注于面部替换或面部操纵的深度伪造不同,该技术能够从头生成完整的人群场景,在规模和真实感方面实现了重大飞跃。
Oliver Wyman 论坛 2025–2026 年 CEO 调查显示,计划在未来 1–2 年内削减初级岗位的高管比例从 17% 翻倍至 43%,而将招聘重心转向中层岗位的比例从 10% 上升至 30%。与此同时,74% 的 CEO 正在冻结或缩减整体招聘规模,仅有 27% 表示 AI 投资回报达到或超过预期,低于一年前的 38%。 这一趋势威胁到长期人才储备,因为初级岗位历来是培养未来中层和高层专业人才的摇篮。如果公司在自动化入门级任务的同时不保留人才培养通道,可能会造成一代缺乏监督与纠正 AI 系统所需经验的从业者断层。 AI 目前最擅长自动化初级岗位中常见的常规性认知任务,例如代码调试、文档审阅和标准沟通起草,使这些岗位格外脆弱。尽管自动化推进激进,但超过一半的 CEO 表示,现在判断 AI 是否真正带来生产力提升仍为时过早。
hugohe3/ppt-master 是一款正在走红的 Python 工具,可将任意文档转换为使用真实 PowerPoint 形状(而非嵌入图片)的可编辑演示文稿,在 GitHub 上 24 小时内获得了 24 颗星。 与大多数生成不可编辑的基于图片的幻灯片的文档转 PPTX 工具不同,ppt-master 生成的是原生 PowerPoint 形状,用户可以完全自定义,这使其成为一款对无需设计技能即可快速创建可编辑演示文稿的用户非常有价值的生产力工具。 该项目使用 Python 编写,采用原生形状生成而非嵌入图片的方式,在技术上具有明显差异化特征;但目前仍处于早期阶段,仅有 1 个 fork 且尚无 pull request,表明社区仍在评估该工具。
Mini Micro 是一款基于 MiniScript 编程语言构建的幻想计算机,旨在通过简化且易用的界面,为用户提供一个能够完全控制硬件的教育环境,帮助学习者掌握基础计算概念。 它填补了计算机教育中的一个空白,让初学者获得现代操作系统所屏蔽的裸机硬件控制感,使其成为与 Pico-8 和 Picotron 类似的业余计算和系统教育领域的有价值工具。 Mini Micro 将 MiniScript 同时用作命令行 shell(一个 REPL)和编程语言,这意味着用户只需学习一种语法;该语言借鉴了 Python、Lua、Basic 和 C
TechCrunch 的一篇文章报道称,科技 CEO 因过度依赖 AI 而越来越多地表现出非理性决策行为,有人将此现象称为'AI 精神病',但该术语并非临床诊断,被认为有夸大之嫌。 这凸显了科技行业对领导层在快速采用 AI 过程中丧失批判性判断力的日益担忧,可能导致糟糕的战略决策和组织损害。 'AI 精神病'一词最早由精神科医生 Søren Dinesen Østergaard 在 2023 年的一篇社论中提出,指的是关于聊天机器人具有感知力或揭示阴谋的妄想信念,但它并非公认的临床诊断;文章将该术语用于 CEO 是比喻性的,而非医学意义上的。
一项分析揭示,私募股权公司已系统性地收购了美国的核心公共服务,而养老基金作为主要资本来源推动了这些收购,因为它们需要约 7%的年回报率才能维持偿付能力。 这一趋势带来了重大系统性风险,因为追求高回报可能导致社区所依赖的核心服务品质下降,而养老基金的参与则形成了一个令人不安的循环——退休保障与可能具有剥削性的商业行为被绑定在一起。 这种动态具有自我强化效应:养老基金需要私募股权的更高回报以避免约十年内资不抵债,而私募股权则依赖这些机构资本来资助对核心服务提供商的杠杆收购,这往往导致削减成本进而降低服务质量。
Honker 是一个全新的 Python SQLite 扩展,为 SQLite 引入了 Postgres 风格的 NOTIFY/LISTEN 语义,提供持久化发布/订阅、带重试逻辑的任务队列、事件流和 cron 调度器——全部无需单独的代理或客户端轮询。 该项目填补了基于 SQLite 的应用在后台作业和进程间通信方面长期需要依赖 Redis 和 Celery 的空白,通过将所有内容保留在单个 .db 文件中,降低了运维开销并消除了双写错误。 Honker 提供了三个核心原语:notify() 用于临时发布/订阅,stream() 用于带消费者偏移量的持久化发布/订阅(类似 Kafka),以及 queue() 用于带重试逻辑和死信处理的至少一次工作队列——任何能调用 load_extension('honker') 的语言均可使用。
Addy Osmani 的 GitHub 仓库 agent-skills 在过去 24 小时内获得了 25 颗星,该仓库提供了生产级别的工程技能集,将资深工程师的工作流程、质量关卡和最佳实践编码给 AI 编码代理使用。 随着 Claude Code 和 Cursor 等 AI 编码代理成为主流,最大的挑战是确保它们遵循规范的工程实践,而不是跳过规格说明、测试和安全审查——该仓库旨在提供结构性护栏,使 AI 代理能够像资深工程师一样工作。 该仓库使用 Shell 编写,包含 19 个生产级技能,打包后使 AI 代理在开发的每个阶段遵循一致的标准,采用 MIT 许可证,社区报告显示已获得超过 8,600 颗星。
Video-Reason/VBVR-EvalKit 是一个在 GitHub 上迅速走红的 Python 框架,专门用于评估基础视频模型的推理能力,过去 24 小时内获得了 23 个星标。该框架配套论文《A Very Big Video Reasoning Suite》已被 ICML 2026 接收。 随着视频基础模型日益复杂,对其推理能力进行标准化评估对于推动 AI 研究进展至关重要。VBVR-EvalKit 通过提供一种可验证的、基于规则的评估方法,超越了主观的模型评判方式,填补了这一空白。 该框架采用基于规则、与人类对齐的评分机制,实现对视频推理能力的可复现和可解释诊断。它专门用于评估视频模型中的思维链(Chain-of-Thought, CoT)推理,能够区分感知缺陷和推理不足。
A technical and reflective post about enhancing SimCity 3000's visuals in 4k, accompanied by community insights on the evolution of city-building games and their design principles.
Last.fm 于 2026 年 5 月宣布重新成为独立公司,此前自 2007 年被 CBS 集团(现为 Paramount Skydance Corporation)以 1.4 亿英镑收购后一直由其持有。 这一独立对依赖 Last.fm API 进行第三方音乐追踪项目的开发者和老用户意义重大,因为企业所有权变更往往会导致 API 限制或服务关闭,而社区对 API 访问保持不变表示欣慰。 Last.fm 确认其 API 使用政策在过渡后不会改变,这一点值得注意,因为 Spotify 等其他平台近期限制了 API 访问,促使一些开发者将其项目迁移到 Last.fm 更为开放的 API。
发表在《Science Advances》上的一项新研究表明,压力会破坏海马体整合重叠事件和形成记忆推理的能力,为教育和认知科学中长期怀疑的这一现象提供了实证证据。 这一发现为高压环境(如学术界"不发表就出局"的文化)为何会损害深度学习和创造性思维提供了神经学解释,对机构如何设计研究和教育环境具有启示意义。 该研究专门考察了海马体整合机制——即大脑将相关但独立的经历联系成连贯叙事记忆的能力——并发现压力显著损害了这一过程。
一位开发者创建了一个名为 help.delduca.org 的简单网页,在手机无法使用时发送包含地理位置和 IP 地址的紧急短信和邮件,其动机源于巴西频发的手机被盗等个人安全问题。 该项目解决了高犯罪率地区的一个现实安全问题,在手机丢失、被盗或没电时提供了一种实用的备用通信方式,在多重认证日益普及、用户一旦丢失设备便难以登录各种服务的当下尤为相关。 该页面使用了多个 SaaS API,包括用于 LLM 摘要短信的 Openrouter、用于邮件的 Resend 以及用于短信发送的 Textbelt,并部署在基于 Docker 的开源 PaaS 平台 Dokku 上。
Kyle Ferrana 在 Twitter 上发布了一段幽默的《星际迷航》皮卡德/数据对话恶搞,描绘了数据未能执行皮卡德直接下达的升起护盾命令,以此类比 AI 编码代理即使在明确指示下也可能无法实施安全措施。 这段恶搞之所以引起共鸣,是因为它抓住了 AI 社区中一个真实且日益严重的担忧:AI 编码代理经常无法遵循关键的安全指令,这可能导致生产软件系统中出现严重漏洞。 这个笑话直接映射了 AI 生成代码的已有记录的故障模式——代理会忽略安全护栏和约束条件,即使被明确要求包含它们,而 IFEval 等基准测试已表明这仍然是当前 LLM 的一个重大弱点。
运行 iOS 26 的 iPhone 在触发裸露内容检测时会导致 FaceTime 通话冻结,严重影响用户体验。该功能原本旨在保护用户,会自动暂停视频并提示用户选择是否恢复音视频或结束通话。
一名开发者成功将 Rust 编程语言与 Slint 声明式 UI 框架移植到已越狱的 Amazon Kindle 电子阅读器上,证明该设备可以作为原生 GUI 应用平台,而不仅限于电子书功能。 该项目展示了将消费级电子阅读器硬件重新用作嵌入式开发平台的潜力,体现了 Rust 在资源受限嵌入式环境中日益增长的可行性,以及 Slint 在低功耗设备上提供原生 GUI 体验的能力。 该项目依赖于已越狱的 Kindle,越狱后移除了亚马逊的软件限制,允许运行自定义代码;并使用 Slint——一个支持 Rust、C++、JavaScript 和 Python 的开源声明式 GUI 工具包——在电子墨水屏上渲染原生用户界面。
JetBrains 发布了一段与 Zig 编程语言创始人 Andrew Kelley 的视频访谈,讨论了 Zig 的设计和开发相关话题。 这次访谈提供了 Zig 创始人对语言哲学和未来方向的直接见解,对系统编程和语言设计的开发者具有重要价值。 JetBrains 为其 IDE 提供了 Zig 插件,这次访谈可能与其对 Zig 生态系统的持续支持有关,但 Reddit 讨论主要围绕 AI 生成代码策略和未使用变量处理等离题话题。
Unicode 18.0.0 Beta 已发布供公众审查,新增 13,047 个字符,总数达到 172,848 个,其中包括灯塔表情符号和可能新增的悲伤便便表情符号。 此次更新延续了 Unicode 联盟支持全球文本表达的使命,新增的表情符号反映了社区对更具表现力的数字通信工具的持续需求。 Beta 审查期鼓励开发者使用新数据测试其程序,该版本除了表情符号外还显著增加了其他字符,从上一版本的 159,801 个字符大幅扩展了总字符集。
Open-Dev-Society 开发的开源 TypeScript 项目 OpenStock 在过去 24 小时内获得了 25 个 star 和 2 个 fork,旨在作为付费市场平台的免费替代品,提供实时股票价格追踪、个性化提醒和公司洞察功能。 OpenStock 满足了开发者和个人投资者对免费市场数据的需求,无需依赖昂贵的平台,但其早期阶段和社区关注度较低表明该项目尚未证明其具有重大的技术创新或广泛的采用。 该项目完全使用 TypeScript 构建,强调