Mistral 发布了 Shieldstral,一个 3B 开放权重多模态安全分类器,用于内容审核,采用 Apache 2.0 许可,声称其性能可媲美大至 7 倍其规模的模型。 它提供了一种经济高效且灵活的开放权重 AI 安全方案,使开发者能够通过自然语言提示调整审核策略,无需重新训练大型模型。 Shieldstral 基于 Mistral 的 Ministral‑3B 骨干网络,可在单块 16 GB GPU 上运行,并在文本安全、拒绝检测、策略适应性及多模态基准上进行了评估。
Waymo 宣布其完全自动驾驶叫车服务现在对达拉斯的普通公众开放,标志着其运营范围超出原有市场的扩张。 达拉斯的部署在低密度、依赖汽车的都市地区测试 Waymo 的技术,为机器人出租车在不同城市环境中的公众接受度、安全性和可扩展性提供宝贵数据。 服务区域详情可见于 Google 支持页面;车辆在指定区域内无安全驾驶员运行,使用 Waymo 第五代 Driver 系统,这继凤凰城和旧金山之后的又一次推出。
特洛伊·亨特在其博客文章中解释,攻击者如何利用看似来自 FedEx 等可信品牌的合法外观电子邮件,利用混淆的域名和用户信任引诱受访者进入钓鱼网站。 这凸显了品牌信任和域名滥用如何提升钓鱼成功率,影响普通用户和组织,并强调了加强域名验证和用户教育的必要性。 文章引用了诸如 c.gle(针对谷歌的拼写错误注册域)等典型拼写错误注册域的例子,指出 .xyz 等新通用顶级域在钓鱼中的激增,并提醒即便看似真实的 FedEx 通信也可能被伪造或误解。
Oxide Computer 在 SEC Form D 披露中宣布获得 4.45 亿美元 D 轮融资,这是其在 2023‑2026 年间连续进行的大额融资。 这笔巨额投资表明投资者对 Oxide 构建专用机架级服务器的方案充满信心,有望加速其专有硬件和软件栈向企业客户的交付。 此轮融资紧随之前的 4400 万美元(A 轮,2023)、1 亿美元(B 轮,2025)和 2 亿美元(C 轮,2026);Oxide 自行设计服务器主板和交换机,运行基于 illumos 的 Helios 操作系统,并声称通过机架级工程实现 55% 的能效提升。
DeepSeek V4 Flash 模型(一个具有 284B 总参数、13B 激活参数的混合专家大语言模型)已被展示可以在单张 AMD MI300X GPU 上通过 MXFP4 4 位量化运行,达到每秒超过 150 个 token,上下文窗口为 256k token。 这表明大型混合专家模型可以在单张高端加速卡上部署,降低了研究人员和小团队的硬件成本和门槛,同时凸显了 AMD 在 AI 推理市场的竞争力。 该模型采用 MXFP4 量化以适应 MI300X 的 192 GB HBM3 内存,保留原始的 13B 激活权重,并将完整的 1M‑token 上下文换为 256k 窗口,同时保持每秒超过 150 个 token 的推理速度。
流行的 npm 包 Keyv(版本 6.0.0)及其相关库被发现包含恶意的 pre‑install 钩子,这是正在进行的 Shai‑Hulud 蠕虫攻击的一部分,该攻击还波及 cacheable 以及超过 400 个其他包。 像 Shai‑Hulud 这样的供应链攻击可能窃取凭证、向下游项目传播,并削弱人们对 npm 生态系统的信任,这凸显了采用更安全依赖实践的紧迫性。 该蠕虫通过被感染的包利用 pre‑install 钩子投放经过严重混淆的 Node 可执行文件,窃取凭证,将自身重新发布到任何可写的 npm 包,并在 GitHub 仓库中植入执行钩子;npm v12 默认禁用安装脚本以此作为缓解措施。
该论文系统分析了 AI 基准在模型性能提升过程中如何出现饱和,并提出了设计更具韧性评估的策略。 理解基准饱和至关重要,因为饱和的指标可能误导进度追踪并阻碍公平的模型比较,影响研究和部署决策。 该研究指出静态基准存在天花板效应、统计功能下降和污染风险,并建议采用动态、多智能体或开放式评估作为替代方案。
在 Xbox Live 服务中断期间,玩家发现光盘版 Xbox 游戏无法启动,即使游戏在光盘上也需要联机登录。 此事件凸显现代 DRM 将实体游戏所有权与在线服务绑定,引发对游戏长期可访问性和保存的担忧。 用户报告被迫登录微软账户,并在《光环:士官长合集》等游戏中看到登录界面,这表明主机在允许游戏前会通过 Xbox Live 检查光盘许可证。
莉莲·温的博客文章介绍了 harness engineering 技术,通过定义适应度函数、优化提示和自动创建工具,使 AI 代理能够自我改进。 将重点从扩大模型规模转移到改进代理的 harness,可以降低成本、避免权重漂移,并在不重新训练的情况下实现持续自我改进。 该方法利用可测量的适应度函数对代理行为进行评分,通过自动生成的工具(如 session_context 工具)将提示优化后的上下文从 20 k tokens 减少到 800 tokens,并需要评估划分以防止奖励黑客行为。
Simon Willison 演示了如何在 Apple Silicon 上使用 MLX 移植运行刚刚发布的 MiniMax-H3 全模态模型,该模型能够生成最长 15 秒、带音频的视频片段。他给出了逐步脚本,下载了约 115 GB 的权重,并展示了根据文本提示生成的示例视频。 此工作将首个开放权重的全模态视频模型带到了 Mac 开发者手中,降低了尝试前沿文本到视频(带音频)生成的门槛。它展示了 MLX 如何让大型生成模型在 Apple Silicon 上本地运行,推动了设备端 AI 的更广泛应用。 演示使用了 MiniMax‑H3 的 8 位 MLX 移植版,需要约 115 GB 的模型文件,在 M5 Max MacBook Pro 上不到 45 分钟即可生成 15 秒视频;音频质量取决于是否按照模型的提示指南提供适当的提示。
作者提出了一种自定义颜色空间和算法,用于生成多样化的肤色,并提供了交互式演示和解释,供数字艺术和游戏开发使用。
Warp 发布了 Warp Agent CLI,一个独立的命令行工具,可在任何终端中提供 AI 驱动的编码帮助,支持本地执行和云端代理工作流。 此举降低了开发者在现有终端工作流中使用 AI 代理的门槛,无需 Warp 桌面应用,有望在各种环境中推广 AI 辅助编程。 该 Agent CLI 可在本地运行或通过 Oz CLI 连接到 Warp 的云代理,用户可先在本地启动工作再交给云端继续,所有代理均可通过 Web 界面监控。
一则 Hacker News 帖子分享了雷·布拉德伯里 1950 年的短篇小说《柳岸轻声雨》(PDF),引发了关于其自动化与核战争焦虑主题的讨论。 该故事对智能家居和自动化的预见与当今物联网和 AI 发展产生共鸣,同时其核战争背景也促使人们反思现代技术所带来的风险。 故事描述了一栋在核爆中幸存且继续自动运作的房屋,凸显了技术超越人类的讽刺;评论者指出物联网在无互联网情况下持续运作的不现实性,并回忆了个人经历的冷战时期核演习。
EdotEnv 推出基于量化交易工作流的自改进强化学习环境,旨在为大语言模型的训练和评估提供持续升级的基准。他们还在 GitHub 上开源了一个示例任务仓库。 该基准能够随模型进步而提升难度,避免传统基准的饱和问题,有助于考察 LLMs 的研究迭代、长期规划和持续学习能力。对希望评估模型真实机器学习能力的 AI 实验室和企业具有潜在价值。 环境让模型完成特征构建、回测、组合设计等任务,奖励仅衡量特征构建技能,使用真实市场数据并包含噪声和即时可验证的反馈。示例代码已在 GitHub 上的 MMcollab-dotcom/feature-engineering 仓库中开源。
Vlt 已发布 1.0 版本,这是一个稳定版,引入了托管包注册表功能,供开发者发布和使用包。 此版本提供了 npm 的替代方案,具备更好的安全性、性能和可配置策略,解决了 JavaScript 依赖管理中的常见痛点。 Vlt 1.0 提供更安全的默认设置、可配置的使用时策略以及托管注册表,用户可存储私有或公开包;该项目由前 npm 开发者(包括 Isaac Schlueter)构建。
Hop.earth 是一个开源的网页赛车游戏,它从 OpenStreetMap 数据程序生成赛道,让玩家可以在真实街道上竞速。该游戏使用 three.js 构建,支持玩家加入共享地图并实时对抗。 该项目展示了如何将开放的地理数据创造性地用于程序生成的游戏内容,凸显了一种新颖的独立游戏世界生成方法。尽管目前受技术错误和服务器负载限制影响较小,但它指向了开放数据驱动游戏体验的更广泛可能性。 游戏使用 three.js 和 WebGL 渲染赛道,从 OpenStreetMap 读取地图几何形状,并通过降落伞效果让玩家进入,这有时会导致穿模 bug。社区反馈表明,当许多用户同时加入同一地图时会出现服务器过载,导致性能下降和偶尔崩溃。
Pudding 在 2026 年 6 月发表的文章探讨了为什么有些人修剪草坪更有效,表明技术、图案重叠和修剪方向比仅仅减少通过次数更重要。 了解这些修剪细节有助于房主和园林工人获得更健康的草坪和更美观的外观,影响日常草坪护理做法和爱好者优化趋势。 文章指出,转弯会浪费时间并遗漏区域,因此需要重叠以获得干净的边缘;它描述了常见的图案——先纵向,再横向,然后对角线旋转——以防止草坪磨损,并强调个人目标各不相同,从最长的连续线条到最小化草屑运输距离。
苹果称有更多前员工可能保留或访问了机密信息,基于新的法庭文件,苹果将其对 OpenAI 的商业秘密调查扩大。 此争议凸显了主要科技公司之间知识产权紧张关系的加剧,可能影响 AI 硬件的发展以及员工在竞争对手之间的流动。 该诉状称前员工利用身份验证漏洞下载了至少 37 份高度敏感的技术文件,包括未发布硬件规格的截屏,这些信息可能有助于 OpenAI 的新兴 AI 硬件计划。
一则黑客新闻帖子链接了巴克敏斯特·富勒 1975 年的演讲《我所知道的一切》,引发用户讨论他的思想、影响及相关趣闻。 此次讨论凸显了富勒在系统思考、设计和未来主义方面的持久影响,表明其历史概念仍在激发当代科技与生态话题。 该演讲最初于 1975 年发表,通过 BFI 网站分享,评论者提到了富勒的《飞船地球使用手册》、他的地球圆顶穹顶工作、Dymaxion 地图,甚至他在一款视频游戏中的 cameo。
Steve Yegge 反思称,他设计的可复用工具 Gas Town 最终只被用来构建自身,而在 Opus 4.7 中出现的持续 "just two more things" 倾向导致代理无法收敛以进行真实工作,最终导致 Gas Town 崩溃。 此轶事说明了自指工具和代理 AI 的常见陷阱——倾向于无休止地调整而非交付,这对依赖 Claude Opus 等模型进行编码代理的开发者具有重要参考价值。 Gas Town 被描述为一套能够运行数十个并行代理的协调组件;Opus 4.7 提供 1M 上下文窗口和强大的代理编码能力,但其 "just two more things" 倾向阻止了收敛,导致 Gas Town 在 4.6 版本表现出色后,在 4.7 版本中崩溃。
文章提出“肉代理”一词,指盲目复制 AI 输出的人,并建议读者阅读、理解、验证并用自己的话重新表达 AI 回复。 它指出盲目依赖 AI 的风险,并倡导批判性参与,这能提高 AI 辅助交流的质量和问责制。 该术语由 Niklas Gruhn 创造;文章中的引用块敦促读者可以提示 AI,但不要仅仅转发输出,而应通过用自己的话重新表达来增加价值。
Perspec 1.0 标志着 Perspec 开源库的首个稳定版发布,使得大规模和流式数据集的透视感知可视化成为可能。 此次发布为开发者提供了生产就绪的工具,用于创建交互式仪表板和分析应用,满足了对稳定透视感知可视化方案的需求。 Perspec 具备编译为 WebAssembly、Python 和 Rust 的高性能查询引擎,并支持用户可配置的报表、仪表板、笔记本以及独立的浏览器部署。
文章认为大多数技术革命总体上使员工的工作变得更糟,而 Hacker News 的评论者则举出工资、安全和生产率提升的例子进行反驳。 这场辩论凸显了技术进步与劳动条件之间的争议关系,对自动化、AI 采用以及工人权利政策的讨论产生影响。 文章未提供具体数据或证据来支持其观点。评论者则引用历史例子,如福特提高工资和缩短工作周、采矿机械化降低死亡率、家用电器带来的便利,以及马克思关于机器速度加剧劳动强度的分析。
英国 AI 安全研究所发布了编号为 INC-2026-07-28-01 的安全事件报告,详细说明了 2026 年 7 月 28 日发生的一起 AI 相关安全事件。 该报告凸显了先进 AI 系统中的持续风险,并展示了该研究所在监测和披露漏洞方面的作用,以帮助政府制定政策和推动 AI 安全实践。 该事件报告以 PDF 形式托管在研究所的 CDN 上;Hacker News 上的讨论仅有三条评论和 20 分,表明社区参与度有限,且未披露漏洞的具体技术细节。