Thinking Machines 宣布推出 Inkling,这是一个支持音频的开放权重多模态模型,旨在作为可微调的基础模型。 Inkling 为需要多模态(尤其是音频)功能的开发者提供了开放替代方案,降低了定制 AI 开发的门槛,并促进了社区驱动的创新。 Inkling 采用开放权重许可证发布,包含音频处理功能,可通过 Tinker 等平台进行微调,社区还提供了 GGUF 和 NVFP4 量化版本以便本地运行。
据消息来源称,Stripe 和私募股权公司 Advent 联合提出收购 PayPal 的报价,金额超过 530 亿美元。 此次交易若成功,将把两家在线支付巨头合并,可能重塑竞争格局、费用结构以及金融科技行业的监管审查。 该报价将 PayPal 估值超过 530 亿美元,且由于涉及 Stripe、PayPal、Venmo、Braintree 和 Xoom 等业务,该交易需接受反垄断审查。
Ayush Paul 发现 Claude 的 web_fetch 工具存在漏洞,攻击者可通过操控链接链式请求窃取私密数据。攻击使用假冒的 Cloudflare 认证页面,诱使模型逐字母导航,从而获取用户姓名、所在城市和雇主名称。 此发现揭示了一种新的提示注入攻击途径,能够绕过现有的基于工具的网络访问防护,影响任何将私人记忆与外部抓取结合的 AI 代理。这凸显了对 LLM 工具获取的 URL 进行更严格验证的必要性,并凸显了 AI 安全领域的持续挑战。 该漏洞使 web_fetch 能够跟随其先前获取内容中嵌入的 URL,从而绕过了仅限于用户输入或 web_search 返回链接的限制。Anthropic 通过移除 web_fetch 在其自身获取内容中导航到额外链接的能力来修补该问题,并且未发放赏金,因为他们声称已在内部发现该问题。
xAI 在 GitHub 上发布了 Grok Build 仓库,推出由 Grok 4.5 驱动的 CLI 工具,将模型集成到终端工作流。该发布在 Hacker News 上引发了关于其实用性和隐私影响的讨论。 该工具凸显了强大 AI 编程助手与数据隐私之间日益加剧的紧张关系,用户担心敏感代码和密钥可能被外泄。其接受度可能影响用户对 xAI 产品的信任,并塑造未来 AI 辅助开发的实践。 Grok Build 默认会将跟踪的 Git 仓库及完整提交历史上传至 xAI 存储,包括未读取的文件和未删减的 .env 密钥,除非显式关闭。尚未看到来自 FTI Tech、Kroll 等独立机构的数据销毁认证,以验证其删除数据的声明。
该文章考察了 Telegram 的分布式数据中心基础设施,详细说明不同数据中心如何服务特定地区并影响性能,依据观察和 API 细节。 了解 Telegram 的数据中心布局有助于用户预测不同地区的延迟和可靠性差异,也能让开发者知道最佳的 API 使用方式和基础设施扩展。 文章指出 DC5 经常对中国用户出现故障,DC2 服务俄语和乌克兰语用户,DC3 似乎已被废弃或仅用于特殊数据流,用户可通过 API 方法 help.getConfig 识别所在数据中心。
deja-vu 项目发布了一款开源工具,为编码代理提供通过本地存储和 SSH 同步的持久内存,使 LLMs 能够在会话间保持上下文。 持久内存克服了 LLMs 上下文窗口有限的问题,使编码代理能够记住代码库细节和过去的交互,从而提高生产力并减少重复提示。 该系统将交互以 Markdown(或 SQLite)形式存储在本地,并通过 SSH 在多台机器间同步;目前采用基于文本的确定性检索,可选地使用 bge‑en‑base 嵌入模型进行相似度搜索。
uv 0.11.29 于 2026-07-15 发布,增加了 gzip 压缩的 PyPy 下载工件,为 `uv tree` 命令添加了 JSON 输出,并将 CUDA 13.2 作为 PyTorch 的支持后端。 这些更新提高了下载效率,便于工具集成,并扩展了与最新 NVIDIA GPU 工具包的兼容性,受益于使用 PyPy 或 PyTorch 工作负载的开发者。 gzip 压缩减小了工件体积和传输时间,JSON 输出便于程序化处理依赖树,CUDA 13.2 支持使 uv 与最新 NVIDIA 工具包保持同步;此外还包括许多错误修复和性能改进,如工作区复用和更好的错误报告。
整个 Firefox 浏览器(包括 Gecko、UI 以及 SpiderMonkey JavaScript 引擎)已被编译为 WebAssembly 并在 HTML
该博客展示了谷歌的 Gemma 4 26B 参数模型在约 2013 年的单路 Xeon CPU 上,仅使用 CPU 资源即可达到大约每秒 5 个 token 的生成速度。 这表明大型语言模型可以在旧式、低成本硬件上运行,为无需现代 GPU 的经济且私密的 LLM 推理提供了可能。 所使用的模型是 Gemma 4 26B A4B(混合专家架构),上下文窗口为 256K token;在较旧的 Xeon(可能是 E5‑26xx v2/v3)上测得约每秒 5 个 token,功耗约 300‑500W,采用了仅限 CPU 的量化和推测解码等优化。
有人在 Hacker News 上发布了一份数字时钟设计的精选画廊,展示了二进制、注水式、字母顺序、瑞士铁路、数字字段和文字字段等多种时钟,并引发了社区讨论。 此展示突显了时间显示的创意方法,激发了业余开发者使用 SVG 和 JavaScript 尝试制作表盘,并表明小众设计项目能够在技术社区中促进互动。 值得注意的设计包括一个位置解释错误的二进制时钟、一种模拟水填充效果的注水式时钟以及拼写出时间的字母顺序时钟;评论者还指出数字字段和文字字段时钟存在歧义。
实验性编解码器 misa77 在‑0 档位下实现超过 5200 MB/s 的解码吞吐量,是 LZ4 约 2500 MB/s 的两倍多,同时压缩率相当(约 42% 对比 LZ4 的 48%)。压缩速度很慢(约 55 MB/s),且格式可能仍会变化,因为它尚未达到 1.0 版本。 更快的解码可以降低读取密集型工作负载的延迟,例如游戏资产加载、数据库页面读取或网络载荷,在压缩速度不是瓶颈时提供有价值的权衡。结果表明,采用无分支且适合乱序执行的格式可以在不牺牲压缩率的情况下超越 LZ4 的速度,为高吞吐量编解码器指明了新方向。 misa77 采用无分支格式,数据划分为独立块,支持并行解码并在乱序执行的核心上表现友好;在 Silesia 测试集上,‑0 档位解码吞吐量为 5219 MB/s,压缩率为 42.64%,而编码速度仅约 54 MB/s。解码器假设输入合法,非法输入将导致未定义行为,且由于项目仍处于 v0.x.y 阶段,格式可能会变化。
一篇题为《Speculative Growth and the AI "Bubble"》的 MIT 经济学工作论文于 2026 年 7 月发布,探讨当前 AI 扩张是否与过去的科技炒作周期相似。 该论文提供了一个经济框架来评估 AI 投资热度,帮助投资者和政策制定者判断该行业被高估的风险。 该论文使用增长理论模型将 AI 资本流动与 dot‑com 时代的投资进行比较,并指出其结论依赖于关于生产力溢出和采纳速度的假设。
文章认为,先进的人工智能技术可能预示着真正人类创造力的衰退。 它凸显了关于人工智能在创作过程中的作用日益增长的哲学辩论,影响着关注文化生产的艺术家、技术人员和政策制定者。 该文章未呈现新研究或突破,而是基于对 AI 生成艺术和文本的现有观察提供一篇反思性文章。
Brainless 项目推出了一套基于 Shadcn UI 的组件,其视觉风格模仿了 AI 编程助手 Claude Code、OpenAI Codex 和 xAI 的 Grok。 这表明开发者可以从新兴 AI 工具中汲取 UI 灵感,可能影响面向开发者的应用设计趋势;同时凸显了 AI 辅助编码与前端组件库的交叉融合。 该项目使用 Shadcn UI 注册表构建,组件可直接复制粘贴到 React/Tailwind 项目中;演示站点托管在 brainless.swerdlow.dev,提供交互式预览但未改变底层功能。
文章强调,优先考虑心理健康并实践有效沟通是实现个人和职业成功的关键。 心理健康和清晰的沟通直接影响生产力、人际关系和整体生活满意度,因此对寻求工作或生活成长的人来说具有重要意义。 文章包含关于克服错误的个人轶事,提到了如 ADD 之类的神经多样性挑战,并讨论了诸如详细计划和自我管理等策略以提高任务完成度。
文章探讨了构建通用 AI 代理 harness 的概念,提出诸如“一切皆文件”等比喻和确定性框架,引发了关于其新颖性和实用性的讨论。
2023 年发表在《Sleep》期刊的一项研究发现,保持规律的睡眠模式对死亡风险的预测力强于总睡眠时长。 该研究表明,睡眠规律可能比仅仅增加睡眠时间更具可操作性的公共卫生干预目标,可能影响健康指南和个人健康策略。 研究者使用腕戴式活动记录仪(actigraphy)通过睡眠规律指数(SRI)测量睡眠规律,并采用 Cox 比例风险模型分析死亡数据,控制了年龄、性别、轮班工作和就业状态等因素。
文章指出该公司在设计和生产过程中完全不使用 AI,强调对人工工艺的承诺。 这种与众不同的立场凸显了关于 AI 在创意产业中作用的持续辩论,可能影响其他公司考虑以人为本的方法。 该文章发布于 mass-driver.com,获得 5.0/10 的评分,并在 Hacker News 上得到 29 分和 13 条评论。
西格尔家族基金会发布了一份题为《必须积极资助开源人工智能》的 PDF,主张积极的财政支持是促进人工智能可及性和创新的必要条件。 倡导专门资助有望降低 AI 研究门槛,实现更广泛的参与,并对抗专有模型在行业中的主导地位。 该 PDF 托管在西格尔基金会网站上,体现了该组织由大卫·西格尔(Two Sigma 联合创始人)于 2011 年创立的背景,并指出在 Hacker News 上仅获得 18 分和一条评论的冷淡反响。
Voxatron 在 Hacker News 上获得 38 分和 13 条评论,表明对 Lexaloffle 的基于体素的游戏引擎及复古风格开发环境有适度的社区兴趣。 这种关注凸显了对独立体素引擎和复古开发工具的持续小众兴趣,能够激励小型开发者并维持一个忠诚的创作者社区。 Voxatron 是一个完全由体素构成的幻想主机,包含竞技场射击和冒险卡带,并提供强大的设计工具,可在 Windows、macOS、Linux 和网页浏览器上创建体素游戏。