首个绕过 MIE 的 M5 macOS 内核漏洞
First macOS Kernel Exploit Bypasses MIE on M5 ⭐️ 9.0/10
研究人员在 Apple Park 的会议上展示了首个公开的、在 Apple M5 芯片上绕过内存完整性保护(MIE)的 macOS 内核内存损坏漏洞。 该漏洞表明,即使是苹果最新的硬件内存安全防御措施也能被绕过,揭示了现代 macOS 版本中的关键安全漏洞,并为未来的安全研究树立了新的标杆。 该漏洞是一个纯数据型内核漏洞,通过破坏内核数据结构而非修改代码来实现,因此更难被检测到。该漏洞已在 2026 年 5 月 18 日的会议上以激光打印报告的形式分享给苹果。
rss · Michael Tsai · May 18, 17:50
背景: Apple silicon 是苹果自研的基于 ARM 架构的处理器系列,用于 Mac 等设备。内存完整性保护(MIE)是苹果推出的硬件安全功能,旨在防止内存损坏攻击。纯数据型漏洞通过操控内核数据而非注入恶意代码,从而绕过常规的代码完整性检查。
标签: #security, #macOS, #exploit, #kernel, #Apple
Meta 的 AIRA 代理自主发现超越 Llama 3.2 的架构
Meta's AIRA Agents Autonomously Outperform Llama 3.2 ⭐️ 9.0/10
Meta 发布了一篇论文,介绍 AIRA 双代理系统,该系统能在 24 小时计算预算内自主发现超越 Llama 3.2 的神经架构,涵盖 350M、1B 和 3B 参数规模。 这一成就表明,AI 驱动的架构搜索可以超越像 Llama 3.2 这样的人工设计模型,可能彻底改变神经网络的设计方式,并减少对人类专业知识的依赖。 该系统将搜索分为两个代理:AIRA-Compose 使用 11 个代理的集成探索宏观架构,而 AIRA-Design 实现低层机制。这种策略与实现的分离在真实搜索问题上优于单一的端到端代理。
rss · elvis(@omarsar0) · May 18, 18:00
背景: 神经架构搜索(NAS)是自动化设计神经网络架构的过程,传统上计算成本高昂。Llama 3.2 是 Meta 最先进的开源大语言模型。AIRA 利用基于 LLM 的代理来推理和搜索注意力、MLP 和 Mamba 等架构组件,从而实现高效发现。
参考链接
标签: #Meta, #neural architecture search, #AI agents, #Llama, #deep learning
Cloudflare 与 Stripe 让 AI 代理自主创建账户并部署
Cloudflare and Stripe Enable AI Agents to Create Accounts and Deploy ⭐️ 9.0/10
Cloudflare 与 Stripe 推出了一项协议,允许 AI 代理自主创建云账户、注册域名、启动订阅并部署到生产环境,Stripe 负责身份验证和支付,默认每月上限为 100 美元。 这标志着 AI 与云交互方式的重大范式转变,目前没有其他主流云提供商提供类似的由代理驱动的账户配置功能,可能为初创公司和开发者实现全自动工作流。 该协议通过 Stripe 设定了每月 100 美元的默认消费上限,Cloudflare 还向通过 Stripe Atlas 注册的新初创公司提供 10 万美元的信用额度。该集成允许任何拥有登录用户的平台以类似方式与 Cloudflare 对接。
rss · InfoQ · May 18, 09:41
背景: AI 代理是可以自主执行账户创建和部署等任务的软件程序。Cloudflare 是一家提供 CDN、DNS 和计算服务的云服务商,而 Stripe 是一个支付处理平台。此前,创建云账户和部署需要人工手动操作;该协议为 AI 代理自动化了整个流程。
参考链接
标签: #AI Agents, #Cloudflare, #Stripe, #Cloud Computing, #Automation
Anthropic 收购 SDK 生成器初创公司 Stainless 作为人才收购
Anthropic acquires SDK generator startup Stainless in acqui-hire ⭐️ 8.0/10
Anthropic 以人才收购方式收购了 API SDK 生成器初创公司 Stainless,并将立即停止所有托管的 Stainless 产品,包括 SDK 生成器。 此次收购凸显了 Anthropic 对顶尖工程人才的需求,以推进其 Claude 平台和代理与 API 的连接,同时也展示了在 AI 代码生成工具崛起的背景下 SDK 生成器市场的挑战。 Stainless 的 SDK 生成器允许开发者从 OpenAPI 规范自动生成多种语言的 SDK。现有用户和 SDK 将不再获得支持,新注册也已立即停止。
hackernews · tomeraberbach · May 18, 17:01 · 社区讨论
背景: SDK 生成器自动化创建 API 的软件开发工具包,简化开发者的集成工作。人才收购(acqui-hire)指主要为了获取人才而收购公司,其产品通常在收购后被停止。
参考链接
社区讨论: 社区情绪复杂:一些人祝贺 Stainless 团队,但对产品关闭表示遗憾,指出 AI 驱动的代码生成正在削弱 SDK 生成器市场。另一些人批评突然停止服务对现有用户不公平,并担忧 Anthropic 通过收购构建封闭生态。
标签: #acquisition, #AI, #SDK, #Anthropic, #startup
Files.md:Obsidian 的开源替代品
Files.md: Open-source Alternative to Obsidian Note-Taking App ⭐️ 8.0/10
Files.md 是一款开源的笔记应用,作为 Obsidian 的替代品,支持 Markdown 文件并采用独特的工作流程。该应用在 Hacker News 上分享并获得了高度关注。 该项目凸显了用户对 Obsidian 等专有工具的开源替代品的日益增长的需求,尤其是那些重视数据所有权和可定制工作流程的用户。它反映了社区对透明且灵活的笔记解决方案的渴望。 Files.md 并非 Obsidian 的功能完全复刻;它提供了自己管理笔记和知识的方法,这可能吸引寻求不同范式的用户。该项目托管在 GitHub 上,采用开源许可。
hackernews · zakirullin · May 18, 13:33 · 社区讨论
背景: Obsidian 是一款流行的专有笔记应用,使用本地 Markdown 文件并提供插件生态系统。虽然个人使用免费,但它并非开源。虽然存在像 Joplin 这样的其他开源替代品,但 Files.md 引入了一种新颖的工作流程,使其与现有工具区别开来。
参考链接
社区讨论: 评论者指出 Obsidian 给人的感觉应该是开源的,凸显了社区对开放模型的信任。一些用户正在构建原生替代品,而其他用户则提到 Joplin 是更简单的开源选项。还有讨论指出 Files.md 的独特工作流程并非直接替代 Obsidian,这让一些人觉得更有趣。
标签: #open-source, #note-taking, #markdown, #obsidian-alternative, #productivity
埃隆·马斯克起诉 OpenAI 败诉
Elon Musk loses lawsuit against OpenAI ⭐️ 8.0/10
陪审团裁定埃隆·马斯克对山姆·阿尔特曼和 OpenAI 的诉讼因超过诉讼时效而被驳回。 该裁决确立了一个先例,即对 OpenAI 向营利性转型的挑战可能因时效问题被驳回,这可能保护公司免受类似诉讼,并为其 IPO 之路提供支持。 陪审团认定,马斯克早在 2019 年或 2021 年就可能因类似的微软交易提起相同的诉讼,因此他 2023 年的起诉已超过三年的诉讼时效。
hackernews · nycdatasci · May 18, 17:38 · 社区讨论
背景: 埃隆·马斯克于 2015 年共同创立了 OpenAI,当时是一家非营利性 AI 研究机构,但他于 2018 年离开。后来,他起诉 OpenAI 及其 CEO 山姆·阿尔特曼,认为该公司追求利润并与微软合作,背离了最初的非营利使命。诉讼的核心是 OpenAI 2023 年与微软的交易,但陪审团认定更早的可比交易本应触发诉讼。
社区讨论: 评论者普遍注意到诉讼时效裁决的法律意义,部分人猜测马斯克的真实目标是损害 OpenAI 的声誉和 IPO 前景,而非赢得诉讼。还有人担忧这为非营利组织向营利实体转移知识产权开创了先例。
标签: #OpenAI, #Lawsuit, #Elon Musk, #Sam Altman, #AI Industry
FBI 寻求全国范围的车牌读取器数据访问权限
FBI Seeks Nationwide Access to License Plate Reader Data ⭐️ 8.0/10
FBI 宣布计划购买全国范围内的自动车牌识别(ALPR)数据访问权限,引发了重大的隐私担忧。 此举可能在没有司法监督的情况下对美国所有车辆进行大规模监控,影响每位司机的隐私,并可能为执法部门的数据获取开创先例。 该计划涉及从运营 ALPR 系统的私营公司购买数据,这些系统可以长期跟踪车辆位置和移动;FBI 希望在没有搜查令的情况下将数据用于调查。
hackernews · cdrnsf · May 18, 19:28 · 社区讨论
背景: 自动车牌识别(ALPR)技术利用摄像头和软件自动捕获和存储车牌信息,通常包括时间、日期和 GPS 位置。这些系统被警方和私营公司广泛部署,形成了庞大的车辆移动数据库。隐私倡导者认为,无证访问此类数据违反了第四修正案对不合理搜查的保护。
参考链接
社区讨论: 评论者表达了深切担忧,有人建议采用每日变更的数字化车牌等解决方案来阻止大规模追踪。另一些人批评个人数据缺乏法律责任,指出目前个人数据是资产而非负债,从而刺激了数据收集。还有人质疑保护隐私权的政治意愿是否存在。
标签: #privacy, #surveillance, #law enforcement, #data security, #ALPR
伊朗启动比特币航运保险
Iran launches Bitcoin-backed insurance for Strait of Hormuz ⭐️ 8.0/10
2026 年 5 月 18 日,伊朗推出名为‘霍尔木兹安全’的比特币支持航运保险服务,用于穿越霍尔木兹海峡的船只。 将比特币作为地缘政治航运保险抵押品的新颖用途,可能挑战美元在国际贸易中的主导地位,并为伊朗提供规避金融制裁的工具。 该服务名为‘霍尔木兹安全’,以比特币收取保费,并将比特币作为储备资产;由伊朗道路与城市发展部于 2026 年 5 月 18 日推出。
hackernews · srameshc · May 18, 17:25 · 社区讨论
背景: 霍尔木兹海峡是连接波斯湾和阿曼湾的狭窄水道,全球约 20%的石油经过此处。伊朗曾威胁关闭该海峡以回应制裁,使得穿越该海峡的船只保险极其昂贵或无法获得。比特币支持保险为传统海上保险市场提供了一个替代方案,传统保险市场可能不愿在美国压力下承保风险。
社区讨论: 评论对该保险在美国海军力量下的有效性表示怀疑,但也指出使用比特币绕过美元霸权的战略和金融影响。一位评论者认为这可能是美国体面退出的方式,另一位则强调了比特币成为类似全球储备商品的重大意义。
标签: #Bitcoin, #Iran, #Shipping, #Geopolitics, #Insurance
Cursor 发布 Composer 2.5,性能媲美 Opus 价格低 30 倍
Cursor releases Composer 2.5, matching Opus at 30x lower cost ⭐️ 8.0/10
Cursor 发布了自研编码模型 Composer 2.5,在编码评测中达到与 Claude Opus 4.7 相当的性能,而输入成本比 Opus 低 10 倍、输出成本低 30 倍。该模型在长上下文任务处理、复杂指令遵循和协作顺畅度方面均有显著提升。 此次发布大幅降低了前沿编码 AI 的成本,可能使个人开发者和小团队更容易获得高质量 AI 辅助。Cursor 的举措挑战了主流闭源模型,并标志着向专业化、高性价比编码模型转变的趋势。 Composer 2.5 基于 Kimi K2.5,并采用三项关键训练创新:定向文本反馈强化学习以解决长 rollout 中的信用分配问题、合成数据生成(数据量是 Composer 2 的 25 倍),以及基础设施优化如 Muon 优化器和分布式正交化。该模型在编码评测中得分与 Opus 4.7 处于同一区间,最大差距不到 1 分。
rss · 小互(@imxiaohu) · May 19, 02:02
背景: Cursor 是一个 AI 原生的代码编辑器,内置编码助手。其 Composer 模型可自主生成和编辑代码。Anthropic 的 Opus(Claude Opus 4.7)是复杂编码任务中最强大的模型之一,但价格昂贵,输入约每百万 token 15 美元、输出 75 美元。Composer 2.5 的目标是以极低的成本提供类似能力,使高级 AI 编码辅助更加普及。
参考链接
标签: #AI, #coding model, #Cursor, #cost efficiency, #Composer 2.5
阿里 Qwen3.7 预览版登陆 Arena 基准测试
Alibaba's Qwen3.7 Preview Lands on Arena Benchmarks ⭐️ 8.0/10
阿里巴巴的 Qwen3.7 预览版(Max 和 Plus 变体)已加入 Arena 平台的文本和视觉基准测试,在文本竞技场中排名第 13,在视觉竞技场中排名第 16。 此次发布标志着阿里巴巴在竞争激烈的 AI 模型领域中表现强劲,使该公司在文本领域位列第 6,在视觉领域位列第 5,显示出其在语言和多模态任务方面不断增强的能力。 Qwen3.7 Max 预览版在文本竞技场的数学、专家、软件与 IT 以及编程子项中分别排名第 7、第 9、第 9 和第 10,而 Plus 预览版处理视觉任务。这些模型是预览版本,完整版本预计很快发布。
rss · Arena.ai(@lmarena_ai) · May 18, 15:42
背景: Arena 是一个众包基准测试平台,用户通过投票模型输出来计算 Elo 评分和排行榜。它评估文本和视觉模态的模型,提供社区驱动的模型质量衡量标准。Qwen 是阿里巴巴的大型语言模型系列,Qwen3.7 是最新版本。
标签: #AI, #Alibaba, #Qwen3.7, #Arena, #benchmark
Claude Code 开发者:HTML 是新的 Markdown
HTML is the new Markdown, says Claude Code developer ⭐️ 8.0/10
Claude Code 核心开发者 Thariq (@trq212) 提出观点:HTML 正在取代 Markdown,成为人与 LLM 交互的首选格式,因其可视化和交互性优势。 这一转变可能显著改善 AI 工作流中的人类监督与协作,为规划、编辑和设计系统管理提供更丰富的界面。 Thariq 提出了三个可落地的工作流:用交互式 HTML 进行头脑风暴、为特定编辑任务生成一次性微应用、以及创建人机双向可读的活体设计系统。
rss · meng shao(@shao__meng) · May 19, 01:08
背景: Markdown 是一种轻量级标记语言,常用于格式化纯文本。它因其简单性和人类与 AI 的可读性而受到 LLM 交互的青睐。然而,随着任务规模增大,静态的 Markdown 文档变得难以审阅,缺乏交互元素。相比之下,HTML 支持丰富的视觉布局和交互组件,更适合复杂的协作工作流。
参考链接
标签: #LLM, #Markdown, #HTML, #Claude Code, #AI interaction
Claude Code 开发日志提示词外化 AI 决策
Claude Code Dev Log Prompt Externalizes AI Decisions ⭐️ 8.0/10
Claude Code 核心开发者 Thariq 分享了他高频使用的提示词,该提示词要求 AI 在编码过程中维护一份 implementation-notes.html 文件,记录设计决策、偏离之处、权衡方案和未决问题。 该提示词解决了 AI 辅助编码中一个根本性问题:过度规约与隐性决策之间的两难。它提供了一种轻量级方法,使 AI 的隐性选择变得可审计,从而减少返工并提升代码审查质量。 提示词要求 AI 记录四类内容:设计决策(规格说明不明确之处)、偏离(有意偏离规格的地方)、权衡(考虑过的替代方案)和未决问题。它使用 HTML 或 Markdown 作为轻量级、可随 PR 提交的格式。
rss · meng shao(@shao__meng) · May 19, 00:41
背景: Claude Code 是 Anthropic 推出的一款智能编码工具,能够读取代码库、编辑文件、运行命令并与开发工具集成。在 AI 辅助开发中,一个常见挑战是 AI 代理会做出许多未完全记录在规格说明中的决策。传统方法要么过度规约(不现实),要么让 AI 自由发挥(隐藏决策)。该提示词通过外化这些决策提供了一条中间路径。
标签: #Claude Code, #AI协作编码, #提示词工程, #开发日志, #软件工程
前 OpenAI 硬件负责人谈 AI 转向物理世界
Former OpenAI Hardware Lead on AI's Shift to Physical World ⭐️ 8.0/10
曾在 OpenAI 和 Meta 组建硬件团队的 Caitlin Kalinowski 在一次采访中解释了为何 AI 公司正大力投资硬件和机器人技术,指出键盘背后的 AI 能力即将饱和。 这一观点标志着 AI 行业从纯数字进步向物理世界应用的战略转变,可能加速机器人、制造和太空探索等领域的发展。 Kalinowski 曾参与苹果 MacBook 的工程研发,领导 Meta 的 AR/VR 硬件项目,随后为 OpenAI 组建了机器人和硬件团队。她在 OpenAI 与美国国防部达成协议后离开了公司。
rss · Lenny Rachitsky(@lennysan) · May 18, 14:31
背景: 大型语言模型和 AI 聊天机器人的兴起带来了数字 AI 能力的快速进步。然而,Kalinowski 认为这种加速是垂直的,将会达到天花板,从而促使 AI 实验室通过硬件、机器人和真实世界感知来探索物理世界。这种转变呼应了历史模式:技术突破最终会超越数字领域,影响物理环境。
标签: #AI hardware, #robotics, #OpenAI, #Meta, #strategy
文件搜索的 SOTA 是什么?Jerry Liu 向社区提问
What's the SOTA for File Search? Jerry Liu Polls Community ⭐️ 8.0/10
AI 领域知名人物 Jerry Liu 在 Twitter 上提问:当前文件搜索和检索的最新 SOTA 是什么?他列出了 grep、BM25、向量搜索、混合搜索和 SQL 等选项。 这个问题引发了关于 RAG 系统和企业搜索中最有效检索方法的讨论,影响了 AI 生态系统中的工具选择。 这条推文提出了类似多项选择的问题,反映出目前没有一种方法被普遍接受;高互动量(20 条回复、52 个赞)表明社区对此很感兴趣。
rss · Jerry Liu(@jerryjliu0) · May 18, 23:37
背景: BM25(最佳匹配 25)是一种根据词频和文档长度估算文档相关性的排序函数。混合搜索结合多种技术(如关键词和向量)来提高检索准确性。这些方法对于现代 AI 应用(如检索增强生成 RAG)至关重要。
标签: #file search, #retrieval, #SOTA, #BM25, #vector search
xAI 发布 Grok Imagine Video,支持三种生成模式
xAI releases Grok Imagine Video with three generation modes ⭐️ 8.0/10
xAI 推出了 Grok Imagine Video,这是一个新的 AI 模型,可生成 1-15 秒的视频片段,分辨率为 480p 或 720p,帧率为 24 fps,支持七种宽高比,并具备三种模式:文本转视频、图像转视频,以及基于最多七张参考图像实现角色、风格和场景一致性的参考转视频。 此次发布标志着 xAI 进入竞争激烈的 AI 视频生成领域,其独特的多参考一致性功能可实现更可控和个性化的视频创作,可能影响追求一致视觉叙事的内容创作者和企业。 该模型可通过 OpenRouter 访问,名称为 'x-ai/grok-imagine-video',支持最高 720p 分辨率和 24 fps 帧率。参考转视频模式可基于最多七张图像,在生成的片段中保持角色、风格和场景的一致性。
rss · OpenRouter(@OpenRouterAI) · May 18, 18:56
背景: xAI 由埃隆·马斯克创立,开发 Grok 聊天机器人和 AI 模型。视频生成模型通常使用基于扩散或 Transformer 的架构,在大型数据集上训练以生成逼真的运动和视觉效果。参考转视频方法是一项相对较新的能力,旨在跨帧保持身份和风格的一致性,这对当前许多模型来说具有挑战性。
参考链接
标签: #AI, #video generation, #xAI, #Grok, #OpenRouter
火狐使用 AI Opus 4.6 修复 22 个安全漏洞
Firefox Uses AI Opus 4.6 to Fix 22 Security Bugs ⭐️ 8.0/10
火狐团队使用 Anthropic 的 Claude Opus 4.6 AI 模型识别并修复了浏览器中的 22 个隐藏安全漏洞,修复已包含在 Firefox 148 中。 这展示了前沿 AI 在浏览器安全中的实际有效应用,可能缩短漏洞被利用的时间窗口,并体现了主要浏览器厂商与 AI 公司之间的合作。 与 Anthropic 的合作涉及使用 Opus 4.6 扫描 Firefox 的代码库,从而在 Firefox 148 中修复了 22 个安全敏感漏洞。这项工作自 2026 年 2 月以来一直持续,是强化浏览器安全更广泛计划的一部分。
rss · Michael Tsai · May 18, 17:50
背景: Opus 4.6 是 Claude 在 2026 年 2 月发布的最强大模型,擅长代码审查、调试以及跨大型代码库的自主任务。传统的漏洞发现依赖人工审计或模糊测试,而 AI 模型可以通过上下文分析代码来发现细微漏洞。这种方法代表了使用 AI 进行主动安全加固的日益增长趋势。
参考链接
标签: #Firefox, #Security, #AI, #Vulnerability, #Browser
LangChain 推出用于智能体可观测性的 SmithDB
LangChain Unveils SmithDB for Agent Observability ⭐️ 8.0/10
LangChain 发布了 SmithDB,这是一个专为智能体可观测性设计的分布式数据库,为 LangSmith 核心工作负载提供支持,宣称性能提升高达 12 倍,并通过对象存储实现完全可移植性。 SmithDB 通过大幅提升可观测性工具的速度和可移植性,解决了智能体开发中的关键瓶颈,使开发者能够在自托管和多云环境中更高效地调试和迭代 AI 智能体。 SmithDB 包含三个组件:用于持久化追踪数据的对象存储、用于段元数据的小型 Postgres 元数据存储,以及用于数据摄入、查询和压缩的无状态服务。
rss · LangChain(@LangChainAI) · May 18, 16:38
背景: AI 智能体的可观测性涉及追踪基于 LLM 的智能体的步骤和决策,以调试和监控其行为。SmithDB 是一个专为高效处理海量追踪数据而设计的分布式数据库,不同于容易成为瓶颈的通用数据库。
参考链接
标签: #LangChain, #observability, #AI agents, #tracing, #performance
Gary Marcus:纯大语言模型仅是自动补全
Gary Marcus: Pure LLMs Are Just Autocomplete ⭐️ 8.0/10
Gary Marcus 在 X 上发帖称,纯大语言模型本质上只是自动补全,而近期 AI 进展(如 Claude Code)实际源于引入经典符号技术与工具,以弥补纯 LLM 的缺陷。 这一批评挑战了仅靠扩大 LLM 规模就能推动 AI 进步的主流观点,强调神经符号方法的必要性。它引发了关于近期突破真正来源以及 AI 研究未来方向的辩论。 Marcus 提到 Claude Code 作为使用符号方法的例子,并回应了 Bindu Reddy 的推文(后者声称称 AI 为“仅自动补全”的批评者已被证明错误)。Marcus 强调,理解进展需要认识到正逐步摆脱纯 LLM。
rss · Gary Marcus(@GaryMarcus) · May 18, 07:44
背景: 纯大语言模型是在海量文本数据上训练、用于预测下一个词的神经网络,常被批评者称为“自动补全”。符号 AI(又称老式 AI)使用逻辑、规则和显式知识表示,与神经网络的统计模式匹配形成对比。Gary Marcus 是知名 AI 研究员,经常批评纯统计 AI,倡导混合神经符号系统。
标签: #GaryMarcus, #LLM critique, #AI progress, #symbolic AI, #autocomplete
Vercel 对所有用户免费提供全部防火墙缓解措施
Vercel makes all firewall mitigations free for everyone ⭐️ 8.0/10
Vercel 宣布所有防火墙缓解措施(包括自定义规则)现已免费。这超越了 DDoS 和系统级缓解,扩展到用户配置的任何规则。 此举大幅降低了使用 Vercel 的开发者和组织的成本,尤其是那些面临大规模攻击的用户。它提升了安全功能的可及性,并可能为云平台定价树立新标准。 即日起,用户无需为被 Vercel 防火墙拒绝、挑战或限速的请求付费。Vercel 承担任何规模攻击或流量缓解的计算和网络成本。
rss · Guillermo Rauch(@rauchg) · May 19, 01:37
背景: Vercel 是一个面向前端开发者的云平台,提供托管和无服务器函数。防火墙缓解措施保护应用免受恶意流量侵害,此前自定义规则可能产生额外费用。此公告取消了这些收费。
标签: #Vercel, #Firewall, #DDoS, #Cloud Computing, #Security
Cursor 与 SpaceXAI 以十倍算力训练巨型模型
Cursor and SpaceXAI Train Massive Model with 10x Compute ⭐️ 8.0/10
Cursor 与 SpaceXAI 宣布合作,从头训练一个更大规模的 AI 模型,使用比以往多十倍的总算力,并借助拥有百万 H100 等效 GPU 的 Colossus 2 超级计算机。 此次合作标志着 AI 能力的重大飞跃,可能催生更强大的模型,从而惠及更广泛的 AI 生态系统,包括 Cursor 的编码助手和 SpaceXAI 的应用。 该模型从头开始训练,使用十倍的计算能力,这得益于 Colossus 2——首个吉瓦级 AI 训练集群,拥有百万块 H100 等效 GPU。Cursor 与 SpaceXAI 正在结合各自的数据和训练技术。
rss · Cursor(@cursor_ai) · May 18, 16:43
背景: SpaceXAI 是 SpaceX 旗下专注于 AI 的部门,由 xAI 在 2026 年并入 SpaceX 后成立。旗下运营 Grok 聊天机器人和社交网络 X。Colossus 2 是由 xAI/SpaceXAI 建造的巨型超级计算机,现为全球首个吉瓦级 AI 训练集群。
标签: #AI, #Large Language Models, #Training, #SpaceXAI, #Cursor
TurboQuant 压缩技术现已集成到 Qdrant
TurboQuant Compression Technique Arrives in Qdrant ⭐️ 8.0/10
Qdrant 1.18 引入了来自 Google Research 的旋转式向量量化算法 TurboQuant,在约两倍压缩比下达到与标量量化 (SQ) 相近的召回率,并在相同存储预算下优于二进制量化 (BQ)。 这一进展使向量搜索系统能够在牺牲检索质量的前提下大幅降低内存和存储成本,使大规模生产部署中的高维向量搜索更加实用。 TurboQuant 随 Qdrant 1.18 发布,包含针对真实嵌入的扩展;在已有集合上启用它需要通过 PATCH 请求指定包含 turbo 设置的 quantization_config。
rss · Qdrant(@qdrant_engine) · May 18, 10:30
背景: 向量数据库使用标量量化 (SQ) 和二进制量化 (BQ) 等量化技术来压缩高维向量,以减少内存使用,但会牺牲部分检索精度。TurboQuant 是一种基于旋转的方法,通过在量化前应用学习到的旋转来改善精度与压缩之间的权衡。
标签: #vector search, #quantization, #Qdrant, #compression, #machine learning
顶级硬件专家谈 AI 将吞噬硬件
AI Will Eat Hardware, Says Top Expert Caitlin Kalinowski ⭐️ 8.0/10
一期播客节目邀请到前 OpenAI、Meta、苹果硬件专家 Caitlin Kalinowski,深入探讨 AI 如何即将变革硬件设计、供应链和机器人领域,并分享了 VR/AR 失败的原因及未来趋势。 Kalinowski 在多个顶级科技公司的独特经历,为 AI 与硬件的融合提供了罕见视角,这将影响从消费电子到机器人乃至国家安全的方方面面。 Kalinowski 指出,硬件在量产前仅能“编译”五次,迭代远难于软件。她警告供应链的脆弱性,比如一颗磁铁就能卡住整个产业,并预测 AI 驱动的机器人将从数字任务转向物理世界。
rss · 跨国串门儿计划 · May 18, 06:37
背景: 这期播客是 Lenny's Podcast 的克隆节目,嘉宾 Caitlin Kalinowski 曾在苹果(MacBook Air、Mac Pro)、Meta(VR/AR)和 OpenAI(机器人)领导硬件团队。她谈到 VR/AR 技术虽未成为主流,但却为机器人时代铺路。AI 已开始变革 CAD 和 PCB 布线等硬件设计工具,但仍缺乏真正的“世界模型”来理解物理世界。
参考链接
标签: #AI, #hardware, #VR/AR, #robotics, #podcast
黑石与谷歌合资构建 TPU 云
Blackstone and Google Joint Venture to Build TPU Cloud ⭐️ 8.0/10
黑石集团与谷歌宣布成立合资公司,基于谷歌的张量处理单元(TPU)构建新型云基础设施,旨在提供 AI 和机器学习云服务。 此次合作将黑石的资本与谷歌的 TPU 技术结合,可能加剧 AI 云市场的竞争,并为机器学习工作负载提供更专业的硬件。 TPU 是谷歌定制的专用集成电路,用于加速机器学习任务,该合资公司很可能会利用谷歌最新一代的 TPU。具体财务条款和时间表尚未披露。
rss · The Keyword · May 19, 01:00
背景: 张量处理单元(TPU)是谷歌开发的用于神经网络处理的定制芯片。它们于 2015 年首次在内部使用,并于 2018 年通过谷歌云向第三方提供。TPU 加速了大型 AI 模型的训练和推理,成为 AI 基础设施的关键组成部分。
标签: #TPU, #Cloud Computing, #AI Infrastructure, #Google, #Joint Venture
Anthropic 在 Code with Claude 2026 上宣布托管代理和主动工作流
Anthropic Announces Managed Agents and Proactive Workflows at Code with Claude 2026 ⭐️ 8.0/10
在旧金山举行的 Code with Claude 2026 活动中,Anthropic 宣布了托管代理、主动工作流以及 AI 编码工具的能力曲线概念。 这些公告标志着向自主 AI 编码助手迈出了重要一步,这些助手可以处理长期任务并预测开发人员需求,从而可能加速软件开发并改变团队工作流程。 托管代理是托管服务,可为长期自主操作维护稳定接口;主动工作流允许 AI 在没有明确用户提示的情况下启动操作;能力曲线描述了 AI 模型可预测的改进轨迹。
rss · InfoQ · May 18, 13:14
背景: 像 Claude Code 这样的 AI 辅助编码工具帮助开发者编写、审查和调试代码。托管代理通过长时间运行复杂任务扩展了这一点。主动工作流使 AI 能够根据上下文建议或执行操作。能力曲线提供了一个框架,用于理解 AI 性能如何随投资和时间扩展,有助于战略规划。
参考链接
标签: #AI, #software development, #Anthropic, #Claude, #AI-assisted coding
Navigation API 达到基线,取代 History API
Navigation API Reaches Baseline, Replacing History API ⭐️ 8.0/10
Navigation API 已成为基线,自 2026 年 1 月起在所有主流浏览器中可用,提供了 History API 的现代替代方案,具有统一的事件和更好的错误处理。 这简化了单页应用中的客户端导航,减少了错误并改善了开发体验。它标志着 Web 平台路由能力的重大演进。 关键特性包括统一的 navigate 事件、自动 URL 更新以及集成的错误处理,解决了 History API 长期存在的问题。
rss · InfoQ · May 18, 06:33
背景: History API 允许操作浏览器会话历史,但缺乏统一的事件模型和清晰的错误处理。SPA 中的客户端路由经常依赖变通方法。Navigation API 提供了更健壮和标准化的方式。
标签: #Navigation API, #History API, #Client-side Routing, #Web Development, #Browser APIs
谷歌在大规模基础设施上安全进行 A/B 测试
Google A/B Tests Infrastructure Fleet-Wide Safely ⭐️ 8.0/10
谷歌发布了一套详细的方法论,用于在整支服务器集群的低层基础设施组件(如内存分配器和内核调度器)上安全地进行 A/B 实验。 这使得谷歌能够在巨大规模下验证性能和效率改进,而不会冒整个集群宕机的风险,为其他大规模系统工程团队提供了范本。 该方法论强调四个支柱:应用级与机器级实验、保持设置的均衡性、确保二进制密封性,以及选择正确的性能指标。
rss · Cloud Blog · May 18, 16:00
背景: A/B 测试通常用于面向用户的更改(如 UI 调整),但将其应用于低层基础设施是有风险的,因为一个错误可能导致大量机器宕机。内存分配器管理动态内存分配,而内核调度器为进程分配 CPU 时间,两者对系统性能都至关重要。
标签: #A/B testing, #infrastructure, #Google, #experimentation, #systems engineering
GPT-3 论文解读:少样本学习突破
GPT-3 Paper Review: Few-Shot Learning Breakthrough ⭐️ 8.0/10
本文回顾了具有里程碑意义的 GPT-3 论文,该论文展示了大型语言模型只需少量示例即可执行各种任务,无需微调。 GPT-3 的少样本学习能力显著降低了对特定任务训练数据的需求,可能降低 AI 在多个领域应用的门槛。 GPT-3 拥有 1750 亿参数,并在多样化的文本语料库上训练。论文表明,仅通过扩大模型规模和训练数据,就能涌现出少样本学习能力。
rss · freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More · May 18, 20:29
背景: 少样本学习是一种机器学习方法,模型能从极少量标注样本中学习进行预测,模仿人类从有限数据中学习的能力。GPT-3 是一种基于 Transformer 的语言模型,无需针对特定任务进行微调,只需在输入提示中给出少量示例,即可执行翻译、问答和文本生成等任务。
参考链接
标签: #GPT-3, #few-shot learning, #language models, #AI paper review
SpaceX 押注 Starship V3 首飞为 IPO 铺路
SpaceX Starship V3 First Flight Key to Planned IPO ⭐️ 8.0/10
SpaceX 已于 4 月秘密提交 IPO 申请,目标在 6 月上市,而 Starship V3 的首飞被视为支持公司上市叙事的关键验证步骤。 Starship V3 的成功直接影响资本市场对 SpaceX 增长故事的看法,因为 Starship 是公司未来运力、卫星部署和更高发射频次计划的核心。 Starship V3 比前代高约 5 英尺(1.5 米),配备新型 Raptor 3 发动机,更简洁、更强大、更可靠;但该项目此前遭遇挫折,包括 2025 年前四枚 Block 2 上面级全部失败。
telegram · zaihuapd · May 18, 13:45
背景: Starship 是 SpaceX 正在开发的两级完全可重复使用超重型运载火箭,旨在替代 Falcon 9 和 Falcon Heavy 火箭。它由 Super Heavy 助推器和 Starship 飞船组成,均使用燃烧液态甲烷和液氧的 Raptor 发动机。自 2023 年 4 月以来,该火箭已进行多次试飞,经历了数次失败和部分成功,其设计目标是通过可重复使用和大规模生产降低发射成本。
参考链接
标签: #space, #spacex, #starship, #ipo