OrcaSlicer 分支恢复对 BambuNetwork 的支持
OrcaSlicer fork restores BambuNetwork support after backlash ⭐️ 9.0/10
社区创建了 OrcaSlicer 的分支(FULU-Foundation/OrcaSlicer-bambulab),恢复了对 Bambu Lab 打印机的 BambuNetwork 完整支持,撤消了之前要求仅云认证的固件更新。 该分支使用户能够保持对打印机的本地控制,抵制供应商锁定并维护开源原则。它反映了社区对 3D 打印行业中限制性固件做法日益增长的反对。 该分支基于之前版本的 OrcaSlicer,允许直接局域网打印而无需云认证。Bambu Lab 的原始固件更新即使对于本地模式也要求云认证,此分支绕过了这一限制。
hackernews · Murfalo · May 12, 21:55 · 社区讨论
背景: OrcaSlicer 是一款流行的开源 3D 打印切片软件。打印机厂商 Bambu Lab 发布了固件更新,强制要求云认证才能打印,移除了仅局域网功能。这引发了强烈反对,进而催生了此分支以恢复原有功能。
参考链接
社区讨论: 评论者对 Bambu Lab 移除功能表示愤怒,将其比作盗窃。有人指出 Bambu Lab 最初要求局域网模式也需云认证,但在遭到反对后撤回。其他人称赞该分支是对供应商锁定的必要回应。
标签: #3D printing, #open source, #firmware, #community backlash, #vendor lock-in
CERT 发布 dnsmasq 六项严重漏洞 CVE
CERT Releases Six CVEs for Critical dnsmasq Vulnerabilities ⭐️ 9.0/10
CERT 发布了针对广泛使用的 DNS 和 DHCP 服务器 dnsmasq 的六项严重安全漏洞 CVE,影响数百万台设备。这些漏洞包括远程堆缓冲区溢出和拒绝服务攻击。 由于 dnsmasq 嵌入在无数路由器、物联网设备和 Linux 系统中,这些漏洞对网络基础设施和用户隐私构成广泛风险。此次披露凸显了从 C 语言等内存不安全语言迁移到 Rust 或 Go 等内存安全语言的紧迫性。 这些漏洞允许远程攻击者通过畸形的 DNS 或 DHCP 数据包执行任意代码或导致拒绝服务。其中一个 CVE 描述了导致 dnsmasq 停止响应的无限循环,另一个涉及堆上的大型越界写入。
hackernews · chizhik-pyzhik · May 12, 18:12 · 社区讨论
背景: dnsmasq 是一款轻量级 DNS 转发器和 DHCP 服务器,常用于小型网络、嵌入式设备和 Linux 发行版。它提供 DNS 缓存、DHCP、TFTP 和 PXE 启动服务。CVE(通用漏洞与暴露)是公开披露安全缺陷的标识符,CERT 协调漏洞披露。
参考链接
社区讨论: 社区评论对反复出现的漏洞表示沮丧,有用户称这是采用内存安全语言的‘临界点’。另一位用户讽刺地指出 dnsmasq 用于数百万台几乎从不更新的设备,凸显了更新难题。
标签: #security, #vulnerabilities, #dnsmasq, #CVE, #memory safety
Google 发布 Android Gemini Intelligence
Google Announces Gemini Intelligence for Android ⭐️ 9.0/10
在 2026 年 Android Show 上,Google 发布了 Gemini Intelligence,为 Android 带来一系列主动型 AI 功能,包括跨应用自动化、Rambler 语音精炼、生成式 widget 等,将于今年夏季在三星和 Pixel 设备上推出。 这标志着 Android 从应用平台向主动型 AI 系统的根本转变,设备无需用户主动发起即可跨应用预测并执行任务。这为移动 AI 集成设立了新标准,可能重塑用户与智能手机的交互方式。 核心功能包括多步跨应用自动化(长按电源键触发)、集成 Gemini 的 Chrome 助手、具备上下文理解能力的增强型 Autofill、将口语转换为精炼文字的 Rambler,以及通过自然语言生成自定义 widget 的 Create My Widget。隐私控制包括下单需用户确认、数据连接可随时关闭。
rss · meng shao(@shao__meng) · May 13, 00:32
背景: 历史上,Android 只是承载应用的操作系统,AI 功能主要限于 Google Assistant。借助 Gemini Intelligence,Google 将大型语言模型 Gemini 直接嵌入系统,使其能够主动感知屏幕并执行跨应用操作。这延续了代理型 AI(agentic AI)的趋势,即 AI 模型代表用户跨多个应用执行动作。
参考链接
标签: #AI, #Android, #Gemini, #Automation, #Google
谷歌发布 Googlebook:搭载 Gemini AI 的 Android 笔记本电脑
Google Announces Googlebook: Android Laptop with Gemini AI ⭐️ 8.0/10
谷歌宣布推出 Googlebook,这是一种全新的笔记本电脑品类,运行定制的 Android 桌面模式,并与 Gemini AI 助手深度集成。首批机型预计于 2026 年晚些时候上市。 这代表了谷歌对统一 AI 优先计算体验的大胆押注,可能模糊移动与桌面操作系统之间的界限。如果成功,它可能挑战传统笔记本电脑范式,并加速 AI 集成设备的普及。 Googlebook 运行代号为‘Aluminium OS’的新操作系统,取代 ChromeOS,并从底层设计用于 Gemini Intelligence,提供个性化和主动式帮助。它将由多家 OEM 合作伙伴提供,支持 x86 和 ARM 架构。
hackernews · tambourine_man · May 12, 17:37 · 社区讨论
背景: Android 桌面模式是内置于 Android 的多窗口计算环境,允许设备连接外部显示器、键盘和鼠标后作为桌面工作站使用。谷歌的 Gemini AI 是一个生成式 AI 平台,可以处理文本、代码、图像、音频和视频,并已集成到 Android 和其他谷歌服务中。Googlebook 旨在将这两项技术结合到全新的笔记本电脑形态中,作为 Chromebook 的继任者。
社区讨论: 社区讨论存在两极分化。一些评论者看到了 AI 优先、无应用未来的愿景,认为 LLM 将取代传统应用;而另一些人则批评 Android 作为桌面操作系统的局限性,质疑目标受众,并指出诸如复制 macOS 顶部面板的不良用户体验设计。还有人希望推出基于 Linux 的‘Google Linux’而非 Android 基础。
标签: #Google, #Android, #laptops, #Gemini, #AI
Needle:从 Gemini 蒸馏的 2600 万参数工具调用模型
Needle: 26M Parameter Tool-Calling Model Distilled from Gemini ⭐️ 8.0/10
Cactus 开源了 Needle,这是一个从 Gemini 蒸馏得到的 2600 万参数函数调用模型,在消费级设备上达到 6000 tok/s 的预填充速度和 1200 tok/s 的解码速度。 这表明小型专用模型在工具调用方面可以超越更大的模型,从而在手机、手表和眼镜等设备上实现高效的端侧 AI 代理应用。 Needle 采用简单的注意力网络架构,没有 MLP 层,仅依靠注意力机制和门控,预训练使用了 2000 亿 tokens,外加 20 亿 tokens 的合成函数调用数据微调。
hackernews · HenryNdubuaku · May 12, 18:03 · 社区讨论
背景: 传统 Transformer 模型同时使用注意力层和前馈网络(FFN)。蒸馏是训练一个较小的“学生”模型来模仿较大的“教师”模型(如 Gemini)。Needle 表明,对于函数调用这类检索与组装任务,可以完全去除 FFN,从而减小模型大小并提高速度。
社区讨论: 评论者对实际应用(如自然语言命令行解析)表现出兴趣,同时也对 Google 的反蒸馏防御机制和缺乏在线演示提出了担忧。一位研究者确认了移除 MLP 层的类似发现。
标签: #machine learning, #small models, #tool calling, #distillation, #on-device AI
Scrcpy v4.0 新增虚拟显示和灵活显示
Scrcpy v4.0 Adds Virtual and Flexible Displays ⭐️ 8.0/10
Scrcpy 4.0 发布,新增通过 --new-display 支持虚拟显示,以及通过 --flex-display(或 -x)支持显示窗口动态调整大小。 这一重大更新增强了 scrcpy 的屏幕镜像功能,允许用户镜像非主显示并实时调整镜像窗口大小,对应用测试、演示和多屏幕工作流特别有用。 虚拟显示功能利用 Android 的 MediaProjection API 创建独立显示,而灵活显示功能在客户端窗口调整大小时动态更新设备分辨率。
hackernews · xnx · May 12, 20:50 · 社区讨论
背景: Scrcpy 是一款开源工具,可通过 USB 或 TCP/IP 在 PC 上镜像并控制 Android 设备,将屏幕作为 H.264 视频流传输。它因低延迟和高性能而广泛使用。虚拟显示是一项新功能,允许镜像辅助屏幕或为应用创建独立显示,超越了默认设备屏幕的限制。
社区讨论: 评论者表达了强烈的热情,有人称赞无缝的灵活显示,另有人分享了将手机放在沙拉袋中通过 WiFi 共享的创意设置。然而,有用户报告三星手机上的手势导航持续存在 bug,开发者无法复现,导致他们无法继续使用。
标签: #scrcpy, #android, #screen mirroring, #open source, #tool
DuckDB 宣布推出 Quack 客户端-服务器协议
DuckDB Announces Quack Client-Server Protocol ⭐️ 8.0/10
DuckDB 宣布了 Quack 远程协议,该协议支持客户端-服务器数据库访问和多个并发写入,已在 DuckDB v1.5.2 中通过 core_nightly 仓库提供。 该协议解决了 DuckDB 此前在远程访问和并发方面的限制,使其能够水平扩展并用于多用户应用,从而拓宽了其在数据分析和应用后端中的使用场景。 Quack 是 DuckDB 的远程过程调用(RPC)协议,使用“quack:”URI 方案,设计上易于设置,并基于 Apache Arrow 和 Flight RPC 等成熟技术构建。
hackernews · aduffy · May 12, 17:54 · 社区讨论
背景: DuckDB 是一个嵌入式、进程内 SQL 数据库管理系统,专为分析查询优化。此前,它缺乏对远程连接和多个并发写入的原生支持,限制了其在客户端-服务器架构中的使用。
参考链接
社区讨论: 社区反应积极,用户对解决并发和远程访问问题表示欣慰。有人指出“并发写入”可能意味着服务器端的串行写入,也有少数用户对 DuckDB 不断变化的发展方向感到不确定。
标签: #DuckDB, #database, #client-server, #remote protocol
Obsidian 推出新插件审核系统以缓解瓶颈
Obsidian Launches New Plugin Review System to Ease Bottleneck ⭐️ 8.0/10
Obsidian 宣布推出新的社区插件审核系统,通过自动化检查替代人工审核,以解决此前插件提交几乎无法进行的问题。 这一变化缓解了 Obsidian 的关键扩展瓶颈,减少开发者挫折感和团队倦怠,同时加速生态系统中的插件供应。 该系统包含自动化检查,但缺少权限沙箱,意味着插件仍可完全访问磁盘和网络,引发安全担忧。
hackernews · xz18r · May 12, 15:45 · 社区讨论
背景: Obsidian 是一款流行的笔记应用,拥有庞大的插件生态系统。此前,所有新插件都需要小型团队进行人工审核,导致长时间的延迟和团队成员倦怠。
社区讨论: 社区成员反应不一。一些人称赞该系统解决了提交瓶颈,而另一些人则批评缺少权限沙箱,认为插件仍然存在远程代码执行等安全风险。
标签: #obsidian, #plugins, #automation, #community, #security
亚马逊和 Meta 员工为应付 AI 指标刷 Token 用量
Amazon, Meta Employees Game AI Usage Metrics ⭐️ 8.0/10
亚马逊和 Meta 员工正通过内部工具 MeshClaw 执行非必要任务,人为增加 AI Token 消耗量,这种被称为“tokenmaxxing”的行为旨在满足公司设定的 AI 使用硬性指标。 这揭示了强制 AI 使用指标所产生的扭曲激励,可能导致资源浪费和生产率数据失真,也反映了科技巨头为证明巨额 AI 投资合理性所承受的压力。 亚马逊内部工具 MeshClaw 受开源项目 OpenClaw 启发,可创建代操作办公软件的 AI Agent;员工用它制造 Token 消耗,但未产生实际生产力。据悉 Meta 员工也存在类似的刷 Token 行为。
rss · 宝玉(@dotey) · May 12, 18:18
背景: Token 是 AI 模型处理的数据单位,常被用作使用量的代理指标。“Tokenmaxxing”指最大化 Token 消耗以显得更有效率。亚马逊的 MeshClaw 基于开源自主 AI Agent 项目 OpenClaw,后者可浏览网页、运行命令、与应用程序交互。这一趋势反映了管理层对可量化 AI 使用指标的关注。
参考链接
标签: #AI工具, #企业文化, #硅谷动态, #激励扭曲
死亡开关脚本:GitHub 令牌被撤销即删除文件
Death Switch Script Deletes Files If Stolen GitHub Token Revoked ⭐️ 8.0/10
这种‘死亡开关’技术将受害者的防御性行为——撤销被入侵的令牌——变成了破坏性触发器,使事件响应变得极其危险。它凸显了一类新型供应链攻击:恶意软件不仅窃取凭证,还会实施报复性的数据销毁。 该脚本是在分析 TanStack/router 供应链攻击相关的 GitHub issue 时发现的。此前攻击者通过投毒 CI 缓存和滥用 OIDC 令牌窃取凭证,发布了 84 个恶意 npm 版本。
rss · Viking(@vikingmute) · May 13, 01:32
背景: 恶意软件中的‘死亡开关’是一种机制,当满足特定条件(如报复受害者)时触发破坏性操作(例如数据擦除)。在本例中,条件是撤回被盗的 GitHub 个人访问令牌。脚本通过 GitHub API 持续监控令牌有效性;如果令牌被撤销,就假设受害者正试图阻止攻击,并以删除本地文件作为回应。这种技术特别阴险,因为它惩罚了受害者采取标准安全步骤的行为。
标签: #security, #malware, #GitHub token, #death switch, #supply chain attack
GB200 GPU 为 MoE 模型实现创新的预填充/解码分离
GB200 GPUs Enable Novel Prefill/Decode Disaggregation for MoE Models ⭐️ 8.0/10
Perplexity 发布了在 NVIDIA GB200 NVL72 Blackwell 机架上服务 Qwen3 235B MoE 模型的研究,展示了一种创新的预填充/解码分离方法,相较于 Hopper GPU 提升了吞吐量。 这一进展解决了服务大规模混合专家(MoE)模型的关键瓶颈,实现了更高的效率和更低的推理延迟,对大规模部署先进 AI 助手至关重要。 该方法利用 GB200 的高带宽内存和互连,将预填充(计算密集型)和解码(内存受限)阶段分离到不同的 GPU 集合上,优化了资源利用率。
rss · Aravind Srinivas(@AravSrinivas) · May 12, 14:27
背景: 像 Qwen3-235B-A22B 这样的大型语言模型采用混合专家(MoE)架构,每个 token 只激活部分参数,从而降低计算成本。预填充-解码分离是一种服务技术,将初始提示处理(预填充)与逐 token 生成(解码)分开,允许在不同硬件上调度各阶段以获得更高吞吐量。NVIDIA 的 GB200 GPU 在内存带宽和扩展能力上相比 Hopper 有显著提升。
参考链接
标签: #AI infrastructure, #large language models, #MoE, #GPU serving, #disaggregation
安德烈森:AI 让程序员更忙碌而非取代他们
Andreessen: AI Makes Programmers Work Harder, Not Replace Them ⭐️ 8.0/10
网景联合创始人、风险投资家马克·安德烈森在直播中表示,AI 正导致程序员更加努力工作、工作时间更长,这与卢德主义者关于自动化会减少工作的预期相反。 这反驳了 AI 将取代程序员的普遍担忧,表明 AI 反而提升了生产力并扩大了人类工作的范围,对软件工程乃至整体经济的未来具有重要影响。 安德烈森观察到程序员‘比以往更努力’、‘工作时间比以往更多’,并且‘精疲力尽却兴高采烈’,他将此归因于边际生产力的提升。讨论还涉及 AI 末日论文学和科技岗位的未来等话题。
rss · a16z(@a16z) · May 12, 19:40
背景: 卢德谬论是指认为自动化必然导致大规模失业的观点,历史上已被证伪,因为技术会创造新就业机会。零和思维应用于技术时,认为自动化的收益以牺牲工人为代价,但安德烈森认为 AI 反而扩展了工作机会。这一观点是关于 AI 对就业和生产力影响更广泛辩论的一部分。
参考链接
标签: #AI, #software engineering, #economics, #productivity, #future of work
Perceptron Mk1 登陆 OpenRouter
Perceptron Mk1 Launches on OpenRouter ⭐️ 8.0/10
Perceptron Mk1 是一款前沿的视觉语言模型,专注于视频分析和具身推理,现已在 OpenRouter 上线,支持最高 2 FPS 的动态帧率、32k 多模态上下文,以及点、框、多边形、片段等结构化空间输出。 此次发布通过统一 API 将先进的视频理解与空间推理能力带给广大开发者,有望加速机器人、自动驾驶和视频分析等领域的应用。 该模型在 32k 多模态上下文窗口内支持最高 2 FPS 的动态帧率,并将结构化空间基元作为一等输出,实现精确定位与跟踪。
rss · OpenRouter(@OpenRouterAI) · May 12, 16:08
背景: OpenRouter 是一个统一的 API 平台,通过单一接口提供对数百个大语言模型的访问,简化了集成与成本管理。具身推理是指 AI 理解并推理真实环境中物理交互的能力,结合了视觉、语言和空间意识。
参考链接
标签: #vision-language model, #video reasoning, #embodied AI, #OpenRouter, #multimodal AI
FinalDose 推出首个可编程药物平台,针对所有癌症
FinalDose Launches First Programmable Drug Platform for All Cancers ⭐️ 8.0/10
Y Combinator 支持的初创公司 FinalDose 推出了首个可编程药物平台——一种智能药物分子,通过 DNA 识别并摧毁病变细胞,初期针对所有癌症。 这种方法可能通过提供基于 DNA 的通用检测机制,减少脱靶效应并适应多种癌症类型,从而彻底改变靶向癌症治疗,有望使治疗更加有效和个性化。 该平台被描述为一个单一的可编程分子,结合了 DNA 传感和治疗作用,但具体的分子机制技术细节尚未公开披露。该公司从所有癌症开始,意味着具有广泛的适用性。
rss · Y Combinator(@ycombinator) · May 12, 16:00
背景: 可编程药物平台旨在创建能够感知疾病生物标志物并做出靶向反应的智能疗法。传统的癌症治疗如化疗缺乏特异性,而较新的靶向疗法通常需要针对每种癌症类型进行定制设计。基于 DNA 的靶向使药物能够识别癌症特异性基因特征,可能实现一种通用解决方案。这一领域建立在纳米医学和基因工程的进展之上。
参考链接
标签: #Biotech, #Cancer Therapy, #Programmable Drugs, #Y Combinator, #Startup
X 的“为你推荐”算法使用户政治立场右移
X's 'For You' Algorithm Shifts Users Politically Right ⭐️ 8.0/10
《对话》杂志发表的一项研究发现,使用 X 平台的“为你推荐”信息流仅几周,就会显著使用户政治观点右移,包括更支持共和党政策、反对起诉特朗普,以及更倾向亲俄立场,且该效应在停止使用后不会迅速消退。 这项研究为社交媒体算法放大效应提供了实证证据,引发对舆论操纵和民主进程的担忧。它凸显了推荐系统透明度和监管的必要性。 该研究专门测试了“为你推荐”信息流,它结合了网络内和网络外内容,并由基于 Grok 的 Transformer 模型排序。算法的影响显著且持久,即使参与者停止使用该信息流后仍存在。
rss · kottke.org · May 12, 15:59
背景: X(前身为 Twitter)使用机器学习算法驱动其“为你推荐”信息流,混合来自你关注账户的帖子和来自未知账户的推荐。该算法使用 Transformer 模型对内容进行排序以预测参与度,其设计可能放大某些观点。这项研究加剧了人们对社交媒体中算法偏见和过滤气泡的担忧。
参考链接
标签: #algorithmic bias, #social media, #politics, #study, #X algorithm
Vercel 推出的 MDXG 让 .md 文件变为交互式文档
Vercel's MDXG turns .md files into interactive docs ⭐️ 8.0/10
Vercel 推出了 Markdown 体验指南(MDXG),这是一项规范,能让 .md 文件充当多页面文档,具备导航、搜索和代码高亮功能,且无需修改原文件本身。 这一标准简化了从纯 Markdown 文件创建丰富文档的过程,有望优化开发者工作流程,使 Markdown 成为技术写作和知识库中更强大的工具。 MDXG 托管在 Vercel Labs 的 GitHub 上,定义了界面应如何呈现和交互 Markdown 文档,利用现有 Markdown 语法而无需扩展。
rss · Geek(@geekbb) · May 13, 08:04
背景: Markdown 是 John Gruber 于 2004 年创建的一种轻量级标记语言,广泛用于纯文本编辑器中的文本格式化。传统上,Markdown 文件是静态的,需要额外的工具来生成可导航的文档站点。MDXG 旨在标准化 Markdown 内容在不同平台上的交互式呈现。
标签: #Markdown, #Vercel, #Documentation, #MDXG, #Web Development
宇树科技发布 GD01 载人机甲,售价 65 万美元
Unitree Launches GD01 Manned Mecha Robot for $650,000 ⭐️ 8.0/10
宇树科技(Unitree Robotics)发布了 GD01,这是一款可搭载人类驾驶员的机甲机器人,起售价 65 万美元,重量约 500 公斤。该公司宣称其已为量产做好准备,不再停留在原型阶段。 这一发布标志着机器人技术从实验室走向真实民用领域的重要一步,可能彻底改变个人交通和重型作业方式。它使宇树科技成为商用机甲技术的领先者,与其他仿人及四足机器人形成竞争。 GD01 具备稳定的双足行走能力,并可切换至四足模式以应对崎岖地形。它可选有人驾驶,即可在有人或无人状态下运行。该机器人定位为民用载具,而不仅仅是展示品。
rss · AI Will(@FinanceYF5) · May 13, 01:12
背景: 宇树科技由王兴兴于 2016 年创立,以 Go1、B2 等高性能四足机器人闻名。GD01 是其首款载人机甲,基于其在腿式运动方面的专长。机甲机器人是科幻作品中的常见元素,但实际实现仅限于实验性机器。宇树科技关于量产准备就绪的声明使 GD01 区别于早期的原型机。
参考链接
标签: #robotics, #humanoid, #mecha, #unitree, #commercial
Linux 两周内遭遇第二个严重漏洞
Linux Hit by Second Severe Vulnerability in Two Weeks ⭐️ 8.0/10
Linux 内核又报告了一个严重的安全漏洞,而就在两周前,刚刚披露了另一个类似的严重缺陷。 连续出现高严重性漏洞凸显了 Linux 安全面临的持续挑战,可能会削弱依赖该操作系统运行关键基础设施的企业用户的信任。 该漏洞的具体 CVE 编号和技术细节尚未披露,但它被描述为“严重”,很可能需要紧急修补。
rss · Hacker News: Newest · May 13, 13:20
背景: Linux 是全球使用最广泛的开源操作系统内核,驱动着从服务器、智能手机到嵌入式设备的各种设备。严重漏洞,尤其是那些允许提权或远程执行代码的漏洞,需要立即关注,并可能影响数百万个系统。
标签: #Linux, #security, #vulnerability, #CVE
Nous Research 推出 Lighthouse Attention 加速长上下文预训练
Nous Research Introduces Lighthouse Attention for Efficient Long-Context Pretraining ⭐️ 8.0/10
Nous Research 推出了 Lighthouse Attention,这是一种应用于标准缩放点积注意力(SDPA)的次二次包装器,可加速长上下文预训练。该包装器使用层级化、无梯度的选择层对称地压缩和解压查询、键和值,并且可以在部署前移除,使模型保留原版注意力推理。 大多数高效注意力方法要么改变部署架构,要么牺牲质量。Lighthouse Attention 通过一种可在训练后干净移除的包装器避免了这两个问题,有望在不增加推理成本的情况下显著加速长上下文预训练。 该方法使用层级化、无梯度选择层包装 SDPA,并保持了从左到右的因果性。初步的大语言模型实验显示,与全注意力基线相比,总训练时间更快且最终损失更低,该包装器在训练结束前的短暂恢复阶段被移除。
rss · elvis(@omarsar0) · May 12, 15:36
背景: 缩放点积注意力(SDPA)是 Transformer 模型的核心机制,但其计算复杂度随序列长度呈二次方增长,使得长上下文预训练成本高昂。次二次注意力变体旨在降低复杂度,但通常需要在推理时改变架构。Lighthouse Attention 提出了一种新颖方法:一个仅在训练时使用、部署前移除的次二次包装器,推理时保留原版 SDPA。
标签: #attention, #pretraining, #efficiency, #long-context, #machine learning
微软发布多模型智能体安全系统 MDASH
Microsoft unveils multi-model agentic security system MDASH ⭐️ 8.0/10
微软宣布推出代号 MDASH 的多模型智能体安全系统,该系统使用超过 100 个跨前沿和定制模型的专用 AI 智能体来发现和验证漏洞。该系统在 CyberGym 基准测试中取得顶尖性能,并已在补丁星期二前帮助发现和修复了 16 个漏洞(包括 4 个严重远程代码执行漏洞);客户现可注册参与私人预览。 这代表了人工智能驱动的网络安全领域的重大进步,展示了多智能体系统在自动化漏洞发现方面如何超越单一模型和传统工具。如果成功,它可能大幅缩短从漏洞发现到补丁修复的时间窗口,增强数百万 Windows 用户的安全性,并为 AI 驱动的安全防御树立新标准。 该系统由微软自主代码安全团队构建,使用前沿模型(如 GPT-4、Claude)和蒸馏定制模型的集成。智能体通过辩论式流程协作确认可利用性,减少误报。MDASH 在伯克利大学创建的包含 1507 个真实漏洞的 CyberGym 基准测试中展现出优越性能。
rss · Satya Nadella(@satyanadella) · May 13, 00:01
背景: 智能体 AI 系统使用多个专用 AI 智能体协同完成复杂任务,如代码分析和漏洞利用。由加州大学伯克利分校开发的 CyberGym 基准测试评估 AI 智能体在 188 个大型项目中发现和利用真实软件漏洞的能力。传统漏洞检测通常依赖静态分析或单一 AI 模型,可能遗漏复杂缺陷或产生高误报率。
参考链接
- Defense at AI speed: Microsoft’s new multi-model agentic security system tops leading industry benchmark | Microsoft Security Blog
- Microsoft’s agentic security system found four critical Windows RCE flaws - Help Net Security
- Microsoft unveils MDASH, a multi-model agentic AI system that beats Anthropic's Mythos - Neowin
标签: #AI, #security, #multi-agent, #Microsoft, #vulnerability detection
吴恩达:AI 不会导致大规模失业,恐慌被夸大
Andrew Ng: No AI Jobpocalypse, Fears Overblown ⭐️ 8.0/10
吴恩达发表文章,认为 AI 导致大规模失业的担忧被夸大,并指出软件工程领域招聘强劲,美国失业率保持在健康的 4.3%。 这一反叙事意义重大,因为它挑战了流行的 AI 失业论,可能影响公共政策和投资决策,并鼓励更多人学习 AI 技能。 吴恩达指出,前沿 AI 实验室和 SaaS 公司有动机夸大 AI 的影响,而企业可能将裁员归咎于 AI,实际原因是大流行期间的过度招聘。
rss · Andrew Ng(@AndrewYNg) · May 12, 16:25
背景: AI 失业论认为 AI 将自动化许多工作,导致大规模失业。著名 AI 领导者吴恩达认为,历史上的技术浪潮创造的就业多于破坏的,AI 也将如此。
标签: #AI, #job market, #Andrew Ng, #automation, #software engineering
Demis Hassabis 宣布为 Isomorphic Labs 融资 21 亿美元
Demis Hassabis Announces $2.1B Funding for Isomorphic Labs ⭐️ 8.0/10
Isomorphic Labs 和 DeepMind 的 CEO Demis Hassabis 宣布获得 21 亿美元新融资,以加速基于 AI 的药物发现,建立在 AlphaFold 突破的基础上。 这笔巨额投资表明行业对 AI 驱动的药物发现充满信心,可能彻底改变新药的开发方式,并降低将治疗药物推向患者的时间和成本。 Isomorphic Labs 成立于 2021 年,是 Alphabet 旗下 DeepMind 的分拆公司,利用 AlphaFold 技术预测蛋白质结构并发现新的药物靶点。21 亿美元的资金将加速其‘重新构想药物发现并最终解决所有疾病’的使命。
rss · Demis Hassabis(@demishassabis) · May 12, 13:50
背景: AlphaFold 是 DeepMind 开发的人工智能系统,能从氨基酸序列高精度预测蛋白质 3D 结构,在生物学领域取得突破。这项成果为 Demis Hassabis 赢得了 2024 年诺贝尔化学奖。Isomorphic Labs 的成立正是为了将 AlphaFold 的能力应用于药物发现,旨在大幅加速新药的寻找过程。
标签: #AI, #Healthcare, #Drug Discovery, #Funding, #AlphaFold
Jina AI 发布 v5-omni 多模态嵌入模型
Jina AI Releases v5-omni Multimodal Embedding Model ⭐️ 8.0/10
Jina AI 发布了 v5-omni 多模态嵌入模型,支持文本、图像、音频和视频。该模型现已在 Elastic Inference Service、HuggingFace 和 Jina API 上可用。 此次发布实现了四种模态的统一向量表示,简化了多模态 AI 应用中的搜索与检索任务。模型已在主流平台上提供,降低了开发者集成多模态嵌入的门槛。 v5-omni 是一个单一模型,覆盖文本、图像、音频和视频,并附有 arXiv 论文和博客文章提供技术细节。可通过 HuggingFace、Jina API 以及 Elastic 的托管推理服务访问。
rss · Jina AI(@JinaAI_) · May 12, 15:44
背景: 多模态嵌入将不同类型的数据(如文本、图像)表示为共享向量空间中的向量,从而实现跨模态的相似性搜索。Jina AI 专注于神经搜索和嵌入技术,Elastic Inference Service 则提供了部署此类模型的托管平台。
参考链接
标签: #multimodal embeddings, #Jina AI, #v5-omni, #AI model release, #HuggingFace
Perplexity 在 Blackwell 上优化 Qwen 实现更快推理
Perplexity Optimizes Qwen on Blackwell for Faster Inference ⭐️ 8.0/10
Perplexity 发布了一篇研究论文,详细介绍了如何利用分离式预填充/解码、Blackwell 原生量化、自定义内核和机架级 NVLink,在 NVIDIA GB200 NVL72 Blackwell 机架上托管后训练的 Qwen3 235B 模型,从而实现更快的响应和更低的服务成本。 这一演示表明,NVIDIA 的 Blackwell 平台在大规模混合专家模型的高吞吐推理方面显著优于 Hopper,使其成为生产级 LLM 服务的领先平台。Perplexity 的优化为其他组织实现低成本、低延迟推理提供了蓝图。 该方案利用预填充/解码分离技术,让不同的 GPU 资源分别处理预填充和解码阶段,并利用 Blackwell 对亚 8 位数据类型(如 MXFP6 和 MXFP4)的原生支持实现高效量化。自定义 CUDA 内核和机架级 NVLink 互连进一步降低了延迟并最大化吞吐量。
rss · Perplexity(@perplexity_ai) · May 12, 14:17
背景: 大型语言模型推理包含两个阶段:预填充(处理输入提示)和解码(生成令牌)。分离式服务将这两个阶段分配到不同的 GPU 上,以提高利用率并降低延迟。NVIDIA 的 Blackwell 架构原生支持 FP4 等低精度格式,与 Hopper 相比吞吐量可翻倍。机架级 NVLink 可实现机箱内多个 GPU 之间的高带宽通信。
参考链接
标签: #NVIDIA, #Blackwell, #large model inference, #Perplexity, #Qwen
AI 加速团队面临生产可靠性风险
AI-Accelerated Teams Face Production Reliability Risks ⭐️ 8.0/10
Stack Overflow 博客文章讨论了 AI 加速开发团队如何越来越频繁地导致生产中断,并指出那些保持高可靠性的团队采用的最佳实践。 随着 AI 工具加速代码生成,引入细微错误并导致生产中断的风险增加,可靠性成为软件团队关键竞争差异因素。 文章对比了常见失败模式(如过度依赖 AI 而不进行审查)与应对措施,包括系统测试、可观测性以及针对 AI 生成代码的人工验证。
rss · Stack Overflow Blog · May 12, 16:41
背景: AI 加速开发是指使用大型语言模型和代码生成工具来更快地生产软件。虽然这提高了开发速度,但也带来了挑战,因为 AI 可能生成不正确或不安全的代码,这些代码逃脱了传统质量检查,导致生产问题。
标签: #AI, #software engineering, #DevOps, #best practices, #production reliability
分布式系统中队列恢复的积压数学
Mathematics of Backlogs for Queue Recovery in Distributed Systems ⭐️ 8.0/10
Rajesh Kumar Pandey 在 InfoQ 上的文章提供了实用的数学公式,用于计算分布式系统中的积压耗尽时间、消费者余量和自动扩缩容触发器,并涵盖了重试放大和亚稳态等故障模式。 这些公式为工程师提供了系统化的容量规划方法,有助于防止重试风暴和亚稳态崩溃等常见故障,这些故障可能导致大规模系统出现代价高昂的中断。 文章包含基于队列长度和处理速率的耗尽时间方程,将消费者余量定义为吸收峰值的备用容量,并提出基于队列增长率而非绝对长度的自动扩缩容触发器以避免振荡。
rss · InfoQ · May 13, 09:00
背景: 在分布式系统中,当生产者速度超过消费者时会产生积压,导致请求排队。重试放大是指失败请求触发级联重试,压垮系统。亚稳态是一种故障模式,系统即使在初始触发因素消失后仍处于退化状态。这些概念是理解文章所处理故障模式的关键。
参考链接
标签: #distributed systems, #capacity planning, #queue management, #backpressure, #auto-scaling
AWS WorkSpaces 让 AI 代理无需 API 操作遗留应用
AWS WorkSpaces Lets AI Agents Control Legacy Apps Without APIs ⭐️ 8.0/10
AWS 宣布 Amazon WorkSpaces 现已作为用于 AI 代理的托管虚拟桌面进入公开预览。代理通过 IAM 进行身份验证,并利用计算机视觉和输入模拟来操作遗留应用程序,无需 API。 这一能力解决了缺乏 API 的遗留桌面应用程序的集成难题,使企业能够使用 AI 代理自动化工作流程。在遗留系统现代化成本高昂或不可行的环境中,这可以显著减少人工投入。 该服务处于公开预览阶段,并使用 IAM 进行身份验证。Reflex 的基准测试显示,基于视觉的代理消耗的令牌数量是基于 API 的代理的 45 倍,这凸显了企业需要考虑的潜在成本问题。
rss · InfoQ · May 13, 07:31
背景: AI 代理通常需要 API 与软件交互,但许多遗留桌面应用程序缺乏现代 API,导致自动化困难。AWS WorkSpaces 提供虚拟桌面基础设施;这项新功能允许代理通过计算机视觉和输入模拟“看到”屏幕并模拟鼠标和键盘输入,从而有效弥合差距。基于视觉的代理相比基于 API 的代理消耗更高的令牌数量是一个关键权衡。
参考链接
标签: #AWS, #AI Agents, #Legacy Applications, #Computer Vision, #Virtual Desktops
AI 编码代理将攻击面扩展到源代码之外
AI coding agents expand attack surface beyond source code ⭐️ 8.0/10
Google Cloud 发布博文,详细阐述了 AI 编码代理如何通过代理指令、运行时设置和扩展包等文件引入新的攻击向量,并宣布使用 VirusTotal Code Insight 进行语义分析来检测恶意配置。 这将软件供应链攻击面扩展到影响 AI 代理行为的非代码文件,要求安全团队重新思考防御策略,因为攻击者正在利用开发环境中受信任的文件。 攻击面分为四类:执行类、指令类、连接类和扩展类。Google Threat Intelligence 集成了代理能力,能够大规模将这些工件与更广泛的威胁活动关联起来。
rss · Cloud Blog · May 12, 16:00
背景: AI 编码代理是在 IDE、编辑器和终端中运行的自动化工具,能够访问本地文件并执行命令。它们依赖配置文件(如 AGENTS.md、.env)来影响行为,但这些文件通常被信任而不经审查,从而创造了传统源代码扫描无法解决的新攻击面。
参考链接
标签: #AI security, #software supply chain, #developer tools, #AI agents
Figma 如何将数据管道从多日延迟升级为实时
How Figma Upgraded Data Pipeline from Multi-Day Latency to Real-Time ⭐️ 8.0/10
Figma 工程团队对其数据管道进行了彻底改造,将多日批处理升级为流式架构,实现了实时延迟。此次升级解决了随着平台用户基数和数据量指数级增长而带来的扩展挑战。 这一转变使 Figma 能够提供实时分析和洞察,提升用户体验和运营决策效率。同时,它为面临类似数据管道可扩展性和延迟问题的其他公司提供了有价值的参考。 该管道可能利用了 PostgreSQL 只读副本和 PgBouncer 连接池实现近乎实时的复制,并结合了流处理技术。此次迁移解决了导致数据新鲜度延迟数天的瓶颈问题。
rss · ByteByteGo Newsletter · May 12, 15:31
背景: 数据管道通常以批处理方式(例如隔夜)处理信息,导致分析和报告产生显著延迟。实时管道则持续处理数据,实现即时洞察。Figma 是一个协作设计平台,会产生大量用户交互数据,需要快速处理以支持团队分析和使用监控等功能。
参考链接
标签: #data engineering, #data pipeline, #real-time, #system design, #scalability
Databricks Catalog Commits 正式发布,统一开放表格式与目录
Databricks Catalog Commits GA Unifies Open Table Formats and Catalogs ⭐️ 8.0/10
Databricks 宣布 Catalog Commits 正式发布,该功能将 Delta 和 Iceberg 等开放表格式与 Unity Catalog 等开放目录在湖仓一体架构中统一起来。 这一进步简化了湖仓管理,支持跨不同表格式和目录的原子性多表事务,降低了运营复杂性并提升了企业数据一致性。 Catalog Commits 要求表为 Unity Catalog 托管表(Delta 或 Iceberg),且需要 Databricks Runtime 16.4 及以上版本才能读取、写入或创建启用目录提交的表。
rss · Databricks · May 12, 15:00
背景: Delta Lake 和 Apache Iceberg 等开放表格式为数据湖带来了 ACID 事务和模式演进,而 Unity Catalog 等开放目录则提供了集中式元数据管理。Catalog Commits 将这两层连接起来,支持跨表格式和目录的原子性提交,确保湖仓生态的一致性。
标签: #data engineering, #lakehouse, #open table formats, #catalog, #Databricks
每日科技综述:供应链攻击、AI 趋势、欧盟监管
Daily tech roundup: supply chain attack, AI trends, EU regulation ⭐️ 8.0/10
2026 年 5 月 13 日 Hacker News 精选十大科技新闻,涵盖 TanStack 供应链攻击、Bambu Lab 平台信任问题、AI 推动系统语言取代 Python 的趋势,以及欧盟针对未成年人的新规。 这份综述揭示了开源持续集成/持续交付管线中的严重网络安全漏洞、硬件公司与开源社区之间日益紧张的关系,以及可能重塑在线平台的监管变化。同时,它也预示着 AI 模型偏好类型安全语言可能带来的软件工程角色转变。 TanStack 攻击利用 GitHub Actions 的 pull_request_target 漏洞向 42 个 npm 包注入恶意版本。Bambu Lab 因强制云端依赖并施压社区固件而受到批评。其他故事包括 GitLab 重组、图形用户界面截图回顾,以及 UCLA 的中风康复候选药物 DDL-920。
rss · HackerNews每日摘要 on SuperTechFans · May 12, 23:07
背景: Hacker News 是一个专注于计算机科学和创业的社会新闻网站,用户提交并投票选择故事。这篇每日综述浓缩了当天获赞最多的帖子,帮助读者快速了解网络安全、开源、人工智能、监管和硬件等领域的关键动态。
参考链接
标签: #HackerNews, #tech news, #cybersecurity, #AI, #regulation
美国商务部删除 AI 安全测试协议细节
US Commerce Dept Removes AI Safety Testing Agreement Details ⭐️ 8.0/10
美国商务部的 AI 标准与创新中心(CAISI)删除了与 Google、xAI 和 Microsoft 达成的关于在 AI 模型公开发布前进行安全测试的协议细节网页。原始链接显示 404 错误并重定向到 CAISI 首页,未提供任何解释。 这一删除行为引发了对 AI 安全监管中政府透明度的担忧,尤其因为此类测试对负责任的 AI 开发至关重要。它可能削弱公众对前沿 AI 模型监管的信任和问责。 被删除的网页属于 CAISI(美国对应英国 AI 安全研究院的机构),涉及对前沿 AI 模型进行发布前的漏洞测试。商务部及白宫未回应置评请求。
telegram · zaihuapd · May 12, 13:38
背景: AI 安全研究院是在 2023 年英国 AI 安全峰会后国际间建立的,美国成立了 CAISI 以评估和确保先进 AI 模型的安全性。删除测试协议细节可能预示着政策转变或协调不足,时值关于 AI 监管和行业自我治理的持续辩论。
标签: #AI Safety, #US Government, #Transparency, #Regulation, #Big Tech
SpaceX 与谷歌磋商轨道数据中心合作
SpaceX and Google Discuss Orbital Data Centers ⭐️ 8.0/10
谷歌正与 SpaceX 就发射轨道数据中心进行谈判,作为其‘Project Suncatcher’项目的一部分,目标是在 2027 年前发射配备定制 AI 芯片的太阳能卫星原型。 这可能将云计算推向太空,解决地面能源限制问题,同时为地球观测和全球 AI 工作负载提供低延迟处理能力。 SpaceX 计划使用升级版星链卫星,配备大型太阳能板以提供内置计算能力;谷歌已与 Planet Labs 合作开发卫星。该项目仍处于早期谈判阶段。
telegram · zaihuapd · May 12, 16:28
背景: 轨道数据中心是拟议中的太空设施,利用空间太阳能克服地球在 AI 计算方面的能源和散热限制。历史概念包括战略防御倡议的‘Brilliant Pebbles’以及近期的军事架构如‘扩散性作战人员空间架构’。谷歌的‘Project Suncatcher’是一项研究性登月计划,旨在将通过太阳能供电的卫星(配备张量处理单元)联网,形成轨道 AI 云。
标签: #space, #cloud computing, #data centers, #Google, #SpaceX
小米发布 OneVL:一步式潜空间推理框架
Xiaomi Releases OneVL: One-Step Latent Reasoning for Autonomous Driving ⭐️ 8.0/10
小米发布了 OneVL,一个一步式潜空间推理框架,将视觉-语言-动作(VLA)模型与世界模型统一用于自动驾驶,并已全面开源。 该框架在多个基准测试中达到最先进水平,同时将延迟降低至 0.24 秒,仅为自回归 VLA 模型的 5.4%。这将加速更高效、更安全的自动驾驶系统的部署。 OneVL 利用潜空间思维链(CoT),用视觉潜变量编码物理因果结构,用语言潜变量编码驾驶意图。推理时移除训练中用于预测未来画面和可读思维链的辅助解码器,实现一步并行生成。
telegram · zaihuapd · May 13, 10:33
背景: 视觉-语言-动作(VLA)模型结合了视觉感知、语言理解和动作预测,用于机器人和自动驾驶。世界模型使自动驾驶系统能够合成传感器数据并预测未来场景。潜空间推理将思考转移到抽象的、非语言的空间以提高效率。OneVL 统一了这些概念。
参考链接
标签: #小米, #自动驾驶, #VLA, #世界模型, #潜空间推理
马化腾在股东会回应腾讯 AI 进展
Ma Huateng Addresses Tencent's AI Progress at Shareholder Meeting ⭐️ 8.0/10
在腾讯股东大会上,CEO 马化腾承认公司 AI 起步落后,但已“站上船”,仍需加速追赶竞争对手。 这位科技巨头的坦诚表态意味着战略调整和 AI 投入的紧迫性提升,可能重塑中国 AI 竞争格局并影响腾讯的产品生态。 马化腾用比喻描述过程:起初发现船漏水,后来成功登上船但坐不下去,敦促加速前进。他强调腾讯不会盲目跟风,而是结合自身优势推进。
telegram · zaihuapd · May 13, 13:09
背景: 腾讯作为中国互联网巨头,此前在 AI 竞赛中相对于百度和字节跳动等对手被认为落后。公司正加强人才引进和内部培训,构建 AI 能力,重点是将 AI 整合到微信和游戏等现有产品中。
标签: #腾讯, #AI, #马化腾, #战略, #行业动态