从 133 条内容中筛选出 18 条重要资讯
- Keyv 等 npm 包遭 Shai-Hulud 供应链攻击 ⭐️ 9.0/10
- 黑客利用 Coldcard 钱包漏洞窃取 1.3 亿美元 ⭐️ 9.0/10
- Qwen3.8-Max 发布:开源 2.4T 前沿模型 ⭐️ 9.0/10
- Kimi K3 发布:2.8T 参数开源模型,原生视觉与百万上下文 ⭐️ 9.0/10
- 腾讯混元 Hy3:295B 参数 MoE 模型,面向智能体接入微信 ⭐️ 9.0/10
- 单块 AMD MI300X 运行 DeepSeek V4 Flash:实战指南 ⭐️ 8.0/10
- Xbox 宕机导致光盘游戏无法游玩 ⭐️ 8.0/10
- 谷歌盘点 2026 年 7 月 AI 创新成果 ⭐️ 8.0/10
- Cloudflare Wallets:为 AI 智能体打造的可编程支付钱包 ⭐️ 8.0/10
- AI 子代理将 Astro 的 GitHub 问题数降至零 ⭐️ 8.0/10
- 开源权重模型接近前沿 AI,安全差距持续存在 ⭐️ 8.0/10
- Anthropic 与云初创公司 Volta 签署 100 亿美元协议 ⭐️ 8.0/10
- 得州暂停数据中心审批,要求电网审计 ⭐️ 8.0/10
- MiniMax-H3 通过 MLX 可在 Apple Silicon 上运行 ⭐️ 8.0/10
- GitHub 力推堆叠式 PR 拆分 AI 巨型代码 ⭐️ 8.0/10
- NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型 ⭐️ 8.0/10
- NVIDIA 开源 cuFile API,推动 GPU 直连存储 ⭐️ 8.0/10
- Cloudflare 推出 CI SDK,用于边缘 CI/CD ⭐️ 8.0/10
Keyv 等 npm 包遭 Shai-Hulud 供应链攻击 ⭐️ 9.0/10
Keyv 及关联 npm 包在一次活跃的 Shai-Hulud 供应链攻击中被入侵。 Keyv 是 Node.js 生态中广泛使用的键值存储库,因此此次攻击影响范围很广。 Shai-Hulud 蠕虫利用生态系统的自动化机制传播,并窃取开发者凭据。
hackernews · cimi_ · Aug 4, 11:01 · 社区讨论T2 社区与开源
背景: Shai-Hulud 是近期被记录的蠕虫,专门针对 npm 和 PyPI 包,通过被入侵的依赖进行自我传播。Keyv 是 Node.js 的简单键值存储模块,支持多种后端,常用于缓存。供应链攻击通过破坏受信任的依赖项向下游用户分发恶意软件。
社区讨论: 开发者呼吁暂停使用 pre-install 钩子,并建议通过 npm 配置如 ‘min-release-age=5’ 来降低风险。
标签: #security, #npm, #supply-chain, #node.js, #malware
黑客利用 Coldcard 钱包漏洞窃取 1.3 亿美元 ⭐️ 9.0/10
Coldcard 钱包漏洞被利用,1.3 亿美元加密货币被盗。 此漏洞削弱了硬件钱包的信任度,影响所有加密货币用户。 漏洞影响 2021 年以来的资金,25 分钟内窃取 594 枚 BTC。
rss · TechCrunch · Aug 4, 16:27T1 官方实验室
背景: Coldcard 是 Coinkite 推出的仅支持比特币的硬件钱包,面向离线隔离签名设计。它将私钥存储在专用安全芯片中。
参考链接
标签: #security, #cryptocurrency, #hardware wallet, #vulnerability, #blockchain
Qwen3.8-Max 发布:开源 2.4T 前沿模型 ⭐️ 9.0/10
Qwen 发布 Qwen3.8-Max,2.4T 参数 MoE 模型,并宣布下周开源权重。 这是首次开源 Qwen-Max 级权重,将前沿规模的 AI 带给开源社区。 它采用混合专家架构,每个 token 只激活 2.4T 总参数中的 95B。
rss · AIHOT 精选 · Aug 3, 02:00AIHOT 精选
背景: 混合专家(MoE)将模型拆分为多个专家子网络,并为每个输入只路由到相关专家。总参数与激活参数因此分离,从而以较低推理成本实现超大规模。
参考链接
标签: #AI, #LLM, #Qwen, #Open Source, #Model Release
Kimi K3 发布:2.8T 参数开源模型,原生视觉与百万上下文 ⭐️ 9.0/10
月之暗面发布 Kimi K3,这是一个 2.8T 参数的开源模型,支持原生视觉和 100 万 token 上下文窗口。 它为开源模型的参数规模和原生多模态能力树立了新标杆,扩大了开发者的可构建范围。 基于 Kimi Delta Attention 和 Attention Residuals 构建;权重预计未来数日以 Modified MIT 许可证发布。
rss · AIHOT 日报 · Jul 17, 03:32AIHOT 日报
背景: Kimi K3 是月之暗面的旗舰模型。原生视觉指利用端到端架构在统一语义空间中处理图像与文本。它延续了 Kimi K2 系列的开源权重模式,但公告时完整权重尚未公开。
参考链接
标签: #AI, #Open-source model, #Kimi K3, #Large language models, #Machine learning
腾讯混元 Hy3:295B 参数 MoE 模型,面向智能体接入微信 ⭐️ 9.0/10
腾讯混元发布 Hy3,295B 参数的 MoE 大模型,面向智能体任务,已集成至微信服务超 10 亿用户。 腾讯此举标志着面向智能体的 LLM 通过微信海量用户进入主流应用,将深刻影响数十亿用户的日常体验。 Hy3 采用稀疏 MoE 架构,总参数 295B,每个 token 激活约 21B 参数,并以 Apache 2.0 协议开源。
rss · AIHOT 日报 · Jul 13, 00:00AIHOT 日报
背景: MoE 架构通过门控系统将每个输入路由到专门的专家子网络,每个 token 仅激活部分参数,从而提升推理效率。AI 智能体以 LLM 为推理核心,结合工具和上下文规划并执行多步骤任务。
参考链接
标签: #AI, #LLM, #Tencent, #MoE, #Agent
单块 AMD MI300X 运行 DeepSeek V4 Flash:实战指南 ⭐️ 8.0/10
一份发布指南展示了在单块 AMD MI300X 上以每秒超过 150 token 的速度运行 DeepSeek V4 Flash(284B 参数的混合专家模型)。 这表明前沿级大模型推理可在一块 GPU 上完成,大幅降低硬件成本,为本地部署打开空间。 模型保留完整推理权重,未做激进量化,但上下文长度从 1M 降至 256k token。
hackernews · zhoutong · Aug 4, 10:00 · 社区讨论T2 社区与开源
背景: DeepSeek V4 Flash 是混合专家(MoE)模型,总参数量 284B,但每个 token 只激活 13B 参数,因此可以放进 192GB HBM3 显存。AMD MI300X 是数据中心 GPU,配备 192GB HBM3、1216 个张量核心,采用 750W OAM 形态。
社区讨论: 评论者指出 MI300X 不单独出售(8 卡整机约 25 万欧元),讨论 144GB 的 PCIe 版 MI350P 作为替代,并认为 256k 上下文是实用取舍。
标签: #DeepSeek, #AMD MI300X, #LLM inference, #quantization, #hardware
Xbox 宕机导致光盘游戏无法游玩 ⭐️ 8.0/10
Xbox 故障导致玩家无法启动光盘版游戏。 凸显 DRM 可能让已购买的游戏无法游玩。 即使实体光盘也需要联网验证所有权。
hackernews · surprisetalk · Aug 4, 12:01 · 社区讨论T2 社区与开源
背景: 数字版权管理(DRM)通常需要通过联网验证来防止盗版,但服务器故障可能会让合法购买的内容也无法使用。
社区讨论: 用户认为拥有游戏应允许离线游玩、备份和转售。
标签: #DRM, #digital ownership, #gaming, #Xbox, #consumer rights
谷歌盘点 2026 年 7 月 AI 创新成果 ⭐️ 8.0/10
谷歌官方博客发布了 2026 年 7 月 AI 新闻与公告回顾,总结了近期的更新与创新成果。 这份回顾为开发者和研究人员追踪谷歌 AI 最新进展提供了可靠的参考。 该文章按月份汇总了 2026 年 7 月的各项公告,但现有内容中未包含具体技术细节。
rss · Google AI Blog · Aug 4, 13:00T1 官方实验室
背景: 谷歌经常在其 AI 博客上发布月度汇总,以让社区及时了解进展。这篇文章沿用了这一惯例,对当月的进展进行了高层面概括。
标签: #AI, #Google, #Machine Learning, #Announcements, #Technology
Cloudflare Wallets:为 AI 智能体打造的可编程支付钱包 ⭐️ 8.0/10
Cloudflare 宣布推出 Wallets,一个可编程钱包,让 AI 智能体能够通过 x402 协议进行原生支付和身份验证。 这很重要,因为它让 AI 智能体能够自主购买 API 和内容,在智能体网络上创造真实的经济活动。 x402 是一个基于 HTTP 402 状态码的开放、中立标准,最初由 Coinbase 的开发平台团队开发。
rss · Cloudflare Blog · Aug 4, 13:00T1 官方实验室
背景: 智能体互联网(agentic Internet)是为智能体间交互优化的基础设施层,软件可在其中自主开展业务。x402 填补了网络协议栈的空白,为服务器提供了一种在提供内容前要求付款的原生方式。
标签: #AI agents, #payments, #identity, #Cloudflare, #protocols
AI 子代理将 Astro 的 GitHub 问题数降至零 ⭐️ 8.0/10
Astro 维护者利用 GitHub Actions 中的隔离 AI 子代理自动复现、诊断并修复 bug,将开放问题减少了 85%。 这表明 AI 可以胜任实际的开源维护工作,可能改变开源项目的 bug 管理方式。 流水线由 issue 标签驱动,修复后自动发布预览版本供用户验证;底层引擎已发展为 Flue,一个开源的平台无关的持久化智能体框架。
rss · Cloudflare Blog · Aug 4, 13:00T1 官方实验室
背景: Flue 是 Astro 团队开源的 TypeScript 框架,采用 harness-first 设计。代理通过 createAgent() 定义,技能为 Markdown 文件,默认沙箱是内存中的 just-bash shell。
参考链接
社区讨论: 开发者提醒,AI 子代理需要严格的范围和充分的前置上下文,否则可能在没有明确护栏的情况下推出破坏性更改。
标签: #AI, #GitHub Actions, #open source, #issue triage, #automation
开源权重模型接近前沿 AI,安全差距持续存在 ⭐️ 8.0/10
安全 AI 报告发现,Z.ai 的开源权重模型 GLM-5.2 接近前沿 AI,但缺乏安全缓解措施。 强大的开源权重模型可能会超越治理和安全保障。 GLM-5.2 是 Z.ai 推出的大规模推理模型,可在 Hugging Face 和 OpenRouter 上使用。
rss · TechCrunch · Aug 4, 20:05T1 官方实验室
背景: 开源权重模型是指其核心权重公开释出、任何人都可下载的 AI 模型。前沿 AI 指的是顶级、最先进的模型。报告强调,开源权重模型正在迎头赶上前沿性能,却缺乏封闭模型所具备的安全措施。
参考链接
标签: #AI safety, #open-weight models, #frontier AI, #governance, #GLM-5.2
Anthropic 与云初创公司 Volta 签署 100 亿美元协议 ⭐️ 8.0/10
Anthropic 与成立仅数月的 AI 云初创公司 Volta 签署 100 亿美元、为期六年的算力协议,硬件来自 Nvidia、戴尔和比特币矿商 Bitdeer。 这表明 Anthropic 为快速获取 GPU 算力,愿意押注未经验证的新供应商,可能重塑云市场竞争格局。 Volta 估值 24 亿美元,将在 Bitdeer 挪威 121MW 站点部署算力;Anthropic 承担了超大规模云厂商合同中从未有的交易对手风险。
rss · TechCrunch · Aug 4, 19:48T1 官方实验室
背景: Volta 是一家今年早些时候由 Ricard Boada 和 Sofia Gumuzio 创立的隐形 AI 云初创公司。其硬件几乎全为租用:英伟达芯片由戴尔组装,数据中心容量来自总部位于新加坡的比特币矿商兼 AI 云公司 Bitdeer。
参考链接
社区讨论: 有评论指出,Anthropic 是在用财务风险换取交付速度,若 Volta 无法兑现,可能损害信任。
标签: #AI, #Cloud, #Anthropic, #Partnership, #Business
得州暂停数据中心审批,要求电网审计 ⭐️ 8.0/10
得州州长暂停数据中心审批并下令审计。 影响 AI 基础设施扩展和电网可靠性。 此举是在数据中心需求激增导致电力紧张的背景下做出的。
rss · TechCrunch · Aug 4, 15:42T1 官方实验室
背景: AI 模型训练需要大量算力,推动数据中心用电量激增,导致电网承压。
标签: #data centers, #energy policy, #Texas, #infrastructure, #AI compute
MiniMax-H3 通过 MLX 可在 Apple Silicon 上运行 ⭐️ 8.0/10
MiniMax-H3 是一个开放权重的多模态模型,现可通过 MLX 移植在 Apple Silicon 上生成带音频的 15 秒视频。 可在 Mac 上本地生成视频和音频,减少对云端的依赖。 需下载约 115 GB 模型文件;在 M5 Max MacBook Pro 上生成耗时不到 45 分钟。
rss · AIHOT 精选 · Aug 4, 19:10AIHOT 精选
背景: H3 是一个开放权重的全模态生成模型;MLX 是 Apple 用于在 Apple Silicon 上运行 ML 的框架。
标签: #MiniMax-H3, #MLX, #Apple Silicon, #multimodal generation, #video generation
GitHub 力推堆叠式 PR 拆分 AI 巨型代码 ⭐️ 8.0/10
GitHub 发布教程,演示如何将 AI 生成的 1000+ 行大 diff 按数据、API、接线和 UI 拆成四个分层堆叠 PR,便于独立审查。 使用 AI 编码助手的团队能保持代码审查质量,避免被超大 diff 淹没。 堆叠中的每个 PR 指向其下方分支,形成最终合并到 main 的有序链条;各层可分配给不同审查者。
rss · AIHOT 精选 · Aug 4, 16:47AIHOT 精选
背景: 堆叠式 PR(stacked PR)是一串 PR,每个 PR 指向它下面的 PR 分支,而不是直接指向 main。GitHub 引入这一技巧,是因为 AI 编码智能体常一次性生成超大 diff,单次审查不现实。
参考链接
社区讨论: 开发者普遍认为 AI 生成的超大 diff 冲击传统审查方式,堆叠 PR 是务实的应对手段。
标签: #GitHub, #AI code generation, #Pull Requests, #Code Review, #Stacked PRs
NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型 ⭐️ 8.0/10
NVIDIA has made Alpamayo 2 Super, an open model for Robotaxi and autonomous driving built on Cosmos 3 Super Reasoner, available for commercial use.
rss · AIHOT 精选 · Aug 4, 15:00AIHOT 精选
标签: #NVIDIA, #Autonomous Driving, #Open Source AI, #Robotics, #AI Models
NVIDIA 开源 cuFile API,推动 GPU 直连存储 ⭐️ 8.0/10
NVIDIA announced open sourcing the cuFile API and storage software stack at FMS, enabling microsecond-latency GPU-direct storage access, with Vera CPU delivering up to 3.21x throughput improvement over x86 and a Storage-Next initiative with 40+ vendors.
rss · AIHOT 精选 · Aug 4, 15:00AIHOT 精选
标签: #GPU, #storage, #NVIDIA, #cuFile, #AI infrastructure
Cloudflare 推出 CI SDK,用于边缘 CI/CD ⭐️ 8.0/10
Cloudflare 推出基于 Workflows 和 Sandbox SDK 的官方 CI SDK,可直接在其平台上为数百万个仓库运行 CI/CD 流水线。 这使平台和企业能够将 CI/CD 基础设施卸载到 Cloudflare 的全球边缘,降低成本和运维开销。 该 SDK 支持构建、lint、类型检查、单元测试、依赖缓存和条件部署,并利用 Sandbox SDK 的隔离容器安全执行代码。
rss · AIHOT 精选 · Aug 4, 13:00AIHOT 精选
背景: Cloudflare Workflows 是构建在 Workers 之上的持久执行引擎,适用于多步骤应用。Sandbox SDK 提供了一种在 Cloudflare 网络上的隔离环境中安全运行不受信任代码的方法。
标签: #CI/CD, #Cloudflare, #SDK, #Developer Tools, #Workflows
附录
以下内容来自 AIHOT 日报,每天 08:00 北京时间发布
- AI HOT 日报 · 2026-08-04 — Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数
Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-08-04
- AI HOT 日报 · 2026-08-03 — Grok 支持分析任意视频
Grok 支持分析任意视频 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-08-03
- AI HOT 日报 · 2026-08-02 — 德国法院裁定 AI 音乐生成器 Suno 侵犯版权,驳回合理使用抗辩
德国法院裁定 AI 音乐生成器 Suno 侵犯版权,驳回合理使用抗辩 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-08-02
- AI HOT 日报 · 2026-08-01 — DeepSeek V4 Flash 0731 开源,登顶开源模型前三
DeepSeek V4 Flash 0731 开源,登顶开源模型前三 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-08-01
- AI HOT 日报 · 2026-07-31 — Google DeepMind 发布 Gemini Robotics 2 物理 AI
Google DeepMind 发布 Gemini Robotics 2 物理 AI — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-31
- AI HOT 日报 · 2026-07-30 — Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制
Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-30
- AI HOT 日报 · 2026-07-29 — Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%
Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95% — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-29
- AI HOT 日报 · 2026-07-28 — Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放
Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-28
- AI HOT 日报 · 2026-07-27 — xAI 发布 Grok CLI 并支持 /tutorial 命令
xAI 发布 Grok CLI 并支持 /tutorial 命令 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-27
新报告揭示 OpenAI 在 Hugging Face 自主黑客事件中失控的严重程度 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-26
Anthropic 发布 Claude Opus 5 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-25
Cactus 发布 Gemma 4 E2B Hybrid:可在设备端为每个回答输出置信度分数,低分时自动路由至更大模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-24
腾讯设计 Agent 平台 Miora 全面开放 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-23
小红书 dots 模型获 IMO 2026 满分金牌 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-22
面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-21
Qwen3.8 开源发布,2.4T 参数模型上线 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-20
Claude Code v2.1.214 发布:修复权限绕过、添加 EndConversation 工具与多项 Bash 权限检查改进 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-19
Kimi K3 登顶前端编码榜,开放权重挑战闭源双巨头 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-18
Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-17
阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-16
Bonsai 27B:首款可在手机上运行的 27B 级多模态模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-15
腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-14
腾讯混元发布 Hy3 模型:295B 参数 MoE 架构,Agent 向 LLM 定位,已集成微信服务 10 亿+用户 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-13
蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-12
百度搭子在成都 AI Day 发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-11
OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-10
推出 Grok 4.5 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-09
Meta Superintelligence Labs 推出 Muse Image 和 Muse Video — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-08
Fun-ASR-Realtime 发布:单模型支持 30 种语言与 16 种方言,识别准确率领先 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-07
美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-06