从 123 条内容中筛选出 18 条重要资讯
- 谷歌 AMIE 实现专家级实时视频会诊 ⭐️ 9.0/10
- OpenAI 的 Astra 攻克 10 道数学难题 ⭐️ 9.0/10
- 未发布 Claude 将 zeta 零点下界提升至 67.2% ⭐️ 9.0/10
- Anthropic 发布 Claude Opus 5 ⭐️ 9.0/10
- 小红书 dots-note-3.0 获 IMO 2026 满分金牌 ⭐️ 9.0/10
- Qwen3.8-Max:阿里开源 2.4 万亿参数模型 ⭐️ 9.0/10
- Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 ⭐️ 9.0/10
- vLLM v0.27.0 发布:新增 Kimi K3 与 PyTorch 2.13 ⭐️ 8.0/10
- Mojo 1.0 正式发布:面向高性能计算的 Python 风格语言 ⭐️ 8.0/10
- Stealing Reasoning Traces from Proprietary LLM APIs ⭐️ 8.0/10
- AI 搜索让互联网集体记忆黯淡 ⭐️ 8.0/10
- 英伟达的风险生意:AI 算力需求面临审视 ⭐️ 8.0/10
- Apple Silicon 虚拟机内核修复让 llama.cpp 提速 11 倍 ⭐️ 8.0/10
- IBM 研究用更少 Token 实现 LLM 对齐与推理 ⭐️ 8.0/10
- Cloudflare DDoS Threat Report H1 2026: 1 Tbps attacks soar as DNS floods and geopolitical tensions drive a new wave ⭐️ 8.0/10
- General Catalyst 领投 11 亿美元给成立仅两个月的 River AI ⭐️ 8.0/10
- North Korean remote IT staffer worked for US government agency, says FBI ⭐️ 8.0/10
- 将 GitHub Copilot 置于中间人代理之后:学到的经验 ⭐️ 8.0/10
谷歌 AMIE 实现专家级实时视频会诊 ⭐️ 9.0/10
AMIE 在一项首创研究中实现了专家级的实时临床视频会诊。 这将使专家级诊断支持通过视频普及到任何诊所。 在一项 100 名患者的研究中,AMIE 诊断准确率达 90%,并在视频会诊中指导实时体格检查。
rss · Google AI Blog · Aug 11, 17:00T1 官方实验室
背景: AMIE(Articulate Medical Intelligence Explorer)是一种基于大语言模型的研究型 AI 系统,专为诊断推理和临床对话优化。本研究将此前基于文本的诊断工作扩展到了实时视频会诊。
参考链接
标签: #AI, #Healthcare, #Medical AI, #Video Consultation, #Research
OpenAI 的 Astra 攻克 10 道数学难题 ⭐️ 9.0/10
OpenAI 透露其未发布的 Astra 模型解决了数学与理论计算机科学领域的 10 道开放难题,并发布了附有 Lean 形式化验证的 250 页论文。 这标志着 AI 首次形式化证明如此重大的开放难题,可能重塑数学研究的方式。 这些难题涉及球体堆积、纠错码和非 sofic 群的存在性,证明已在 Lean 中用机器检查验证。
rss · AIHOT 精选 · Aug 11, 11:00AIHOT 精选
背景: Lean 是一种开源证明助手和函数式编程语言,用于对数学证明进行形式化验证。非 sofic 群是一类离散群,其存在性此前是开放问题,这次 AI 辅助的结果解决了这一疑问。
参考链接
社区讨论: MathOverflow 上的数学家正在谨慎审视非 sofic 群的证明,对 AI 生成的论证既感到兴奋也持怀疑态度。
标签: #AI, #Mathematics, #OpenAI, #Theorem Proving, #Lean
未发布 Claude 将 zeta 零点下界提升至 67.2% ⭐️ 9.0/10
未发布 Claude 将 zeta 零点下界从 41.6% 提升至 67.2%。 展示 AI 推动纯数学研究的潜力,是 AI 驱动研究的重要里程碑。 该结果仍属初步,未能证明完整的黎曼猜想。
rss · AIHOT 精选 · Aug 9, 16:00AIHOT 精选
背景: 黎曼 zeta 函数的非平凡零点据信全部位于实部 1/2 的临界线上,这就是黎曼猜想。证明在临界线上的零点所占比例的下界,是逼近猜想的部分步骤。
标签: #Riemann Hypothesis, #AI Research, #Mathematics, #Anthropic, #Claude
Anthropic 发布 Claude Opus 5 ⭐️ 9.0/10
Anthropic 在 2026 年 7 月 25 日的 AIHOT 日报中宣布发布其旗舰 AI 模型 Claude Opus 5。 此次发布是 AI 行业的重大事件,可能重塑竞争格局,并影响开发者和企业部署先进模型的方式。 根据现有模型信息,Claude Opus 5 每个请求最多可处理 100 万 tokens 的上下文。
rss · AIHOT 日报 · Jul 25, 00:00AIHOT 日报
背景: Claude Opus 是 Anthropic 的旗舰模型系列,专为复杂问题求解和数据分析而设计。Opus 5 是该系列的最新一代,目前已被拿来与 OpenAI 的 GPT-5.6 等竞品进行比较。
标签: #AI, #Anthropic, #Claude, #Model Release, #Machine Learning
小红书 dots-note-3.0 获 IMO 2026 满分金牌 ⭐️ 9.0/10
小红书 Dots Studio 宣布其 dots-note-3.0 模型在 IMO 2026 取得 42/42 满分,获得金牌,成为首个获 IMO 官方金牌认证的中国大语言模型。 满分成绩将 AI 数学推理推至 2025 年 DeepMind 和 OpenAI 里程碑之上的新高度,标志着自动定理证明能力的重大跃升。 该模型正确解答了全部六道 IMO 试题,与并列第一的七位人类选手得分相同。
rss · AIHOT 日报 · Jul 22, 00:00AIHOT 日报
背景: Dots Studio 是小红书于 2025 年初推出的 AI 研究工作室,由公司内部大模型团队发展而来。IMO 是面向高中生的国际数学奥林匹克竞赛,42/42 的满分在人类选手中极为罕见,此前也未有中国大语言模型在官方评测中达成。
参考链接
社区讨论: 包括 Remio AI 文章在内的一些评论者提醒,尽管有官方评测,这一成绩仍需独立验证。
标签: #AI, #IMO, #mathematical reasoning, #Xiaohongshu, #breakthrough
Qwen3.8-Max:阿里开源 2.4 万亿参数模型 ⭐️ 9.0/10
阿里巴巴宣布开源 Qwen3.8-Max,这是一个拥有 2.4 万亿参数的混合专家模型。 它为开发者提供了一个前沿规模的开源权重模型,可能重塑开源 AI 生态。 该模型每次前向传播仅激活 950 亿参数,开放权重承诺在 API 发布一周后提供。
rss · AIHOT 日报 · Jul 20, 00:00AIHOT 日报
背景: 混合专家模型每个 token 只激活部分参数,从而以较低的计算量实现巨大的总参数量。Qwen 是阿里巴巴的开源权重大模型系列,与前沿模型竞争。
参考链接
标签: #AI, #LLM, #Open Source, #Qwen, #Model Release
Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 ⭐️ 9.0/10
2026 年 7 月 17 日,Moonshot AI 发布 Kimi K3,这是一个 2.8T 参数的开源模型,具备原生视觉和百万 token 上下文窗口。 这是首个开放 3T 级模型,为开源社区带来前沿规模的智能,能够处理长周期编码、知识工作和复杂推理任务。 K3 基于 Kimi Delta Attention 和注意力残差技术构建,并提供原生视觉与百万 token 上下文窗口。
rss · AIHOT 日报 · Jul 17, 03:32AIHOT 日报
背景: 原生视觉意味着模型直接联合处理图像和文本,无需依赖外部 OCR 通道。百万 token 上下文窗口让模型能够对完整代码库或书籍等超长输入进行推理。
标签: #AI, #Large Language Model, #Open Source, #Multimodal, #Model Release
vLLM v0.27.0 发布:新增 Kimi K3 与 PyTorch 2.13 ⭐️ 8.0/10
vLLM v0.27.0 通过 561 个提交带来了 Kimi K3 全栈支持、新模型(Qwen3.5、K-EXAONE-2.0)以及 PyTorch 2.13.0 升级。 这一重要版本巩固了 vLLM 作为领先 LLM 推理引擎的地位,新增了对前沿模型和下一代硬件的支持。 PyTorch 2.13.0 是破坏性升级;FlashAttention 4 现在在 SM100 上支持 FP8 KV 缓存和 headdim-256。
github · khluu · Aug 10, 21:18
背景: AttnRes(注意力残差)用对前层输出的 softmax 注意力替代固定残差累加,减少深层 LLM 中隐藏状态的增长。DeepGEMM 是 DeepSeek 开发的简洁高效的 BLAS 内核库,专为 NVIDIA GPU 上的 FP8 矩阵乘法而设计。
参考链接
标签: #vLLM, #LLM inference, #PyTorch, #FlashAttention
Mojo 1.0 正式发布:面向高性能计算的 Python 风格语言 ⭐️ 8.0/10
Modular 正式发布 Mojo 1.0,这是其面向性能的 Python 风格编程语言的首个稳定版本。 开发者现在可以用类似 Python 的语法编写性能关键的代码并获得更高速度,这对 AI/ML 场景尤其有价值。 Mojo 编译器目前仍为闭源,官方承诺在 2026 年开源编译器与工具链;最初“成为 Python 完整超集”的目标也已有所调整。
hackernews · dayanruben · Aug 11, 16:56 · 社区讨论T2 社区与开源
背景: Mojo 是 Modular 开发的系统编程语言,采用类似 Python 的语法,但加入了静态类型、借用检查机制,并通过 MLIR 编译器框架进行编译。它可以面向 CPU、GPU、TPU 等硬件,并能与 Python 原生互操作,因此适合加速 AI/ML 场景下的现有 Python 程序。
社区讨论: 一些开发者质疑在编译器闭源的情况下 Mojo 的价值,并询问为何开源要等到 2026 年;也有人认为该语言的目标定位还不够清晰。
标签: #Mojo, #programming languages, #AI/ML, #compilers, #Python
Stealing Reasoning Traces from Proprietary LLM APIs ⭐️ 8.0/10
Researchers demonstrate a method to extract hidden reasoning traces from proprietary LLM APIs by replaying them into weaker models.
hackernews · quantumgarbage · Aug 11, 13:22 · 社区讨论T2 社区与开源
标签: #LLM, #security, #AI, #reasoning traces, #API
AI 搜索让互联网集体记忆黯淡 ⭐️ 8.0/10
《海象》杂志的一篇文章指出,AI 驱动的搜索正在侵蚀互联网的集体记忆,减少用户对原始页面的直接访问。 这会威胁开放网络作为共享文化档案的作用,影响后代获取知识的方式。 评论区的一位记者指出,AI 聊天机器人搜索不到 Google 索引在第二页或更后面的公开记录 PDF。
hackernews · awnird · Aug 10, 22:36 · 社区讨论T2 社区与开源
背景: 传统搜索引擎会索引人类编写的页面,用户可点击进入原始来源。AI 助手现在直接给出答案,减少了创作者网站的流量和收益,而旧页面逐渐失效,侵蚀了网络的历史记录。
社区讨论: 评论者观点不一:有人担心 AI 不可靠并失去 Google 普及信息的角色,也有人指出 AI 在搜索冷门或存档内容时的具体失败。
标签: #AI, #web search, #information retrieval, #internet culture, #journalism
英伟达的风险生意:AI 算力需求面临审视 ⭐️ 8.0/10
Stratechery 的一篇分析文章审视了英伟达的商业风险与竞争地位,质疑 AI 算力需求的可持续性以及 CUDA 软件护城河的强度。 投资者和科技行业必须重新评估:如果需求增长放缓或出现替代方案,英伟达的估值与主导地位能否维持。 分析指出,虽然对算力的第一层需求是真实的,但第二层的增长预期可能被夸大,而 CUDA 生态的锁定效应是关键风险。
hackernews · jonbaer · Aug 11, 10:02 · 社区讨论T2 社区与开源
背景: CUDA 是英伟达专有的 GPU 计算平台;它在机器学习研究中的深度渗透构成了强大的软件护城河。
参考链接
社区讨论: 评论者就 CUDA 护城河是强是弱展开辩论:有人批评其开发者体验差,也有人指出本地推理和中国模型可能侵蚀需求。
标签: #Nvidia, #AI, #business strategy, #semiconductors, #CUDA
Apple Silicon 虚拟机内核修复让 llama.cpp 提速 11 倍 ⭐️ 8.0/10
一篇博文修复了 macOS Virtualization.framework 虚拟机中的内核选择问题,使 Apple Silicon 上 llama.cpp 推理速度提升高达 11 倍。 在 Apple Silicon 上通过 macOS 虚拟机运行 llama.cpp 的用户,可通过简单内核修复获得大幅提速。 该修复仅适用于 Virtualization.framework 虚拟机;它纠正了内核选择,使 llama.cpp 不再选用次优内核,与未修改的虚拟机相比整体提速 11.08 倍、token 生成提速 16.36 倍。
hackernews · frabonacci · Aug 11, 14:50 · 社区讨论T2 社区与开源
背景: macOS Virtualization.framework 是 Apple 提供的 API,用于在 Apple Silicon 和 Intel Mac 上运行虚拟机。它管理包括 GPU 支持在内的虚拟硬件,这会影响 llama.cpp 等计算库选择内核的方式。
社区讨论: 评论者澄清,该提速并非普遍适用,仅适用于 Virtualization.framework 虚拟机;在这些虚拟机中,虚拟机导致 llama.cpp 选择了错误的内核。
标签: #Apple Silicon, #llama.cpp, #macOS, #Virtualization, #GPU
IBM 研究用更少 Token 实现 LLM 对齐与推理 ⭐️ 8.0/10
IBM 研究在 Hugging Face 发布博客文章,提出 ALTK-Evolve-SLDD 方法,以更少的 Token 实现对齐或推理(ACE),提升 LLM 效率。 这有望降低 LLM 的训练和推理成本,使算力有限的组织也能更容易地实现对齐与推理。 该方法需要兼顾激进的 Token 压缩与关键语义信息的保留,这正是 Token 缩减研究中的核心挑战。
rss · Hugging Face Blog · Aug 11, 13:37T1 官方实验室
背景: Token 缩减技术通过剪枝、合并或聚类来减少 Token 数量,在保留关键语义信息的同时降低计算开销。LLM 对齐是指微调模型,使其输出安全、准确并符合人类价值观。
标签: #LLM, #Token Efficiency, #Alignment, #Reasoning, #IBM Research
Cloudflare DDoS Threat Report H1 2026: 1 Tbps attacks soar as DNS floods and geopolitical tensions drive a new wave ⭐️ 8.0/10
Cloudflare’s H1 2026 DDoS Threat Report highlights a 519% surge in hyper-volumetric attacks driven by DNS and CLDAP reflection vectors amid geopolitical tensions.
rss · Cloudflare Blog · Aug 11, 13:00T1 官方实验室
标签: #DDoS, #Cloudflare, #cybersecurity, #threat report, #DNS
General Catalyst 领投 11 亿美元给成立仅两个月的 River AI ⭐️ 8.0/10
由 xAI 联合创始人 Igor Babuschkin 创立的 River AI,在成立仅两个月后获得 General Catalyst 领投的 11 亿美元融资。 这笔巨额融资表明投资者对个人 AI 代理作为 AI 下一个前沿领域充满信心。 本轮融资的具体产品和技术细节未对外披露。
rss · TechCrunch · Aug 11, 17:41T1 官方实验室
背景: 个人 AI 代理是一种助手,能管理邮件、日历和任务,超越了传统聊天机器人。
参考链接
标签: #AI agents, #funding, #startup, #personal AI, #River AI
North Korean remote IT staffer worked for US government agency, says FBI ⭐️ 8.0/10
The FBI reveals that a North Korean remote IT worker infiltrated a US government agency, underscoring vulnerabilities in remote hiring and national security.
rss · TechCrunch · Aug 11, 13:40T1 官方实验室
标签: #cybersecurity, #North Korea, #government security, #remote work, #infiltration
将 GitHub Copilot 置于中间人代理之后:学到的经验 ⭐️ 8.0/10
一位工程师使用 mitmproxy 拦截 VS Code 中 GitHub Copilot 的流量,逆向分析了其内部架构与运行时行为。 这表明基于 Electron 的 AI 应用共享相似的网络栈,相关发现可迁移到其他工具,帮助开发者理解 AI 应用的内部机制。 作者给出了在 VS Code 中配置代理以拦截 Copilot HTTPS 流量的具体步骤。
rss · AIHOT 精选 · Aug 11, 18:32AIHOT 精选
背景: Mitmproxy 是一个开源的交互式 HTTPS 代理,通过安装本地证书来解密 SSL/TLS 流量,使开发者可以检查和修改请求。作者刻意实施了中间人拦截——这种技术通常与攻击相关,但此处用于分析。
标签: #reverse-engineering, #github-copilot, #mitmproxy, #electron, #ai
附录
以下内容来自 AIHOT 日报,每天 08:00 北京时间发布
- AIHOT 日报 · 2026-08-11 — SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理
SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-11
- AIHOT 日报 · 2026-08-10 — Seedance 2.5 上线一周新增六种创意玩法
Seedance 2.5 上线一周新增六种创意玩法 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-10
- AIHOT 日报 · 2026-08-09 — 苹果 Mac 简体中文支持文档更新,“Apple 智能”阿里千问扩展现身
苹果 Mac 简体中文支持文档更新,“Apple 智能”阿里千问扩展现身 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-09
- AIHOT 日报 · 2026-08-08 — 谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时
谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-08
- AIHOT 日报 · 2026-08-07 — NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿
NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-07
- AIHOT 日报 · 2026-08-06 — Qwen-Image-3.0-Pro 上线 Qwen Cloud
Qwen-Image-3.0-Pro 上线 Qwen Cloud — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-06
- AIHOT 日报 · 2026-08-05 — NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型
NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-05
- AIHOT 日报 · 2026-08-04 — Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数
Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-04
- AIHOT 日报 · 2026-08-03 — Grok 支持分析任意视频
Grok 支持分析任意视频 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-03
德国法院裁定 AI 音乐生成器 Suno 侵犯版权,驳回合理使用抗辩 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-02
DeepSeek V4 Flash 0731 开源,登顶开源模型前三 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-01
Google DeepMind 发布 Gemini Robotics 2 物理 AI — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-31
Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-30
- AIHOT 日报 · 2026-07-29 — Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%
Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95% — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-29
Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-28
xAI 发布 Grok CLI 并支持 /tutorial 命令 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-27
新报告揭示 OpenAI 在 Hugging Face 自主黑客事件中失控的严重程度 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-26
Anthropic 发布 Claude Opus 5 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-25
Cactus 发布 Gemma 4 E2B Hybrid:可在设备端为每个回答输出置信度分数,低分时自动路由至更大模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-24
腾讯设计 Agent 平台 Miora 全面开放 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-23
小红书 dots 模型获 IMO 2026 满分金牌 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-22
面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-21
Qwen3.8 开源发布,2.4T 参数模型上线 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-20
Claude Code v2.1.214 发布:修复权限绕过、添加 EndConversation 工具与多项 Bash 权限检查改进 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-19
Kimi K3 登顶前端编码榜,开放权重挑战闭源双巨头 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-18
Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-17
阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-16
Bonsai 27B:首款可在手机上运行的 27B 级多模态模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-15
腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-14
腾讯混元发布 Hy3 模型:295B 参数 MoE 架构,Agent 向 LLM 定位,已集成微信服务 10 亿+用户 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-13