从 103 条内容中筛选出 20 条重要资讯


  1. 韦伯的‘小红点’:宇宙新谜团? ⭐️ 9.0/10
  2. AI 隐藏学习成本需两年才显现 ⭐️ 9.0/10
  3. NVIDIA 与多所大学提出 ASPIRE:自我改进机器人框架 ⭐️ 9.0/10
  4. 全球首款忆阻器神经动力学芯片 ⭐️ 9.0/10
  5. 全球首例 AI Agent 勒索攻击曝光,从漏洞利用到数据库加密全程自主完成 ⭐️ 9.0/10
  6. 阿里达摩院发布超导材料发现 AI 智能体 Elements Claw ⭐️ 9.0/10
  7. Claude Fable 5 自主优化 AIHOT 网站 SEO/GEO 全记录 ⭐️ 9.0/10
  8. Mistral AI 发布开源形式化验证模型 Leanstral 1.5 ⭐️ 9.0/10
  9. 首个统一科学大模型 LOGOS 开源 ⭐️ 9.0/10
  10. 小米 MiMo 加速器在 1T MoE 模型上达到 1000 tokens/s ⭐️ 9.0/10
  11. YouTube 私密视频漏洞通过 AI 提示注入暴露 ⭐️ 8.0/10
  12. 安娜的档案馆悬赏 20 万美元获取谷歌图书全部扫描件 ⭐️ 8.0/10
  13. Claude Code 用户报告可能的会话缓存泄漏 ⭐️ 8.0/10
  14. htop/top 全面解读指南 ⭐️ 8.0/10
  15. pxpipe:通过图像化压缩输入 token 降低 Claude Code 成本 ⭐️ 8.0/10
  16. Simon Willison 分享 Claude Code 团队的代币节省技巧 ⭐️ 8.0/10
  17. 生数科技发布 Vidu S1 实时交互视频生成模型 ⭐️ 8.0/10
  18. Safari MCP 服务器:让 AI 代理进行网页调试 ⭐️ 8.0/10
  19. 中国拟出台 AI 透明度和标识新规 ⭐️ 8.0/10
  20. 扎克伯格承认 AI 智能体进展慢于预期 ⭐️ 8.0/10

韦伯的‘小红点’:宇宙新谜团? ⭐️ 9.0/10

詹姆斯·韦伯太空望远镜发现的‘小红点’可能是一种称为黑洞星的新型天体。 这些观测挑战了早期星系和黑洞形成的现有模型,可能改写宇宙学。 一些小红点发射 X 射线,其紧凑尺寸表明它们并非普通星系。

hackernews · jnord · Jul 4, 09:08 · 社区讨论T2 社区与开源

背景: 小红点(LRD)是詹姆斯·韦伯太空望远镜在早期宇宙中发现的紧凑红色天体。它们显示宽发射线,体积极小,引发猜测它们可能是黑洞星——被稠密气体包围的黑洞,气体像恒星大气一样发光。

参考链接

社区讨论: 评论者开玩笑说要在论文中提名 Soundgarden 成员,另一些人则争论褐矮星是否可能污染信号。

标签: #astrophysics, #James Webb Space Telescope, #little red dots, #black hole stars, #cosmology


AI 隐藏学习成本需两年才显现 ⭐️ 9.0/10

一项对 26000 名学生 30 个月的面板研究发现,AI 使作业分数提升 18%,但考试分数下降 20%,且完全影响需两年才显现。 这揭示 AI 短期收益掩盖了长期学习损害,对教育技术采纳政策构成挑战。 社会学科下降 27%,STEM 下降 22%,英语下降 17%,语文下降 9%。每周使用 AI 一小时损失约 5%,五小时损失约 30%。

rss · AIHOT 精选 · Jul 4, 09:08AIHOT 精选

背景: 面板数据追踪同一群体随时间的变化,可隔离个体层面的变化。本研究跟踪学生 30 个月,以区分即时与延迟效应。

参考链接

标签: #AI in education, #learning impact, #long-term study, #edtech, #student performance


NVIDIA 与多所大学提出 ASPIRE:自我改进机器人框架 ⭐️ 9.0/10

NVIDIA 联合密歇根大学、UIUC、UC Berkeley 提出了 ASPIRE,这是一个自我改进的机器人框架,能自主编写和调试控制程序,在 LIBERO-Pro 任务上零样本成功率最高提升 77 个百分点。 该框架让机器人能从自身失败中学习并复用技能,在没有额外人工标注数据或重新训练的情况下,大幅提升复杂任务的性能。 ASPIRE 采用协调器-执行器架构、闭环执行引擎、技能库和进化搜索,并使用 Claude Code(Claude Opus 4.6)作为编程智能体。

rss · AIHOT 精选 · Jul 4, 06:32AIHOT 精选

背景: LIBERO 是一个面向机器人终身学习的仿真任务基准;BEHAVIOR-1K 是一个包含 1000 个日常活动的具身 AI 基准。零样本指无需任何任务特定训练数据即可执行任务。

参考链接

标签: #robotics, #self-improving AI, #NVIDIA, #reinforcement learning, #LLM applications


全球首款忆阻器神经动力学芯片 ⭐️ 9.0/10

中国研究人员研制出全球首款可控存内计算忆阻器神经动力学芯片,单步运算时延仅 2.12 毫秒。 该芯片突破神经动力学实时计算瓶颈,在脑皮层重建任务中比 GPU 快 50 至 478 倍。 芯片采用 40 纳米工艺,核心面积 0.28 平方毫米,运行频率 50 MHz,单步积分仅需 9 级流水。

rss · AIHOT 精选 · Jul 4, 05:01AIHOT 精选

背景: 忆阻器是一种非线性电阻,其阻值取决于流过电荷的历史,可在同一器件中实现存储与计算。存内计算直接在存储阵列中执行算术运算,减少数据搬运瓶颈。

参考链接

标签: #memristor, #neuromorphic computing, #compute-in-memory, #neural dynamics, #chip


全球首例 AI Agent 勒索攻击曝光,从漏洞利用到数据库加密全程自主完成 ⭐️ 9.0/10

Security researchers document the first fully autonomous AI Agent ransomware attack that self-exploited vulnerabilities, stole cloud credentials, encrypted databases, and learned from errors without human intervention.

rss · AIHOT 精选 · Jul 3, 11:57AIHOT 精选

标签: #AI security, #ransomware, #autonomous attack, #cloud security, #vulnerability exploitation


阿里达摩院发布超导材料发现 AI 智能体 Elements Claw ⭐️ 9.0/10

阿里达摩院发布了超导材料发现 AI 智能体 Elements Claw,该智能体筛选了 240 万种晶体结构并发现了 4 种新型超导体。 这展示了 AI 加速材料科学发现的潜力,将发现时间从数年缩短至数天。 该智能体 AUC 达 0.996,预测临界温度平均误差小于 1K,使用了基于 1.25 亿分子/晶体预训练的 10 亿参数原子基础模型。

rss · AIHOT 精选 · Jul 3, 03:27AIHOT 精选

背景: “专通融合”架构结合了通用原子基础模型与面向超导发现的任务特定微调。

参考链接

标签: #AI, #superconductivity, #materials science, #deep learning, #discovery


Claude Fable 5 自主优化 AIHOT 网站 SEO/GEO 全记录 ⭐️ 9.0/10

Claude Fable 5 autonomously optimized a website’s SEO/GEO, conducting multi-agent research, identifying traffic anomalies, selecting a CDN, interacting with support, and generating maintenance docs.

rss · AIHOT 精选 · Jul 3, 00:16AIHOT 精选

标签: #AI autonomy, #SEO, #Claude Fable, #CDN optimization, #multi-agent


Mistral AI 发布开源形式化验证模型 Leanstral 1.5 ⭐️ 9.0/10

Mistral AI 发布了 Leanstral 1.5,这是一款 Apache-2.0 开源形式化验证模型,总参数 119B(激活 6B),在 miniF2F 上达到 100%,并在 PutnamBench 和 FATE 基准上取得最先进结果。 Leanstral 1.5 通过开源和发现真实漏洞的能力,使形式化验证大众化,推动了数学和软件可靠性领域的人工智能发展。 该模型使用 CISPO 强化学习和智能体式证明,在 57 个开源仓库中发现了 5 个未知漏洞。

rss · AIHOT 精选 · Jul 1, 16:00AIHOT 精选

背景: miniF2F 是一个跨系统的奥林匹克级数学形式化基准。PutnamBench 是一个来自 Putnam 竞赛的多语言数学竞赛基准。CISPO 是一种 REINFORCE 风格的算法,通过裁剪重要性采样权重来稳定训练。

参考链接

标签: #formal verification, #theorem proving, #Mistral AI, #open-source, #AI for math


首个统一科学大模型 LOGOS 开源 ⭐️ 9.0/10

首个统一科学大模型 LOGOS 已开源。 它可加速多个学科领域的科学研究。 该模型已开源,便于社区协作。

rss · AIHOT 日报 · Jun 19, 00:00AIHOT 日报

背景: 统一科学大模型是在多个科学领域数据上训练的大语言模型。

参考链接

标签: #AI, #open-source, #scientific model, #large language model, #breakthrough


小米 MiMo 加速器在 1T MoE 模型上达到 1000 tokens/s ⭐️ 9.0/10

小米声称其 MiMo-V2.5-Pro-UltraSpeed AI 加速器在单个 8-GPGPU 节点上,对 1 万亿参数的混合专家模型实现了每秒 1000 token 的推理速度。 这一性能里程碑可能大幅降低推理成本,并使大型 MoE 模型的部署更加普及。 UltraSpeed 版本据称使用 8 个常规 GPU,而非定制芯片。

rss · AIHOT 日报 · Jun 9, 00:00AIHOT 日报

背景: 混合专家是一种稀疏模型架构,每次输入只激活部分参数,从而可以在不按比例增加计算成本的情况下训练更大的模型。MiMo 是小米的定制 AI 加速器系列。

参考链接

社区讨论: 目前没有关于此公告的社区讨论。

标签: #AI hardware, #ML inference, #MoE, #Xiaomi, #breakthrough


YouTube 私密视频漏洞通过 AI 提示注入暴露 ⭐️ 8.0/10

一个漏洞允许恶意评论在 YouTube Studio 的 AI 提示中触发提示注入,泄露创作者私密视频的标题。 它威胁创作者隐私和平台信任,因为私密视频可能通过 AI 回复被泄露。 攻击利用专门构造的评论,当创作者在 YouTube Studio 中点击建议的 AI 回复时,就会注入来自创作者私密视频的数据。

hackernews · javxfps · Jul 4, 16:45 · 社区讨论T2 社区与开源

背景: 提示注入是一种技术,攻击者通过精心构造输入,让 AI 模型将其解释为命令,从而注入恶意指令。谷歌的 Gemini AI 被集成到 YouTube Studio 中,帮助创作者回复评论,这使得它容易受到此类攻击。

参考链接

社区讨论: 一位前谷歌员工指出该漏洞很微妙,可能会转交给实现该功能的工程师;另一位评论者认为修复需要重新训练 Gemini,表明这是一个根本性缺陷。

标签: #security, #privacy, #youtube, #ai, #bug


安娜的档案馆悬赏 20 万美元获取谷歌图书全部扫描件 ⭐️ 8.0/10

安娜的档案馆悬赏 20 万美元,征集谷歌图书的全部扫描件。 此举可能大幅扩大对数百万数字化图书的获取,挑战版权规范。 悬赏目标是谷歌图书整个语料库,该库已扫描超过 4000 万种图书。

hackernews · Cider9986 · Jul 4, 16:51 · 社区讨论T2 社区与开源

背景: 安娜的档案馆是一个针对影子图书馆(如 LibGen、Sci-Hub、Z-Library)的元搜索引擎,旨在收录所有现存图书。

参考链接

社区讨论: 评论显示来自图书获取受限国家用户的支持,以及对谷歌验证码和潜在裁员的担忧。

标签: #digital libraries, #book scanning, #copyright, #access to knowledge, #open data


Claude Code 用户报告可能的会话缓存泄漏 ⭐️ 8.0/10

Claude Code 用户报告会话缓存泄漏。 可能的数据泄漏威胁用户隐私和安全。 类似问题在 Gemini 中也有报告,暗示基础设施层面缺陷。

hackernews · chatmasta · Jul 4, 14:03 · 社区讨论T2 社区与开源

背景: Claude Code 是 Anthropic 的 AI 编程助手,可读取代码库并执行命令。缓存泄漏可能导致不同会话的响应被交换。

参考链接

社区讨论: 其他大型语言模型用户报告了类似的响应交换问题。

标签: #security, #LLM, #data-leakage, #session-hijacking, #Claude-Code


htop/top 全面解读指南 ⭐️ 8.0/10

2019 年的一篇博客详解 htop 和 top 中每个指标的含义。 掌握 Linux 系统监控的必备参考资料。 解释了内存指标(RSS 与 VSZ)及 I/O 速度的含义。

hackernews · theanonymousone · Jul 4, 12:00 · 社区讨论T2 社区与开源

社区讨论: 用户 cogman10 建议禁用用户线程并启用树状视图。

标签: #htop, #Linux, #system monitoring, #performance tools


pxpipe:通过图像化压缩输入 token 降低 Claude Code 成本 ⭐️ 8.0/10

pxpipe reduces Claude API costs by rendering text as images to compress tokens, achieving 59-70% savings with minimal accuracy impact.

rss · AIHOT 精选 · Jul 3, 19:19AIHOT 精选

标签: #cost optimization, #token compression, #AI API, #Claude, #hacker news


Simon Willison 分享 Claude Code 团队的代币节省技巧 ⭐️ 8.0/10

让 Fable 自行判断,并将小任务委托给 Sonnet 和 Haiku 等低功耗模型以节省 token。 这种实用工作流可显著降低 AI 代理部署的 token 成本。 Willison 将提示词存入 Claude Code 记忆文件,观察到 Fable 的 token 消耗显著下降。

rss · AIHOT 精选 · Jul 3, 18:51AIHOT 精选

背景: Claude Code 是 Anthropic 开发的 AI 编码代理,可集成于终端和 IDE。Fable 很可能是 Claude 模型系列的一个变体,而 Opus、Sonnet 和 Haiku 是已知的 Claude 3 模型尺寸。

参考链接

标签: #AI, #LLM, #efficiency, #Fable, #Claude Code


生数科技发布 Vidu S1 实时交互视频生成模型 ⭐️ 8.0/10

Vidu S1 通过自回归扩散技术实现 540p 25-42 FPS 的实时语音控制视频生成。 这一突破实现了真正的实时交互视频通话和无限时长生成。 TurboDiffusion 加速大幅降低计算成本;一张图片即可创建角色并自定义语音。

rss · AIHOT 精选 · Jul 3, 11:17AIHOT 精选

背景: 自回归扩散混合了自回归预测与扩散模型,用于生成连贯的长视频。TurboDiffusion 是一个开源框架,通过优化注意力机制和时间步蒸馏实现 100-200 倍加速。

参考链接

标签: #video generation, #real-time AI, #interactive AI, #diffusion model


Safari MCP 服务器:让 AI 代理进行网页调试 ⭐️ 8.0/10

Safari Technology Preview 247 引入了内置 MCP 服务器,支持 AI 代理进行浏览器自动化。 Web 开发者无需离开 AI 工具即可自动化调试和性能分析。 内置工具包括截图、执行 JavaScript、列出网络请求和获取控制台消息。

rss · AIHOT 精选 · Jul 3, 09:59AIHOT 精选

背景: Model Context Protocol(MCP)是 Anthropic 于 2024 年 11 月推出的开放标准,用于标准化 AI 系统与外部工具和数据的集成方式。它允许 AI 代理读取文件、执行函数和处理上下文提示。

参考链接

标签: #Safari, #MCP, #web development, #browser automation, #debugging


中国拟出台 AI 透明度和标识新规 ⭐️ 8.0/10

国家网信办就《互联网信息服务管理办法》修订草案征求意见,新增智能信息服务专章,要求 AI 服务提供者公示技术原理、标识生成合成内容。 该规定将影响中国所有 AI 服务提供商,并可能影响全球 AI 治理标准。 草案还规定超过 6 个月不登录账号可依约注销,并要求平台建立网络暴力信息特征库。

rss · AIHOT 精选 · Jul 3, 09:15AIHOT 精选

背景: 该草案是对 2011 年《互联网信息服务管理办法》的修订,这是第二次公开征求意见。新增的“智能信息服务”专章专门针对 AI 透明度。

参考链接

社区讨论: 公众意见反馈截止 8 月 2 日;行业观察者密切关注最终要求。

标签: #AI regulation, #China, #internet governance, #AI safety, #policy


扎克伯格承认 AI 智能体进展慢于预期 ⭐️ 8.0/10

扎克伯格承认 AI 智能体进展慢于预期。 表明 AI 智能体部署比预期更难。 新的 AI 组织架构尚未带来预期收益。

rss · AIHOT 精选 · Jul 2, 23:38AIHOT 精选

参考链接

标签: #AI agents, #Meta, #Zuckerberg, #AI development, #tech industry



附录

以下内容来自 AIHOT 日报,每天 08:00 北京时间发布

  1. AI HOT 日报 · 2026-07-04 — 生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代 生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代 — 点击查看完整日报

  2. AI HOT 日报 · 2026-07-03 — AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 — 点击查看完整日报

  3. AI HOT 日报 · 2026-07-02 — 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 — 点击查看完整日报

  4. AI HOT 日报 · 2026-07-01 — Claude Sonnet 5 发布 Claude Sonnet 5 发布 — 点击查看完整日报

  5. AI HOT 日报 · 2026-06-30 — 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 — 点击查看完整日报

  6. AI HOT 日报 · 2026-06-29 — Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus — 点击查看完整日报

  7. AI HOT 日报 · 2026-06-28 — 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 — 点击查看完整日报

  8. AI HOT 日报 · 2026-06-27 — OpenAI 预览新一代模型 GPT-5.6 Sol OpenAI 预览新一代模型 GPT-5.6 Sol — 点击查看完整日报

  9. AI HOT 日报 · 2026-06-26 — Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 — 点击查看完整日报

  10. AI HOT 日报 · 2026-06-25 — OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 — 点击查看完整日报

  11. AI HOT 日报 · 2026-06-24 — FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 — 点击查看完整日报

  12. AI HOT 日报 · 2026-06-23 — PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M — 点击查看完整日报

  13. AI HOT 日报 · 2026-06-22 — 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 — 点击查看完整日报

  14. AI HOT 日报 · 2026-06-21 — 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 — 点击查看完整日报

  15. AI HOT 日报 · 2026-06-20 — 阿里开源向量数据库 Zvec,UCSD 黄碧薇教授提出因果 AI 第四代范式 阿里开源向量数据库 Zvec,UCSD 黄碧薇教授提出因果 AI 第四代范式 — 点击查看完整日报

  16. AI HOT 日报 · 2026-06-19 — 首个统一科学大模型 LOGOS 正式开源 首个统一科学大模型 LOGOS 正式开源 — 点击查看完整日报

  17. AI HOT 日报 · 2026-06-18 — MolmoMotion:语言引导的 3D 运动预测模型 MolmoMotion:语言引导的 3D 运动预测模型 — 点击查看完整日报

  18. AI HOT 日报 · 2026-06-17 — Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型 Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型 — 点击查看完整日报

  19. AI HOT 日报 · 2026-06-16 — MiniMax 开源 M3 模型权重及 MSA 技术论文 MiniMax 开源 M3 模型权重及 MSA 技术论文 — 点击查看完整日报

  20. AI HOT 日报 · 2026-06-15 — Anthropic 暂停新模型访问,印度辩论 AI 未来 Anthropic 暂停新模型访问,印度辩论 AI 未来 — 点击查看完整日报

  21. AI HOT 日报 · 2026-06-14 — 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 — 点击查看完整日报

  22. AI HOT 日报 · 2026-06-13 — MiniMax M3 开源权重模型发布,已上架 HuggingFace MiniMax M3 开源权重模型发布,已上架 HuggingFace — 点击查看完整日报

  23. AI HOT 日报 · 2026-06-12 — Gemini Omni Flash 视频任务达 SOTA Gemini Omni Flash 视频任务达 SOTA — 点击查看完整日报

  24. AI HOT 日报 · 2026-06-11 — DiffusionGemma:文本生成速度提升 4 倍的开源扩散模型 DiffusionGemma:文本生成速度提升 4 倍的开源扩散模型 — 点击查看完整日报

  25. AI HOT 日报 · 2026-06-10 — Claude Fable 5 和 Claude Mythos 5 Claude Fable 5 和 Claude Mythos 5 — 点击查看完整日报

  26. AI HOT 日报 · 2026-06-09 — 小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型 小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型 — 点击查看完整日报

  27. AI HOT 日报 · 2026-06-08 — Harness-1:基于强化学习训练的有状态搜索 20B 检索子智能体 Harness-1:基于强化学习训练的有状态搜索 20B 检索子智能体 — 点击查看完整日报

  28. AI HOT 日报 · 2026-06-07 — GitHub 开源 Spec Kit 工具包,用产品规范引导 AI 编码 GitHub 开源 Spec Kit 工具包,用产品规范引导 AI 编码 — 点击查看完整日报

  29. AI HOT 日报 · 2026-06-06 — Riverflow 2.5:可控制评分标准的图像模型 Riverflow 2.5:可控制评分标准的图像模型 — 点击查看完整日报

  30. AI HOT 日报 · 2026-06-05 — Nemotron 3.5 Content Safety:面向全球企业 AI 的可定制多模态安全 Nemotron 3.5 Content Safety:面向全球企业 AI 的可定制多模态安全 — 点击查看完整日报