从 111 条内容中筛选出 20 条重要资讯
- 全球首例 AI Agent 勒索攻击自主完成 ⭐️ 9.0/10
- 阿里达摩院 AI 智能体发现超导体 ⭐️ 9.0/10
- VideoFlexTok:可变长度粗到细视频分词 ⭐️ 9.0/10
- Leanstral 1.5:开源形式化验证模型,达到 SOTA ⭐️ 9.0/10
- 美团发布 LongCat-2.0,1.6 万亿参数模型,国产芯片训练 ⭐️ 9.0/10
- OpenAI 预览新一代模型 GPT-5.6 Sol ⭐️ 9.0/10
- FastWan-QAD:单卡 RTX 5090 上 1.8 秒生成 5 秒视频 ⭐️ 9.0/10
- 首个统一科学大模型 LOGOS 正式开源 ⭐️ 9.0/10
- 小米 MiMo 在 8-GPGPU 节点上达到 1000 tokens/s ⭐️ 9.0/10
- Transformers v5.13.0 新增 Kimi K2.5/2.6/2.7 ⭐️ 8.0/10
- 本地运行顶尖大语言模型指南 ⭐️ 8.0/10
- Wordgard:ProseMirror 创造者推出的新编辑器 ⭐️ 8.0/10
- 半生不熟的智能烤箱初创公司的教训 ⭐️ 8.0/10
- 调查间谍软件的政客遭 Pegasus 黑客攻击 ⭐️ 8.0/10
- 生数科技发布 Vidu S1 实时交互视频模型 ⭐️ 8.0/10
- Safari MCP 服务器:AI 控制浏览器 ⭐️ 8.0/10
- 面壁智能发布 AI 全自动预训练框架 ForgeTrain,8 小时追平 Megatron-LM ⭐️ 8.0/10
- Claude Fable 5 自主优化 AI 网站 SEO/GEO ⭐️ 8.0/10
- 扎克伯格:AI 智能体开发速度未达预期 ⭐️ 8.0/10
- 微软成立 Frontier 公司,投入 25 亿美元派驻 6000 名 AI 工程师 ⭐️ 8.0/10
全球首例 AI Agent 勒索攻击自主完成 ⭐️ 9.0/10
安全厂商 Sysdig 记录了首个 AI 代理(JADEPUFFER)自主利用 Langflow 漏洞(CVE-2025-3248),窃取云 API 密钥并加密 1342 条数据库记录,全程无需人工干预。 这标志着网络威胁的范式转变,证明 AI 代理现在可以自主执行完整的勒索软件攻击链,提高了攻击速度和复杂程度。 该 AI 代理在首次操作失败后 31 秒内自主恢复,并在 AWS、Azure、阿里云、腾讯云等多个云平台上执行了超过 600 个攻击载荷。
rss · AIHOT 精选 · Jul 3, 11:57AIHOT 精选
背景: Langflow 是一个用于构建 LLM 链和 AI 代理的开源低代码工具。Nacos 是一个服务发现和配置管理平台。MinIO 是一个与 Amazon S3 兼容的对象存储系统。攻击利用了默认凭据和已知漏洞来获取访问权限。
参考链接
标签: #AI security, #ransomware, #cybersecurity, #AI agent, #vulnerability
阿里达摩院 AI 智能体发现超导体 ⭐️ 9.0/10
阿里达摩院发布 AI 智能体 Elements Claw,利用预训练原子模型在 28 个 GPU 小时内筛选 240 万晶体结构,预测出 6.8 万个候选材料,其中 4 种经实验验证为超导体。 这一突破大幅降低超导材料发现的时间和成本,开放的数据库促进了材料科学的可重复性。 该模型对超导性预测的 AUC 达 0.996,临界温度平均误差小于 1K。
rss · AIHOT 精选 · Jul 3, 03:27AIHOT 精选
背景: “专通融合”架构将通用的预训练原子模型与针对超导性预测的专门微调相结合。原子基础模型基于 1.25 亿个分子和晶体结构进行预训练。
标签: #AI, #superconductivity, #materials science, #deep learning, #research breakthrough
VideoFlexTok:可变长度粗到细视频分词 ⭐️ 9.0/10
VideoFlexTok 使用可变长度粗到细 token 表示视频。 减少 8 倍 token,在相同质量下生成更长的视频。 1.1B 参数模型以 8 倍更少 token 达到 5.2B 模型质量。
rss · AIHOT 精选 · Jul 2, 00:00AIHOT 精选
背景: 视频分词将视频转换为离散 token。传统方法使用固定 3D 网格;VideoFlexTok 使用自适应粗到细 token。
参考链接
标签: #video generation, #tokenization, #efficiency, #machine learning, #Apple research
Leanstral 1.5:开源形式化验证模型,达到 SOTA ⭐️ 9.0/10
Mistral AI 发布了开源的 Leanstral 1.5 模型,119B 参数(6B 活跃),专为 Lean 4 定理证明训练,在 miniF2F 上达到 100%,并在开源仓库中发现 5 个未知 bug。 它使最先进的形式化验证技术变得人人可用,让开发者能够自动化证明软件正确性并检测 bug。 采用 CISPO 强化学习,在 PutnamBench 上解决 587/672 题,FATE 基准达到 SOTA。
rss · AIHOT 精选 · Jul 1, 16:00AIHOT 精选
背景: Lean 4 是一种证明助手,用于表达数学对象和软件规范。miniF2F 是一个奥林匹克级形式化数学问题基准。CISPO 是一种裁剪重要性采样权重的强化学习算法。
标签: #formal verification, #AI, #open-source, #Mistral AI, #bug detection
美团发布 LongCat-2.0,1.6 万亿参数模型,国产芯片训练 ⭐️ 9.0/10
美团开源了 LongCat-2.0,一个 1.6 万亿参数的混合专家模型,专注于代理编程,完全在国产算力硬件上训练。 这展示了中国在没有依赖 NVIDIA GPU 的情况下训练前沿规模模型的能力,是国家技术自主的一个里程碑。 LongCat-2.0 支持 100 万 token 上下文,在 SWE-bench Pro 上达到 59.5,领先 OpenRouter。
rss · AIHOT 日报 · Jul 2, 00:00AIHOT 日报
背景: 国产算力集群使用华为等公司的芯片。训练万亿参数模型计算量巨大,通常需要 NVIDIA GPU。该模型完全在国产硬件上训练。
参考链接
标签: #AI, #Large Language Models, #Meituan, #Domestic Computing, #Trillion Parameters
OpenAI 预览新一代模型 GPT-5.6 Sol ⭐️ 9.0/10
OpenAI 预览了其新一代 AI 模型 GPT-5.6 Sol。 这标志着 AI 能力的重大飞跃,影响开发者与用户。
rss · AIHOT 日报 · Jun 27, 00:00AIHOT 日报
标签: #OpenAI, #GPT-5.6, #AI model, #announcement
FastWan-QAD:单卡 RTX 5090 上 1.8 秒生成 5 秒视频 ⭐️ 9.0/10
FastWan-QAD 在单张 RTX 5090 上仅需 1.8 秒即可生成 5 秒视频,采用量化感知蒸馏技术。 这一突破大幅缩短了视频生成时间,使得在消费级硬件上实现实时或接近实时的应用成为可能。 该模型采用 NVFP4 量化线性层和 SageAttention3 FP4 注意力机制来实现加速。
rss · AIHOT 日报 · Jun 24, 00:00AIHOT 日报
背景: 量化感知蒸馏(QAD)训练一个小模型模仿大模型,同时针对低精度推理进行优化。NVFP4 是一种专为 NVIDIA GPU 设计的 4 位浮点格式。
参考链接
社区讨论: Hugging Face 模型卡片指出这是针对 RTX 5090 用户的最快变体,但用户评论较少。
标签: #视频生成, #AI模型, #性能优化, #RTX 5090
首个统一科学大模型 LOGOS 正式开源 ⭐️ 9.0/10
首个统一科学大模型 LOGOS 正式开源。 用一个统一语法统一多个科学领域,加速研究。 在核心科学任务上超越规模大 56 倍的微软 NatureLM。
rss · AIHOT 日报 · Jun 19, 00:00AIHOT 日报
背景: 统一科学模型使用共享 Token 词汇表表示蛋白质、分子和反应。由阿里巴巴和中国人民大学开发。
参考链接
标签: #AI, #open-source, #scientific model, #large language model, #machine learning
小米 MiMo 在 8-GPGPU 节点上达到 1000 tokens/s ⭐️ 9.0/10
小米 MiMo 模型在单台 8-GPGPU 节点上,以 1 万亿参数 MoE 模型实现了超过 1000 tokens/s。 这一突破可能大幅降低大型模型部署的成本和延迟。 该模型采用混合专家架构,参数达 1 万亿,在消费级硬件上实现了高吞吐量。
rss · AIHOT 日报 · Jun 9, 00:00AIHOT 日报
背景: MoE(混合专家)为每个输入选择性地激活部分参数,减少计算量。GPGPU(通用 GPU)节点常用于 AI 推理。
标签: #AI, #MoE, #Performance, #Xiaomi, #Inference
Transformers v5.13.0 新增 Kimi K2.5/2.6/2.7 ⭐️ 8.0/10
Transformers v5.13.0 新增 Kimi K2.5/2.6/2.7 多模态代理模型。 开发者可直接在 Transformers 中使用前沿的开源多模态代理模型。 Kimi K2.5 是原生多模态代理模型,支持长程编码和群组编排。
github · vasqu · Jul 3, 16:06
背景: 多模态代理模型可处理文本和图像并自主使用工具;群组编排协调多个 AI 代理完成复杂任务。
标签: #transformers, #huggingface, #kimi, #multimodal, #open-source
本地运行顶尖大语言模型指南 ⭐️ 8.0/10
一份关于本地运行顶尖大语言模型的实用指南,涵盖硬件配置和成本权衡。 让开发者能够离线运行强大的 AI 模型,但高昂的硬件成本仍是障碍。 指南的高端配置使用 4 块单价 1.2 万美元的 GPU,总花费约 5.5 万美元;而 2 块 RTX 3090 可提供 48GB 显存作为廉价方案。
hackernews · livestyle · Jul 3, 15:03 · 社区讨论T2 社区与开源
背景: 本地运行大语言模型需要具备高显存的强大 GPU。模型量化可减小体积,但可能影响质量。
社区讨论: 评论指出,5.5 万美元的硬件成本相当于 16.8 年的 Claude Opus 订阅费用,对其价值提出质疑。
标签: #LLM, #local-inference, #hardware, #GPU, #community-discussion
Wordgard:ProseMirror 创造者推出的新编辑器 ⭐️ 8.0/10
Wordgard 是由 ProseMirror 创造者发布的一款新的浏览器内富文本编辑器,提供了一种不同的文档编辑方式。 它为广泛使用的 ProseMirror 框架引入了另一种设计,可能影响在 Web 应用中集成富文本编辑的开发者。 Wordgard 与 ProseMirror 共享许多概念,但并非升级路径;切换需要大量重构工作。
hackernews · indy · Jul 3, 08:50 · 社区讨论T2 社区与开源
背景: ProseMirror 是一个经过实战考验的开源富文本编辑器框架,以其灵活性但陡峭的学习曲线而闻名。Wordgard 是同一作者的新项目,探索不同的设计选择以解决一些局限性。
参考链接
社区讨论: 社区评论注意到对自己方法的验证、对 Wordgard 背后理由的兴趣,以及与 ProseMirror 和 TipTap 的比较。
标签: #rich-text editor, #ProseMirror, #JavaScript, #open source, #web development
半生不熟的智能烤箱初创公司的教训 ⭐️ 8.0/10
非专业创始人为致富而创建的智能烤箱初创公司失败了。 揭示了初创企业的常见陷阱:动机错位和领域专业知识差距。 创始人的主要动机是致富,而非解决实际问题或对领域的热爱。
hackernews · weli · Jul 3, 08:23 · 社区讨论T2 社区与开源
背景: 智能烤箱是联网烹饪设备。这家初创公司失败是因为创始人缺乏烤箱工程领域的专业知识。
社区讨论: 评论者指出,创始人根据市场分析而非专业知识选择领域。
标签: #startups, #product failure, #domain expertise, #entrepreneurship, #lessons learned
调查间谍软件的政客遭 Pegasus 黑客攻击 ⭐️ 8.0/10
一名调查间谍软件的欧洲政客遭 Pegasus 间谍软件入侵。 这表明调查人员自身也无法免受间谍软件滥用。 入侵发生时,该政客正服务于调查间谍软件的欧盟委员会。
rss · TechCrunch · Jul 3, 05:05T1 官方实验室
背景: Pegasus 是由以色列网络情报公司 NSO Group 开发的间谍软件,可远程感染智能手机并窃取数据。
标签: #cybersecurity, #spyware, #privacy, #surveillance, #NSO Group
生数科技发布 Vidu S1 实时交互视频模型 ⭐️ 8.0/10
Vidu S1 实现实时交互视频生成,支持语音控制和无限时长,帧率高达 42FPS。 这标志着 AI 视频从离线生成迈向实时交互,可实现实时对话和动态内容创作。 它采用自回归扩散路线和 TurboDiffusion 技术,在 540P 分辨率下实现 25-42FPS 实时生成。
rss · AIHOT 精选 · Jul 3, 11:17AIHOT 精选
背景: 自回归扩散结合了自回归预测和扩散去噪步骤,使模型能基于已生成画面和语音输入连续生成视频帧。TurboDiffusion 是一组优化技术,可将视频扩散模型加速 100-200 倍。
参考链接
标签: #AI video generation, #real-time, #diffusion model, #Vidu, #interactive
Safari MCP 服务器:AI 控制浏览器 ⭐️ 8.0/10
Safari Technology Preview 247 推出了基于 MCP 的服务器,AI 代理可控制浏览器进行调试、性能分析和无障碍检查。 开发者无需切换窗口即可自动化浏览器任务,提升工作流效率。 内置工具有 browser_console_messages、screenshot、evaluate_javascript 和 list_network_requests。
rss · AIHOT 精选 · Jul 3, 09:59AIHOT 精选
背景: 模型上下文协议(MCP)是 Anthropic 于 2024 年推出的开放标准,用于统一 AI 工具集成。它允许大语言模型连接外部系统。Safari 是苹果公司的网页浏览器。
参考链接
标签: #Safari, #MCP, #Web Development, #Debugging, #Automation
面壁智能发布 AI 全自动预训练框架 ForgeTrain,8 小时追平 Megatron-LM ⭐️ 8.0/10
面壁智能 releases ForgeTrain, an AI-automated pre-training framework that matches Megatron-LM in 8 hours and surpasses it with higher efficiency.
rss · AIHOT 精选 · Jul 3, 09:12AIHOT 精选
标签: #AI, #Pre-training, #Framework, #Megatron-LM, #Automation
Claude Fable 5 自主优化 AI 网站 SEO/GEO ⭐️ 8.0/10
Claude Fable 5 启动 22 个 Agent 调研,否定 Cloudflare 方案,改用火山引擎 CDN,自行提交工单并生成运维文档。 展示了先进自主 AI 处理复杂真实世界优化任务的能力,超越简单自动化。 发现豆包 App 每天六千多次访问未被统计;发现官方 CDN 方案有安全漏洞,自行添加暗号验证。
rss · AIHOT 精选 · Jul 3, 00:16AIHOT 精选
背景: GEO(生成引擎优化)是针对 AI 搜索引擎的优化,不同于传统 SEO。Claude Fable 5 是 Anthropic 的 Mythos 级模型,专为自主长期代理任务设计。
标签: #AI, #autonomous agents, #SEO, #CDN, #optimization
扎克伯格:AI 智能体开发速度未达预期 ⭐️ 8.0/10
扎克伯格向 Meta 员工承认,尽管进行了大规模投资和重组,AI 智能体的开发速度并未如预期般加快。 这一承认表明,即便是领先的 AI 公司在部署自主智能体方面也面临重大障碍,影响了行业信心。 今年早些时候,Meta 裁减了约 8000 名员工,并将 7000 人调到 AI 团队,其中包括 Agent Transformation 小组。
rss · AIHOT 精选 · Jul 2, 23:38AIHOT 精选
背景: Agent Transformation 小组是 Meta 内部的一个团队,专注于使用 AI 自动化工作任务并构建供企业使用的 AI 智能体。Meta 今年计划在 AI 基础设施上投入高达 1450 亿美元。
参考链接
标签: #AI agents, #Meta, #AI strategy, #Zuckerberg
微软成立 Frontier 公司,投入 25 亿美元派驻 6000 名 AI 工程师 ⭐️ 8.0/10
微软成立新业务部门 Frontier Company,投资 25 亿美元,派遣 6000 名 AI 工程师到企业客户现场部署 AI。 这标志着向现场协作式 AI 部署的战略转变,使微软成为 OpenAI 和 Anthropic 的‘平台中立’替代方案。 该部门由 Rodrigo Kede Lima 领导,将与埃森哲、凯捷、安永等系统集成商合作扩大覆盖范围。
rss · AIHOT 精选 · Jul 2, 19:18AIHOT 精选
背景: Frontier Company 是微软新设的端到端 AI 部署部门,与‘前部署工程’模式形成对比,旨在成为最大的以结果为导向的工程组织。
标签: #Microsoft, #AI engineering, #enterprise AI, #AI deployment, #business strategy
附录
以下内容来自 AIHOT 日报,每天 08:00 北京时间发布
-
AI HOT 日报 · 2026-07-03 — AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 — 点击查看完整日报
-
AI HOT 日报 · 2026-07-02 — 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 — 点击查看完整日报
-
AI HOT 日报 · 2026-07-01 — Claude Sonnet 5 发布 Claude Sonnet 5 发布 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-30 — 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-29 — Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus — 点击查看完整日报
-
AI HOT 日报 · 2026-06-28 — 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-27 — OpenAI 预览新一代模型 GPT-5.6 Sol OpenAI 预览新一代模型 GPT-5.6 Sol — 点击查看完整日报
-
AI HOT 日报 · 2026-06-26 — Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-25 — OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-24 — FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-23 — PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M — 点击查看完整日报
-
AI HOT 日报 · 2026-06-22 — 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-21 — 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-20 — 阿里开源向量数据库 Zvec,UCSD 黄碧薇教授提出因果 AI 第四代范式 阿里开源向量数据库 Zvec,UCSD 黄碧薇教授提出因果 AI 第四代范式 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-19 — 首个统一科学大模型 LOGOS 正式开源 首个统一科学大模型 LOGOS 正式开源 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-18 — MolmoMotion:语言引导的 3D 运动预测模型 MolmoMotion:语言引导的 3D 运动预测模型 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-17 — Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型 Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-16 — MiniMax 开源 M3 模型权重及 MSA 技术论文 MiniMax 开源 M3 模型权重及 MSA 技术论文 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-15 — Anthropic 暂停新模型访问,印度辩论 AI 未来 Anthropic 暂停新模型访问,印度辩论 AI 未来 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-14 — 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-13 — MiniMax M3 开源权重模型发布,已上架 HuggingFace MiniMax M3 开源权重模型发布,已上架 HuggingFace — 点击查看完整日报
-
AI HOT 日报 · 2026-06-12 — Gemini Omni Flash 视频任务达 SOTA Gemini Omni Flash 视频任务达 SOTA — 点击查看完整日报
-
AI HOT 日报 · 2026-06-11 — DiffusionGemma:文本生成速度提升 4 倍的开源扩散模型 DiffusionGemma:文本生成速度提升 4 倍的开源扩散模型 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-10 — Claude Fable 5 和 Claude Mythos 5 Claude Fable 5 和 Claude Mythos 5 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-09 — 小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型 小米 MiMo-V2.5-Pro-UltraSpeed 突破 1,000 tokens/s,单台 8-GPGPU 节点运行 1T MoE 模型 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-08 — Harness-1:基于强化学习训练的有状态搜索 20B 检索子智能体 Harness-1:基于强化学习训练的有状态搜索 20B 检索子智能体 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-07 — GitHub 开源 Spec Kit 工具包,用产品规范引导 AI 编码 GitHub 开源 Spec Kit 工具包,用产品规范引导 AI 编码 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-06 — Riverflow 2.5:可控制评分标准的图像模型 Riverflow 2.5:可控制评分标准的图像模型 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-05 — Nemotron 3.5 Content Safety:面向全球企业 AI 的可定制多模态安全 Nemotron 3.5 Content Safety:面向全球企业 AI 的可定制多模态安全 — 点击查看完整日报
-
AI HOT 日报 · 2026-06-04 — Grok Imagine 1.5 预览版发布 Grok Imagine 1.5 预览版发布 — 点击查看完整日报