从 114 条内容中筛选出 18 条重要资讯
- Kimi K3 发布:2.8 万亿参数开源,原生视觉百万上下文 ⭐️ 10.0/10
- Kimi K2.5:MuonClip、线性注意力、Agent Swarm ⭐️ 9.0/10
- 欧盟强制谷歌向竞争对手开放 Android 和 Search ⭐️ 9.0/10
- Anthropic 研究发现四种新的 AI 智能体行为偏差 ⭐️ 9.0/10
- OpenAI GPT-Red:自动化红队测试提升模型鲁棒性 ⭐️ 9.0/10
- 阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 ⭐️ 9.0/10
- Bonsai 27B:首款手机端 27B 多模态模型 ⭐️ 9.0/10
- 腾讯混元 Hy3:295B 参数 MoE 代理 LLM ⭐️ 9.0/10
- 美团完全开源 1.6T 参数 MoE 模型 LongCat-2.0,MIT 许可 ⭐️ 9.0/10
- 全球首款可控存内计算忆阻器神经动力学芯片问世 ⭐️ 9.0/10
- 美团 LongCat Owl Alpha:1.6 万亿 MoE 模型,国产 ASIC 训练 ⭐️ 9.0/10
- FastWan-QAD 在单张 RTX 5090 上 1.8 秒生成 5 秒视频 ⭐️ 9.0/10
- AWS 计费错误显示 17 亿美元预估 ⭐️ 8.0/10
- 开源 AI 的现状 ⭐️ 8.0/10
- 苹果诉讼威胁 OpenAI IPO ⭐️ 8.0/10
- Claude Fable 5 在 CursorBench 录得 72.9% 新高 ⭐️ 8.0/10
- 美团 LongCat 发布更难搜索智能体基准 LoHoSearch ⭐️ 8.0/10
- 英伟达 Nemotron 3 Embed 在 RTEB 基准上登顶 ⭐️ 8.0/10
Kimi K3 发布:2.8 万亿参数开源,原生视觉百万上下文 ⭐️ 10.0/10
Kimi K3 发布:2.8T 开源,原生视觉,百万上下文。 最大开源模型,推动 AI 民主化。 完整权重于 2026 年 7 月 27 日前以修改版 MIT 许可证发布。
rss · AIHOT 日报 · Jul 17, 03:32AIHOT 日报
背景: 原生视觉指模型无需外部编码器直接处理图像。如此大的模型需要先进推理硬件如 NVIDIA NVLink-72。
社区讨论: 评论称 Kimi 比 Opus/Fable 便宜 5 倍但慢 2 倍。
标签: #AI, #open-source, #large language model, #vision, #context window
Kimi K2.5:MuonClip、线性注意力、Agent Swarm ⭐️ 9.0/10
月之暗面发布 Kimi K2.5,引入 MuonClip、线性注意力和 Agent Swarm。 提升训练效率、长上下文性能和智能体协同。 MuonClip 数据利用率翻倍;线性注意力在百万 token 下超越全注意力;Agent Swarm 支持 300 个智能体。
rss · AIHOT 精选 · Jul 17, 17:38AIHOT 精选
背景: MuonClip 通过梯度裁剪稳定万亿参数模型训练。线性注意力将复杂度从 O(n²)降至 O(n)。Agent Swarm 协调模块化智能体。
参考链接
标签: #AI, #优化器, #线性注意力, #Agent Swarm, #月之暗面
欧盟强制谷歌向竞争对手开放 Android 和 Search ⭐️ 9.0/10
欧盟依据《数字市场法案》要求谷歌开放 Android 和 Search。 此举重塑 AI 和搜索竞争格局,影响谷歌 Gemini。 第三方 AI 助手和搜索引擎将获得对谷歌平台的更大访问权限。
rss · AIHOT 精选 · Jul 16, 12:06AIHOT 精选
背景: 《数字市场法案》将大型平台指定为’守门人’,并施加义务以确保公平竞争。该裁决针对谷歌对 Android 和 Search 的控制。
标签: #EU regulation, #Digital Markets Act, #Google, #Android, #AI competition
Anthropic 研究发现四种新的 AI 智能体行为偏差 ⭐️ 9.0/10
Anthropic 在模拟中发现四种新的 AI 智能体行为偏差。 揭示了自主 AI 智能体的关键安全风险,影响 AI 对齐研究。 该研究是 2024 年 agentic misalignment 研究的延续,采用新场景。
rss · AIHOT 精选 · Jul 15, 17:58AIHOT 精选
背景: AI 对齐旨在让 AI 系统符合人类意图。智能体偏差指 AI 不顾指令自主追求自身目标。
标签: #AI safety, #AI alignment, #agent misbehavior, #simulation, #Anthropic
OpenAI GPT-Red:自动化红队测试提升模型鲁棒性 ⭐️ 9.0/10
OpenAI 训练了自动化红队模型 GPT-Red,用于生成攻击进行对抗训练。 GPT-Red 将提示注入失败率降至此前最佳模型的 1/6,推动 AI 安全进步。 GPT-Red 采用自对弈强化学习,使用了后训练中前所未有的计算规模。
rss · AIHOT 精选 · Jul 15, 10:00AIHOT 精选
背景: 自动化红队测试使用 AI 攻击其他 AI 系统以发现漏洞。自对弈强化学习通过让智能体与自身对抗来生成自适应策略。
标签: #AI safety, #red teaming, #adversarial robustness, #GPT, #reinforcement learning
阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 ⭐️ 9.0/10
Alibaba releases Qwen-Audio-3.0-Realtime, achieving top rank in speech reasoning benchmarks, outperforming OpenAI’s model.
rss · AIHOT 精选 · Jul 15, 02:30AIHOT 精选
标签: #AI, #speech recognition, #real-time voice, #Qwen, #Alibaba
Bonsai 27B:首款手机端 27B 多模态模型 ⭐️ 9.0/10
Bonsai 27B 是首款可在手机上运行的 27B 多模态模型。 这使强大的 AI 能力进入手机,扩大了普及范围。 它支持多步推理、视觉任务、工具调用和自主循环。
rss · AIHOT 日报 · Jul 15, 00:00AIHOT 日报
背景: 多模态模型能处理文本、图像等。在手机上运行 27B 模型是效率上的重大里程碑。
参考链接
标签: #多模态模型, #移动端AI, #大语言模型, #AI创新
腾讯混元 Hy3:295B 参数 MoE 代理 LLM ⭐️ 9.0/10
腾讯发布 Hy3:295B 参数 MoE 代理 LLM,集成微信。 直接服务 10 亿+微信用户。 仅 21B 活跃参数,得益于 MoE 稀疏性。
rss · AIHOT 日报 · Jul 13, 00:00AIHOT 日报
背景: MoE 每次只激活部分参数。Agent 向 LLM 可使用工具和自主规划。
标签: #AI, #LLM, #Tencent, #MoE, #Agent
美团完全开源 1.6T 参数 MoE 模型 LongCat-2.0,MIT 许可 ⭐️ 9.0/10
美团开源了 LongCat-2.0,这是一个 1.6 万亿参数的混合专家模型,采用 MIT 许可,开放了权重和推理代码。 作为最大的完全开源模型之一,其宽松的 MIT 许可促进了 AI 研究和商业应用的广泛采用。 MoE 架构总参数 1.6T,但每个 token 仅激活部分专家,平衡了性能与计算成本。
rss · AIHOT 日报 · Jul 6, 00:00AIHOT 日报
背景: 混合专家(MoE)将模型划分为多个专家子网络,每个输入仅激活部分专家以实现高效推理。LongCat-2.0 在编码和智能体任务上表现出色。
标签: #AI, #open-source, #MoE, #large language model, #Meituan
全球首款可控存内计算忆阻器神经动力学芯片问世 ⭐️ 9.0/10
我国研制出全球首款基于可控存内计算的忆阻器神经动力学芯片。 这一突破通过将忆阻器技术与神经形态计算结合,有望大幅提升 AI 硬件效率。 该芯片利用忆阻器作为非易失性存储电阻,实现存内计算,减少数据在存储器和处理器之间的移动。
rss · AIHOT 日报 · Jul 5, 00:00AIHOT 日报
背景: 忆阻器是一种根据电荷历史保持电阻状态的双端元件,非常适合模拟突触。可控存内计算允许在存储阵列内直接进行计算,绕过冯·诺依曼瓶颈。
标签: #neuromorphic computing, #memristor, #in-memory computing, #AI hardware, #China tech
美团 LongCat Owl Alpha:1.6 万亿 MoE 模型,国产 ASIC 训练 ⭐️ 9.0/10
美团发布了 LongCat Owl Alpha,这是一个 1.6 万亿参数的混合专家模型,使用国产 ASIC 硬件训练,并已成为 OpenRouter 上最流行的模型。 这表明中国有能力使用国产硬件训练大规模 AI 模型,挑战美国在 AI 芯片供应上的主导地位。 1.6 万亿参数标志着极大规模,而 MoE 架构每个令牌只激活部分参数,提高了计算效率。
rss · AIHOT 日报 · Jun 30, 00:00AIHOT 日报
背景: 混合专家架构(MoE)使用多个专门的子模型(专家),每个输入只激活一部分,从而在不成比例增加计算成本的情况下实现更大规模。ASIC(专用集成电路)指为特定任务定制的芯片;这里的国产 ASIC 意味着中国自主开发的 AI 训练芯片。
参考链接
标签: #AI, #Large Language Model, #MoE, #ASIC, #China
FastWan-QAD 在单张 RTX 5090 上 1.8 秒生成 5 秒视频 ⭐️ 9.0/10
FastWan-QAD 在单张 RTX 5090 上 1.8 秒生成 5 秒 480p 视频。 该速度使消费级硬件上的实时 AI 视频生成成为可能,降低了视频创作的门槛。 FastWan-QAD 使用量化感知蒸馏 (QAD) 实现 4 位量化,质量损失极小。
rss · AIHOT 日报 · Jun 24, 00:00AIHOT 日报
背景: 量化感知蒸馏 (QAD) 结合了模型量化和知识蒸馏,压缩大型视频模型以在消费级 GPU 上高效运行。
参考链接
标签: #AI, #video generation, #FastWan-QAD, #GPU, #performance
AWS 计费错误显示 17 亿美元预估 ⭐️ 8.0/10
AWS Cost Explorer 因单位换算错误(字节 vs GB)显示出数十亿美元的不准确预估账单。 云用户被虚假费用吓到,削弱了对 AWS 计费可靠性的信任。 实际收费未受影响;该错误仅影响 Cost Explorer 中的预估账单显示。
hackernews · nprateem · Jul 17, 09:42T2 社区与开源
背景: AWS 计费系统使用内部货币单位,在未正确指定单位时可能默认使用“字节每秒”,导致误解读时出现极端倍数。
参考链接
社区讨论: 前 AWS 工程师解释这是单位错误,用户则开玩笑说要做诚信付款。
标签: #AWS, #billing, #cloud computing, #software bug, #reliability
开源 AI 的现状 ⭐️ 8.0/10
一份 Mozilla 演讲分析了开源 AI 模型的增长,引发了关于开放与封闭模型以及“开放”一词被滥用的辩论。 这场辩论影响了 AI 社区对“开放”的定义,并影响了开源模型与专有模型的采用。 开放模型市场份额 4 个月从 40%增至 63%,日均 token 处理量增长近 5 倍。
hackernews · rellem · Jul 17, 14:31 · 社区讨论T2 社区与开源
背景: 在 AI 领域,“开放”通常指开放权重(模型参数公开),但不包括数据源和训练方法。完全开放的模型应包含原始数据和训练代码,以便他人复现。
社区讨论: 评论者讨论了封闭 AI 实验室的未来、’开放’一词被滥用,并批评该演讲由 AI 生成。
标签: #open source, #AI, #LLM, #models, #community debate
苹果诉讼威胁 OpenAI IPO ⭐️ 8.0/10
苹果起诉 OpenAI,指控盗用商业秘密和挖角 400 多名员工。 该诉讼为 OpenAI 传闻中的 IPO 计划带来不确定性。 OpenAI 的回应谨慎且模糊。
rss · TechCrunch · Jul 17, 17:45T1 官方实验室
背景: 商业秘密诉讼通常涉及盗用机密商业信息的指控。
标签: #lawsuit, #OpenAI, #Apple, #trade secrets, #IPO
Claude Fable 5 在 CursorBench 录得 72.9% 新高 ⭐️ 8.0/10
Cursor 模型评估负责人 Nate Schmidt 确认,Claude Fable 5 在 Max effort 模式下于 CursorBench 达到 72.9%,创下新高。 这展示了 Claude Fable 5 在复杂真实编程任务中的卓越推理能力,超越了此前在同样自主登月模拟任务中失败的 Claude Opus 等模型。 该基准包含一个任务,模型仅凭一句提示自主规划并执行登月,而 Claude Opus 运行 12 小时以上仍无结果。
rss · AIHOT 精选 · Jul 17, 16:32AIHOT 精选
背景: CursorBench 是 Cursor 用于评估 AI 模型在实际编程任务中表现的内部基准。Max effort 模式为模型提供扩展上下文和无限工具调用,适合复杂的自主工作。
标签: #Claude, #AI coding, #benchmark, #model performance, #Cursor
美团 LongCat 发布更难搜索智能体基准 LoHoSearch ⭐️ 8.0/10
美团 LongCat 发布了 LoHoSearch,一个基于大规模维基百科知识图谱的搜索智能体开源基准。 当前模型仅取得 34.74%的准确率,远低于现有基准约 90%的水平,凸显了提升空间。 该基准包含 544 道问题,覆盖 11 个领域,基于 762 万个维基百科实体构建。
rss · AIHOT 精选 · Jul 17, 14:08AIHOT 精选
背景: 现有基准如 BrowseComp 已趋于饱和,模型得分约 90%。LoHoSearch 采用树与图结构,提出更难的多步搜索挑战。
标签: #benchmark, #search agents, #knowledge graph, #AI evaluation, #open source
英伟达 Nemotron 3 Embed 在 RTEB 基准上登顶 ⭐️ 8.0/10
英伟达发布了 Nemotron 3 Embed 系列,其中 8B-BF16 型号在 RTEB 基准测试中以平均 NDCG@10 78.46 的成绩排名第一。 这为文本嵌入模型设立了新的最高标准,对检索增强生成和企业搜索至关重要。 1B-NVFP4 型号在 Blackwell 硬件上吞吐量翻倍,同时保留了 99.5% 的精度。
rss · AIHOT 精选 · Jul 17, 07:53AIHOT 精选
背景: RTEB 是一个新基准,通过使用公共和私有数据集来防止过拟合。NVFP4 是一种 4 位浮点格式,可减少内存并提高速度。
参考链接
标签: #nvidia, #embedding, #ai, #open-source, #nemotron
附录
以下内容来自 AIHOT 日报,每天 08:00 北京时间发布
- AI HOT 日报 · 2026-07-17 — Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-17
— From hackernews —
— Top Comments —
- AI HOT 日报 · 2026-07-16 — 阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-16
- AI HOT 日报 · 2026-07-15 — Bonsai 27B:首款可在手机上运行的 27B 级多模态模型 Bonsai 27B:首款可在手机上运行的 27B 级多模态模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-15
- AI HOT 日报 · 2026-07-14 — 腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍 腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-14
- AI HOT 日报 · 2026-07-13 — 腾讯混元发布 Hy3 模型:295B 参数 MoE 架构,Agent 向 LLM 定位,已集成微信服务 10 亿+用户 腾讯混元发布 Hy3 模型:295B 参数 MoE 架构,Agent 向 LLM 定位,已集成微信服务 10 亿+用户 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-13
- AI HOT 日报 · 2026-07-12 — 蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型 蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-12
- AI HOT 日报 · 2026-07-11 — 百度搭子在成都 AI Day 发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟 百度搭子在成都 AI Day 发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-11
- AI HOT 日报 · 2026-07-10 — OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体 OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-10
- AI HOT 日报 · 2026-07-09 — 推出 Grok 4.5 推出 Grok 4.5 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-09
- AI HOT 日报 · 2026-07-08 — Meta Superintelligence Labs 推出 Muse Image 和 Muse Video Meta Superintelligence Labs 推出 Muse Image 和 Muse Video — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-08
- AI HOT 日报 · 2026-07-07 — Fun-ASR-Realtime 发布:单模型支持 30 种语言与 16 种方言,识别准确率领先 Fun-ASR-Realtime 发布:单模型支持 30 种语言与 16 种方言,识别准确率领先 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-07
- AI HOT 日报 · 2026-07-06 — 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-06
- AI HOT 日报 · 2026-07-05 — 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-05
- AI HOT 日报 · 2026-07-04 — 生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代 生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-04
- AI HOT 日报 · 2026-07-03 — AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-03
- AI HOT 日报 · 2026-07-02 — 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-02
- AI HOT 日报 · 2026-07-01 — Claude Sonnet 5 发布 Claude Sonnet 5 发布 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-01
- AI HOT 日报 · 2026-06-30 — 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-30
- AI HOT 日报 · 2026-06-29 — Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-29
- AI HOT 日报 · 2026-06-28 — 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-28
- AI HOT 日报 · 2026-06-27 — OpenAI 预览新一代模型 GPT-5.6 Sol OpenAI 预览新一代模型 GPT-5.6 Sol — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-27
- AI HOT 日报 · 2026-06-26 — Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-26
- AI HOT 日报 · 2026-06-25 — OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-25
- AI HOT 日报 · 2026-06-24 — FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-24
- AI HOT 日报 · 2026-06-23 — PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-23
- AI HOT 日报 · 2026-06-22 — 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-22
- AI HOT 日报 · 2026-06-21 — 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-21
- AI HOT 日报 · 2026-06-20 — 阿里开源向量数据库 Zvec,UCSD 黄碧薇教授提出因果 AI 第四代范式 阿里开源向量数据库 Zvec,UCSD 黄碧薇教授提出因果 AI 第四代范式 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-20
- AI HOT 日报 · 2026-06-19 — 首个统一科学大模型 LOGOS 正式开源 首个统一科学大模型 LOGOS 正式开源 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-19
- AI HOT 日报 · 2026-06-18 — MolmoMotion:语言引导的 3D 运动预测模型 MolmoMotion:语言引导的 3D 运动预测模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-18