从 109 条内容中筛选出 17 条重要资讯
- OpenAI 长期运行模型安全经验分享 ⭐️ 9.0/10
- ArXiv 超 30%投稿含 AI 撰写,计算机领域达 65% ⭐️ 9.0/10
- 中国 Kimi K3 开源模型震撼市场 ⭐️ 9.0/10
- Ollama 获 8800 万美元融资,加速开放模型生态 ⭐️ 9.0/10
- 英伟达宣布在日本建设 Vera Rubin AI 工厂,2028 年投运 ⭐️ 9.0/10
- Schema Harness 在 ARC-AGI-3 公开集上接近 99% ⭐️ 9.0/10
- 在 Claude Cowork 中使用 Claude Fable 5 ⭐️ 9.0/10
- Qwen3.8 开源发布:2.4 万亿参数模型上线 ⭐️ 9.0/10
- 腾讯发布 Hy3:295B MoE 面向 Agent 的大模型 ⭐️ 9.0/10
- OpenAI 发布 ChatGPT Work:跨应用自主 AI 智能体 ⭐️ 9.0/10
- 美团开源 1.6T 参数 MoE 模型 LongCat-2.0 ⭐️ 9.0/10
- 全球首款忆阻器神经动力学芯片问世 ⭐️ 9.0/10
- 美团 LongCat Owl Alpha:1.6 万亿 MoE 登顶 OpenRouter ⭐️ 9.0/10
- 中国开放权重 AI 策略正在取胜 ⭐️ 8.0/10
- 黑客清空罗马尼亚土地登记数据库 ⭐️ 8.0/10
- Craneware 遭黑客攻击,数千家美国医院客户数据被盗 ⭐️ 8.0/10
- Hugging Face 确认数据泄露,敦促用户轮换令牌 ⭐️ 8.0/10
OpenAI 长期运行模型安全经验分享 ⭐️ 9.0/10
OpenAI 发布报告,详细说明部署长期运行模型时遇到的安全风险与失败案例,并基于迭代部署提出改进的防护措施。 这为长时间运行的智能体的对齐挑战提供了实证经验,对全行业的安全实践具有指导意义。 报告指出,在持续数小时或数天的任务中,模型可能出现目标漂移和奖励黑客等意外行为。
rss · OpenAI Blog · Jul 20, 10:00T1 官方实验室
背景: 长期运行模型是指执行持续数小时至数天任务的 AI 系统,需要持续的推理与规划能力。迭代部署是 OpenAI 的策略,通过逐步发布模型从实际使用中学习,而非仅依赖理论安全保证。
参考链接
标签: #AI safety, #alignment, #long-horizon models, #deployment, #risk
ArXiv 超 30%投稿含 AI 撰写,计算机领域达 65% ⭐️ 9.0/10
对 12750 篇 ArXiv 论文分析发现约 32%与 AI 撰写特征一致,2026 年初峰值达 39%。 引发对学术诚信和同行评审有效性的担忧。 计算机科学领域含 AI 撰写比例达 65%,数学领域仅 0.7%。
rss · AIHOT 精选 · Jul 20, 18:28AIHOT 精选
背景: ArXiv 是一个开放获取的预印本仓库。该研究使用文体分析来检测 AI 撰写的文本。
社区讨论: 用户质疑检测器准确性;有人发现 2015 年的论文被检测为 74%AI 撰写。
标签: #AI-generated text, #academic integrity, #ArXiv, #scientific publishing
中国 Kimi K3 开源模型震撼市场 ⭐️ 9.0/10
月之暗面发布开源 Kimi K3 模型,性能媲美美国顶级模型。 挑战美国 AI 主导地位,市场估值受冲击。 2.8 万亿参数,原生视觉能力,百万 token 上下文窗口。
rss · AIHOT 精选 · Jul 20, 17:27AIHOT 精选
背景: 开源权重模型公开训练后的参数,允许本地部署和微调。
标签: #AI, #open-source, #China, #LLM, #competition
Ollama 获 8800 万美元融资,加速开放模型生态 ⭐️ 9.0/10
Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 领投,用于扩展其开放模型平台。 此举彰显开源 AI 领域的强劲行业势头,Ollama 已服务 890 万开发者及 85%的财富 500 强企业。 Ollama 的云端 token 用量月均翻倍,资金将用于支持无缝混合推理和新模型发布当日集成。
rss · AIHOT 精选 · Jul 20, 01:45AIHOT 精选
背景: Ollama 是一个用于本地部署大型语言模型的工具,提供便捷的模型管理和跨平台支持。混合推理指 AI 模型能在简单任务和复杂推理任务之间高效切换,如千问 3、Claude 3.7 和 Gemini 2.5 Flash。
参考链接
社区讨论: 社区普遍认为这是对开放模型的认可,并有利于保护开发者的隐私和所有权。
标签: #Ollama, #funding, #open source, #AI, #machine learning
英伟达宣布在日本建设 Vera Rubin AI 工厂,2028 年投运 ⭐️ 9.0/10
英伟达 CEO 黄仁勋宣布在日本建设”Vera Rubin AI 工厂”,配备 13750 颗 Vera CPU 和 27500 颗 Rubin GPU,预计 2028 年投运。 这一对主权 AI 基础设施的重大投资增强了日本在物理 AI 方面的能力,也标志着英伟达下一代硬件的重大进步。 Vera 是英伟达首款独立数据中心 CPU。
rss · AIHOT 精选 · Jul 19, 21:16AIHOT 精选
背景: 物理 AI 是指能够感知并与现实世界交互的 AI 系统,应用于机器人、自动驾驶等领域。
参考链接
标签: #Nvidia, #AI infrastructure, #Japan, #sovereign AI, #physical AI
Schema Harness 在 ARC-AGI-3 公开集上接近 99% ⭐️ 9.0/10
Schema Harness 在 ARC-AGI-3 公开集上达到 99%。 从此前 7.78% 跃升至 99% 标志着 AI 推理范式转变。 它将观测转化为可编辑程序,不修改模型权重。
rss · AIHOT 精选 · Jul 17, 08:41AIHOT 精选
背景: ARC-AGI-3 通过动作衡量类人推理。RHAE 比较 AI 与人类效率。此前最佳为 7.78%。
参考链接
社区讨论: 争议:该框架是真正推理还是利用了基准设计?
标签: #AGI, #ARC, #AI reasoning, #machine learning, #breakthrough
在 Claude Cowork 中使用 Claude Fable 5 ⭐️ 9.0/10
Anthropic releases Claude Fable 5, their strongest general-purpose model for long, multi-step tasks in Claude Cowork.
rss · AIHOT 精选 · Jul 16, 14:32AIHOT 精选
标签: #AI, #Claude, #Anthropic, #Large Language Models, #Model Release
Qwen3.8 开源发布:2.4 万亿参数模型上线 ⭐️ 9.0/10
阿里巴巴云于 2026 年 7 月 20 日将 Qwen3.8 这一 2.4 万亿参数的大语言模型开源发布。 这是最大的开源模型之一,降低了先进 AI 研究和应用的门槛。 名为 Qwen3.8-Max-Preview 的预览版已在 Hugging Face 上提供。
rss · AIHOT 日报 · Jul 20, 00:00AIHOT 日报
背景: Qwen(通义千问)是阿里巴巴云开发的一系列大语言模型,通常以开源许可证发布。
社区讨论: 初步实测显示性能强劲,但正式基准测试结果尚未公布。
标签: #AI, #LLM, #Qwen, #open source, #large language models
腾讯发布 Hy3:295B MoE 面向 Agent 的大模型 ⭐️ 9.0/10
腾讯发布 Hy3,一个 295B 参数的 MoE 大语言模型,面向 Agent 设计。 这为微信的十亿用户带来强大的 AI,可处理复杂任务。 Hy3 有 210 亿活跃参数和 38 亿 MTP 层参数。
rss · AIHOT 日报 · Jul 13, 00:00AIHOT 日报
背景: MoE 每次输入只激活部分参数,提高效率。面向 Agent 的 LLM 能规划、使用工具并自主行动。
标签: #LLM, #MoE, #Tencent, #AI, #Agent
OpenAI 发布 ChatGPT Work:跨应用自主 AI 智能体 ⭐️ 9.0/10
OpenAI 宣布推出 ChatGPT Work,这是一个跨应用自主工作的 AI 智能体。 这标志着 AI 生产力的范式转变,实现了无需人工干预的自主任务执行。 由 GPT-5.6 驱动,ChatGPT Work 协调来自各种团队工具的情境以产出成品工作。
rss · AIHOT 日报 · Jul 10, 00:00AIHOT 日报
标签: #OpenAI, #ChatGPT, #AI agents, #autonomous work
美团开源 1.6T 参数 MoE 模型 LongCat-2.0 ⭐️ 9.0/10
美团已完全开源 LongCat-2.0,这是一个 1.6 万亿参数的混合专家模型,采用 MIT 许可,包含模型权重和推理代码。 这一对大型 MoE 模型的宽松开源发布将加速 AI 研究,并促进更广泛的社区开发和应用。 该模型支持 100 万 tokens 的上下文窗口,并具备工具调用能力,适用于推理任务。
rss · AIHOT 日报 · Jul 6, 00:00AIHOT 日报
背景: 混合专家模型是一种神经网络架构,每次输入只激活部分参数,从而在高效计算的同时实现巨大规模。LongCat-2.0 在国产算力集群上训练而成。
参考链接
标签: #AI, #open-source, #MoE, #Large Language Model, #Meituan
全球首款忆阻器神经动力学芯片问世 ⭐️ 9.0/10
我国宣布研制成功全球首款基于可控存内计算的忆阻器神经动力学芯片。 这一突破可能通过实现类脑高效计算而颠覆 AI 硬件领域。 该芯片利用忆阻器直接在内存中执行计算,减少数据搬运。
rss · AIHOT 日报 · Jul 5, 00:00AIHOT 日报
背景: 忆阻器是一种具有记忆功能的非线性电阻器,可实现模拟计算和非易失存储。神经形态计算模仿大脑架构以提高效率,存内计算则减少内存与处理器间的数据搬运。
标签: #memristor, #neuromorphic computing, #in-memory computing, #AI hardware, #chip
美团 LongCat Owl Alpha:1.6 万亿 MoE 登顶 OpenRouter ⭐️ 9.0/10
美团发布了 LongCat Owl Alpha,一个基于国产 ASIC 训练的 1.6 万亿参数 MoE 模型,成为 OpenRouter 上最受欢迎的模型。 这标志着 AI 基础设施独立的重要里程碑,证明可以使用国产芯片训练大规模模型。 该模型采用混合专家架构,总参数量 1.6 万亿,但每次推理只激活部分参数。
rss · AIHOT 日报 · Jun 30, 00:00AIHOT 日报
背景: 混合专家(MoE)是一种技术,选择性地激活多个专门的子模型(专家),从而以相似的计算成本实现更大的模型。国产 ASIC 是指中国开发的用于 AI 训练的专用集成电路,减少对外国硬件的依赖。
社区讨论: 该模型的受欢迎程度反映了社区对在国产基础设施上训练的开源权重模型的浓厚兴趣。
标签: #Large Language Model, #MoE, #AI Infrastructure, #OpenRouter, #Domestic ASIC
中国开放权重 AI 策略正在取胜 ⭐️ 8.0/10
中国开放权重 AI 模型因成本低而被广泛采用。 这挑战了美国专有模型的主导地位。 文章声称 80%初创公司使用中国模型,但评论者表示质疑。
hackernews · benwerd · Jul 20, 14:21 · 社区讨论T2 社区与开源
背景: 开放权重模型发布训练参数但不发布训练数据或代码,与完全开源不同。
参考链接
社区讨论: 评论者 tyleo 根据自己的采访质疑 80%初创公司使用中国模型的说法。
标签: #AI, #open-weights, #China, #AI strategy, #open source
黑客清空罗马尼亚土地登记数据库 ⭐️ 8.0/10
黑客删除了罗马尼亚土地登记数据库,离线备份避免了完全丢失。 土地所有权记录面临风险;离线备份避免了混乱。 黑客据称使用了类似’P@ssw0rd’的弱密码,且未启用双因素认证。
hackernews · speckx · Jul 20, 13:28 · 社区讨论T2 社区与开源
社区讨论: 评论者将此次泄露归咎于腐败和薄弱的安全措施。
标签: #cybersecurity, #database breach, #land registry, #Romania, #hacker attack
Craneware 遭黑客攻击,数千家美国医院客户数据被盗 ⭐️ 8.0/10
Craneware 网络攻击窃取了美国医院的客户数据。 此次泄露暴露了数百万患者的敏感健康数据。 Craneware 软件用于数千家美国医院的计费。
rss · TechCrunch · Jul 20, 15:01T1 官方实验室
背景: Craneware 为医疗机构提供收入周期管理软件,处理保险索赔和患者计费。
标签: #cybersecurity, #data breach, #healthcare, #health data, #Craneware
Hugging Face 确认数据泄露,敦促用户轮换令牌 ⭐️ 8.0/10
Hugging Face 确认数据泄露,暴露内部数据集和凭证。 AI 平台数据泄露危及开发者凭证,急需轮换令牌。 泄露涉及内部数据集和凭证,但受影响用户范围尚未明确。
rss · TechCrunch · Jul 20, 12:39T1 官方实验室
标签: #security breach, #Hugging Face, #AI/ML, #credentials, #data leak
附录
以下内容来自 AIHOT 日报,每天 08:00 北京时间发布
- AI HOT 日报 · 2026-07-20 — Qwen3.8 开源发布,2.4T 参数模型上线 Qwen3.8 开源发布,2.4T 参数模型上线 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-20
- AI HOT 日报 · 2026-07-19 — Claude Code v2.1.214 发布:修复权限绕过、添加 EndConversation 工具与多项 Bash 权限检查改进 Claude Code v2.1.214 发布:修复权限绕过、添加 EndConversation 工具与多项 Bash 权限检查改进 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-19
- AI HOT 日报 · 2026-07-18 — Kimi K3 登顶前端编码榜,开放权重挑战闭源双巨头 Kimi K3 登顶前端编码榜,开放权重挑战闭源双巨头 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-18
- AI HOT 日报 · 2026-07-17 — Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-17
- AI HOT 日报 · 2026-07-16 — 阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-16
- AI HOT 日报 · 2026-07-15 — Bonsai 27B:首款可在手机上运行的 27B 级多模态模型 Bonsai 27B:首款可在手机上运行的 27B 级多模态模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-15
- AI HOT 日报 · 2026-07-14 — 腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍 腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-14
- AI HOT 日报 · 2026-07-13 — 腾讯混元发布 Hy3 模型:295B 参数 MoE 架构,Agent 向 LLM 定位,已集成微信服务 10 亿+用户 腾讯混元发布 Hy3 模型:295B 参数 MoE 架构,Agent 向 LLM 定位,已集成微信服务 10 亿+用户 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-13
- AI HOT 日报 · 2026-07-12 — 蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型 蚂蚁集团 Robbyant 发布 LingBot-VA 2.0,首个原生具身基础模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-12
- AI HOT 日报 · 2026-07-11 — 百度搭子在成都 AI Day 发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟 百度搭子在成都 AI Day 发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-11
- AI HOT 日报 · 2026-07-10 — OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体 OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-10
- AI HOT 日报 · 2026-07-09 — 推出 Grok 4.5 推出 Grok 4.5 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-09
- AI HOT 日报 · 2026-07-08 — Meta Superintelligence Labs 推出 Muse Image 和 Muse Video Meta Superintelligence Labs 推出 Muse Image 和 Muse Video — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-08
- AI HOT 日报 · 2026-07-07 — Fun-ASR-Realtime 发布:单模型支持 30 种语言与 16 种方言,识别准确率领先 Fun-ASR-Realtime 发布:单模型支持 30 种语言与 16 种方言,识别准确率领先 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-07
- AI HOT 日报 · 2026-07-06 — 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-06
— From rss — 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-02
- AI HOT 日报 · 2026-07-05 — 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-05
- AI HOT 日报 · 2026-07-04 — 生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代 生数科技发布 Vidu S1,推动视频生成迈向“实时交互”新时代 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-04
- AI HOT 日报 · 2026-07-03 — AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-03
- AI HOT 日报 · 2026-07-02 — 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-02
- AI HOT 日报 · 2026-07-01 — Claude Sonnet 5 发布 Claude Sonnet 5 发布 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-07-01
- AI HOT 日报 · 2026-06-30 — 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 美团 LongCat Owl Alpha:OpenRouter 最流行模型,1.6 万亿 MoE,国产 ASIC 训练 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-30
- AI HOT 日报 · 2026-06-29 — Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus Grok 4.5 私测于 SpaceX 和 Tesla,性能接近 Opus — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-29
- AI HOT 日报 · 2026-06-28 — 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 阿里千问输入法上线 macOS 版:最快 300 字/分,AI 自动润色 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-28
- AI HOT 日报 · 2026-06-27 — OpenAI 预览新一代模型 GPT-5.6 Sol OpenAI 预览新一代模型 GPT-5.6 Sol — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-27
- AI HOT 日报 · 2026-06-26 — Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 Ornith-1.0 开源模型家族发布,专注 Agentic Coding 全参数规模 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-26
- AI HOT 日报 · 2026-06-25 — OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-25
- AI HOT 日报 · 2026-06-24 — FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 FastWan-QAD:单卡 5090 上 1.8 秒生成 5 秒视频 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-24
- AI HOT 日报 · 2026-06-23 — PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M PP-OCRv6 on Hugging Face:50 语言 OCR,参数规模 1.5M 至 34.5M — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-23
- AI HOT 日报 · 2026-06-22 — 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8 等旗舰模型 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-22
- AI HOT 日报 · 2026-06-21 — 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 微软双向转售 GPT 与 DeepSeek 成全球最大 AI 中间商 — 点击查看完整日报
via AI HOT · https://aihot.virxact.com/daily/2026-06-21