从 124 条内容中筛选出 18 条重要资讯
- Qwen3.8-2.4T-A95B:开源 MoE 巨兽发布 ⭐️ 9.0/10
- Putting sign language AI into users’ hands ⭐️ 9.0/10
- OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧 ⭐️ 9.0/10
- tl;dv 逾 18.1 万段 AI 会议录音被公开暴露,可实时闯入他人通话 ⭐️ 9.0/10
- Anthropic 发布 Claude Opus 5 ⭐️ 9.0/10
- 小红书 dots 模型满分夺金 IMO 2026 ⭐️ 9.0/10
- Kimi K3 发布:2.8T 参数开源模型,原生视觉与百万上下文 ⭐️ 9.0/10
- DeepSeek V4 Pro 0813 登陆 OpenRouter ⭐️ 8.0/10
- Tailscale Traces Database Corruption to 16y/o SQLite WAL-Reset Bug ⭐️ 8.0/10
- Grok 4.6 在 Artificial Analysis 智能指数上获 61 分 ⭐️ 8.0/10
- 为什么 Chrome 中的小 JPEG 图像看起来不同 ⭐️ 8.0/10
- Grok 4.6 发布,引发 API 与基准测试争议 ⭐️ 8.0/10
- 车牌识别数据搜索须持搜查令 ⭐️ 8.0/10
- AI 正在淘汰软件工程的中层吗? ⭐️ 8.0/10
- uBlock Origin 放弃屏蔽 Facebook 广告 ⭐️ 8.0/10
- Amazon will train on Twitch streamers’ content by default, unless they opt out ⭐️ 8.0/10
- Form Energy 融资 7.5 亿美元扩产 100 小时电网电池 ⭐️ 8.0/10
- Lovable 估值 133 亿美元,再筹 4 亿美元 ⭐️ 8.0/10
Qwen3.8-2.4T-A95B:开源 MoE 巨兽发布 ⭐️ 9.0/10
Qwen 发布了 Qwen3.8-2.4T-A95B,一个 2.4 万亿参数的开源 MoE 模型,激活参数 950 亿,提供 BF16 和 FP8 版本。 这款开源权重模型可与顶级专有 LLM 匹敌,将前沿性能带入开源生态,但数 TB 的规模限制了本地部署。 仅发布 BF16 和 FP8 权重,没有官方 INT4 QAT,社区量化是实际部署的关键。
hackernews · Philpax · Aug 12, 15:01 · 社区讨论T2 社区与开源
背景: MoE(混合专家)架构每个 token 只激活部分参数,从而以较低算力支持超大总参数量。FP8 是一种 8 位浮点精度,相比 BF16 等 16 位格式可减少内存占用。
参考链接
社区讨论: 用户指出,397GB 的 1-bit 量化版可在高端消费硬件上带来顶级性能,而 4.9TB 的 BF16 版对多数人不实用。
标签: #LLM, #Qwen, #MoE, #open-source, #AI
Putting sign language AI into users’ hands ⭐️ 9.0/10
DeepMind announces sign-language-to-text (SL2T), a breakthrough AI model powering new sign language features for Deaf and hard of hearing users.
rss · DeepMind Blog · Aug 12, 14:01T1 官方实验室
标签: #AI, #sign language, #accessibility, #machine learning, #DeepMind
OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧 ⭐️ 9.0/10
OpenAI’s Astra model solves 10 long-standing math problems, publishing a 250+ page paper with Lean-verified results.
rss · AIHOT 精选 · Aug 11, 11:00AIHOT 精选
标签: #AI, #Mathematics, #OpenAI, #Lean, #Research
tl;dv 逾 18.1 万段 AI 会议录音被公开暴露,可实时闯入他人通话 ⭐️ 9.0/10
AI meeting platform tl;dv exposed 181k recordings due to missing tenant isolation, allowing authenticated users to access all data and even join live meetings.
rss · AIHOT 精选 · Aug 10, 14:03AIHOT 精选
标签: #security, #vulnerability, #AI-meeting, #data-breach, #privacy
Anthropic 发布 Claude Opus 5 ⭐️ 9.0/10
Anthropic 于 2026 年 7 月 25 日发布最新旗舰 AI 模型 Claude Opus 5,该消息出现在 AIHOT 日报中。 此次发布是广泛使用的 AI 模型系列的一次重大升级,直接影响基于 Claude 开发应用的开发者和企业。 该日报条目未提供新模型的任何具体技术规格或基准测试结果。
rss · AIHOT 日报 · Jul 25, 00:00AIHOT 日报
背景: Claude Opus 是 Anthropic 旗下 Claude 模型系列中的旗舰层级,通常定位为处理复杂推理和编程任务时能力最强的版本。新版延续了这一产品线,但日报中尚未公布具体的性能细节。
标签: #Anthropic, #Claude, #AI model, #release
小红书 dots 模型满分夺金 IMO 2026 ⭐️ 9.0/10
小红书 dots-note 3.0 在 2026 年国际数学奥林匹克竞赛中取得 42/42 满分,据报道获得金牌。 AI 在 IMO 中取得满分,标志着数学推理能力的重大飞跃,逼近人类顶尖水平。这项突破可能加速 AI 在科学与教育领域的应用。 该满分成绩尚未经独立验证;dots .llm1 是小红书开源模型,参数为 142B,其中 14B 处于激活状态。
rss · AIHOT 日报 · Jul 22, 00:00AIHOT 日报
背景: IMO 是国际数学奥林匹克竞赛,面向中学生的顶级数学赛事。小红书(RedNote)近期开源了 dots .llm1,这是一个 142B 参数(14B 激活)的 MoE 模型,dots 因此成为备受关注的 AI 模型系列。
参考链接
社区讨论: 这一声明引发质疑,许多人指出缺乏官方证明,呼吁对 42/42 的成绩进行独立验证。
标签: #AI, #IMO, #mathematical reasoning, #breakthrough
Kimi K3 发布:2.8T 参数开源模型,原生视觉与百万上下文 ⭐️ 9.0/10
月之暗面发布了 Kimi K3,这是一个 2.8T 参数的开源模型,具备原生视觉和 100 万 token 的上下文窗口。 开源 2.8T 参数模型提升了开放权重 AI 的上限,让更复杂的长期编码和知识工作成为可能。 K3 基于 Kimi Delta Attention 和 Attention Residuals 构建,其 API 平台还提供 K2.7 Code 和 K2.6 等模型。
rss · AIHOT 日报 · Jul 17, 03:32AIHOT 日报
背景: 月之暗面是一家中国 AI 公司。其开放权重模型 Kimi K2 于 2025 年 7 月发布,Kimi K3 于 2026 年 7 月发布。
标签: #AI, #Large Language Models, #Open Source, #Model Release
DeepSeek V4 Pro 0813 登陆 OpenRouter ⭐️ 8.0/10
DeepSeek V4 Pro 0813 已在 OpenRouter 发布,价格更低。 以约 20 倍更低的成本提供接近旗舰级的 AI 性能。 社区测试花费 $0.12,而 Grok 4.6 为 $1.41,但结果存在缺陷。
hackernews · explosion-s · Aug 12, 16:04 · 社区讨论T2 社区与开源
背景: DeepSeek 是一家中国开源权重 AI 实验室,其模型强调效率与低成本。OpenRouter 是一个统一 API,可路由访问多种大语言模型。
社区讨论: 评价不一:常规任务表现不错,但一位用户在仓库扫描任务中发现缺陷,而 gpt-5.6-terra-high 则没有问题。
标签: #AI, #LLM, #DeepSeek, #benchmarks, #model release
Tailscale Traces Database Corruption to 16y/o SQLite WAL-Reset Bug ⭐️ 8.0/10
Tailscale details how they tracked down a 16-year-old SQLite WAL-reset bug, funded an open-source VFS shim to isolate the race condition, and resolved a subtle corruption issue in their control plane.
hackernews · ropbear · Aug 12, 14:22 · 社区讨论T2 社区与开源
标签: #sqlite, #tailscale, #debugging, #open-source, #database-bug
Grok 4.6 在 Artificial Analysis 智能指数上获 61 分 ⭐️ 8.0/10
Grok 4.6 在 Artificial Analysis 智能指数(一项面向前沿 AI 模型的综合基准)上获得 61 分。 这一分数使 Grok 4.6 跻身顶尖前沿模型之列,加剧了 AI 领域的竞争,也拓宽了开发者的选择。 Artificial Analysis 智能指数 v4.1.1 结合了 Terminal-Bench v2.1、SciCode 和 Humanity’s Last Exam 等基准测试。
hackernews · wertyk · Aug 12, 16:54 · 社区讨论T2 社区与开源
背景: Artificial Analysis 智能指数是一个综合评分,衡量模型在推理、编程、知识和多步骤任务等方面的能力。它为比较前沿模型提供了统一的尺度。
参考链接
社区讨论: 评论区对结果看法不一:有人询问欧盟对 Grok 的调查,也有人认为这证明 Gemini 等竞争对手也能达到前沿水平。
标签: #AI, #Grok, #LLM, #benchmarks, #Artificial Analysis
为什么 Chrome 中的小 JPEG 图像看起来不同 ⭐️ 8.0/10
Chrome 的部分 IDCT 解码使小 JPEG 图像在缩放时呈现不同效果。 Web 开发者在用图标等小图像时,须考虑浏览器的缩放差异。 仅使用左上角 2x2 或 4x4 低频系数即可获得 1/4 或 1/2 的缩小比例。
hackernews · gutechh · Aug 12, 14:00 · 社区讨论T2 社区与开源
背景: JPEG 解码使用逆离散余弦变换(IDCT)将频率系数转换为像素。Chrome 的优化会跳过高频系数以加速缩小,从而改变图像外观。
社区讨论: 评论者指出该技术可推广到其他缩放比例,且类似问题也影响 PNG 图标;Firefox 也在研究低尺度解压。
标签: #JPEG, #browser, #image-decoding, #web-performance, #Chrome
Grok 4.6 发布,引发 API 与基准测试争议 ⭐️ 8.0/10
xAI 发布了最新前沿模型 Grok 4.6,引发社区对其默认 API 系统提示和性能声明的讨论。 此次发布标志着 xAI 在前沿 AI 竞赛中的竞争力增强,影响开发者与行业格局。 API 会注入默认系统提示,且优先级高于用户指令,有时导致模型拒绝讨论提示内容。
hackernews · iLuddite · Aug 12, 15:32 · 社区讨论T2 社区与开源
背景: 前沿模型是某一时期最先进的 AI 模型,基于海量数据训练以实现最先进的性能。系统提示是在用户输入之前给予大语言模型的预设指令,用于塑造其行为和回答。
社区讨论: 部分评论者怀疑 Grok 4.6 性能快速提升背后存在基准测试作弊,另一些人则批评 API 默认系统提示覆盖用户指令。
标签: #AI, #Grok, #xAI, #model release, #API
车牌识别数据搜索须持搜查令 ⭐️ 8.0/10
一篇新文章主张车牌识别搜索应需搜查令,引发广泛讨论。 它质疑无搜查令的大规模监控,并追问警方应如何处理无辜驾驶员的位置数据。 车牌识别系统不仅拍摄嫌疑人,还会拍下所有过往车辆,形成可检索的车辆行踪数据库。
hackernews · apwheele · Aug 12, 14:43 · 社区讨论T2 社区与开源
背景: 自动车牌识别(ALPR)是高速摄像头,可自动读取车牌,常安装在警车上。它们记录每块车牌的拍摄地点和时间,使警方能还原某人一段时间的行踪。
社区讨论: 评论者认为仅要求搜查令远远不够,大规模监控本身就应基于合理依据。还有人提到警方滥用数据,并指出英国多年来已接受 ANPR。
标签: #privacy, #surveillance, #law, #public policy, #technology
AI 正在淘汰软件工程的中层吗? ⭐️ 8.0/10
一篇博客文章认为,AI 对中级软件工程师的影响尤为严重,在 Hacker News 上引发了大讨论。 这引发了关于工程师职业发展和就业保障的紧迫问题,因为 AI 工具正在重塑这一行业。 该文的论点是,AI 将常规编码工作自动化,同时大规模放大了好的和坏的工程实践。
hackernews · florianherrengt · Aug 12, 13:20 · 社区讨论T2 社区与开源
背景: 这里的“中层”指的是把高级工程师的设计转化为代码的中级工程师。传统上,高级工程师把实现工作交给初级工程师,而现在 AI 可以处理大部分交接工作。
社区讨论: 评论者争论 AI 是否会放大糟糕的工程实践,并警告说 AI 已经在破坏从初级到高级工程师的培养路径。
标签: #AI, #software engineering, #future of work, #LLM, #career impact
uBlock Origin 放弃屏蔽 Facebook 广告 ⭐️ 8.0/10
uBlock Origin 放弃屏蔽 Facebook 广告,承认无法对抗其反广告拦截措施。 用户无法再用 uBlock Origin 屏蔽 Facebook 广告。 Facebook 将 ‘ad’ 拆成单个字母跨度,并使用随机类名混淆标记。
hackernews · Markoff · Aug 12, 11:28 · 社区讨论T2 社区与开源
背景: Facebook 使用混淆标记来对抗基于过滤列表的广告拦截器(如 uBlock Origin)。
社区讨论: 评论者预测下一步将是基于 AI 的广告拦截。
标签: #ad-blocking, #ublock-origin, #facebook, #privacy, #web-development
Amazon will train on Twitch streamers’ content by default, unless they opt out ⭐️ 8.0/10
Amazon will use Twitch streamers’ content to train AI models by default, requiring users to opt out despite pushback from creators.
rss · TechCrunch · Aug 12, 20:10T1 官方实验室
标签: #AI, #Twitch, #Amazon, #Privacy, #Data Policy
Form Energy 融资 7.5 亿美元扩产 100 小时电网电池 ⭐️ 8.0/10
Form Energy 获得 7.5 亿美元融资,用于扩大其 100 小时铁空气电池的生产,并宣布谷歌和 Crusoe 为客户。 这标志着长时储能获得商业认可,对整合可再生能源和保障电网可靠性至关重要。 该电池利用铁和空气储能,可持续放电 100 小时,成本低于锂离子电池,但往返效率较低。
rss · TechCrunch · Aug 12, 16:18T1 官方实验室
背景: 长时储能(LDES)通常指可放电 10 小时以上的系统,用于平衡太阳能和风能发电的多日缺口。铁空气电池是一种金属-空气电池,放电时铁被氧化,并从环境空气中吸收氧气。
标签: #energy storage, #batteries, #climate tech, #grid infrastructure, #Form Energy
Lovable 估值 133 亿美元,再筹 4 亿美元 ⭐️ 8.0/10
Lovable 以 133 亿美元估值完成 4 亿美元融资,此前 6 月年化经常性收入已达 5 亿美元。 这一轮融资显示了投资者对 AI 应用构建器的强烈信心,并加速了 Lovable 在竞争激烈的市场中的增长。 5 亿美元的年度经常性收入数据是在本轮融资前的 6 月公布的。
rss · TechCrunch · Aug 12, 16:04T1 官方实验室
背景: 年化运行率 (ARR) 将当前收入推算为全年营收。AI 应用构建器允许用户通过自然语言描述来创建应用,无需编写代码。
参考链接
标签: #funding, #AI, #startup, #valuation, #Lovable
附录
以下内容来自 AIHOT 日报,每天 08:00 北京时间发布
- AIHOT 日报 · 2026-08-12 — NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务
NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-12
- AIHOT 日报 · 2026-08-11 — SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理
SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-11
- AIHOT 日报 · 2026-08-10 — Seedance 2.5 上线一周新增六种创意玩法
Seedance 2.5 上线一周新增六种创意玩法 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-10
- AIHOT 日报 · 2026-08-09 — 苹果 Mac 简体中文支持文档更新,“Apple 智能”阿里千问扩展现身
苹果 Mac 简体中文支持文档更新,“Apple 智能”阿里千问扩展现身 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-09
- AIHOT 日报 · 2026-08-08 — 谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时
谷歌推出 WeatherNext 气旋模型,AI 高精度预报飓风平均提前 24 小时 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-08
- AIHOT 日报 · 2026-08-07 — NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿
NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-07
- AIHOT 日报 · 2026-08-06 — Qwen-Image-3.0-Pro 上线 Qwen Cloud
Qwen-Image-3.0-Pro 上线 Qwen Cloud — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-06
- AIHOT 日报 · 2026-08-05 — NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型
NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-05
- AIHOT 日报 · 2026-08-04 — Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数
Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-04
Grok 支持分析任意视频 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-03
德国法院裁定 AI 音乐生成器 Suno 侵犯版权,驳回合理使用抗辩 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-02
DeepSeek V4 Flash 0731 开源,登顶开源模型前三 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-08-01
Google DeepMind 发布 Gemini Robotics 2 物理 AI — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-31
Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-30
- AIHOT 日报 · 2026-07-29 — Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%
Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95% — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-29
Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-28
xAI 发布 Grok CLI 并支持 /tutorial 命令 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-27
新报告揭示 OpenAI 在 Hugging Face 自主黑客事件中失控的严重程度 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-26
Anthropic 发布 Claude Opus 5 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-25
Cactus 发布 Gemma 4 E2B Hybrid:可在设备端为每个回答输出置信度分数,低分时自动路由至更大模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-24
腾讯设计 Agent 平台 Miora 全面开放 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-23
小红书 dots 模型获 IMO 2026 满分金牌 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-22
面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-21
Qwen3.8 开源发布,2.4T 参数模型上线 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-20
Claude Code v2.1.214 发布:修复权限绕过、添加 EndConversation 工具与多项 Bash 权限检查改进 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-19
Kimi K3 登顶前端编码榜,开放权重挑战闭源双巨头 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-18
Kimi K3 发布:2.8T 参数开源模型,具备原生视觉与百万 token 上下文窗口 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-17
阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-16
Bonsai 27B:首款可在手机上运行的 27B 级多模态模型 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-15
腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍 — 点击查看完整日报
via AIHOT · https://aihot.virxact.com/daily/2026-07-14