AI觉醒星球
Awakening is here
Knowledge File / 全球热点解读
2026-08-05 6 浏览 公开

AIHOT 日报参考 2026-08-05

AIHOT日报参考汇总了2026-08-05的AI领域重要信息,包括NVIDIA、商汤、OpenRouter等公司的新模型发布,Anthropic的百亿算力协议,以及工信部自动驾驶安全国标等热点。

SOURCE / 全球热点解读 MIN / 3 ACCESS / 公开 POST / 2026-08-05 08:00:34

原贴

查看原文
作者:AIHOT 来源站点:aihot.virxact.com 原贴时间:

中文翻译

核心信息

AIHOT日报参考汇总了2026-08-05的AI领域重要信息,包括NVIDIA、商汤、OpenRouter等公司的新模型发布,Anthropic的百亿算力协议,以及工信部自动驾驶安全国标等热点。

  • 模型发布/更新:NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型
  • 模型发布/更新:商汤 SenseNova U1 开源
  • 模型发布/更新:OpenRouter 上线 FLUX 3 Video 统一多模态模型
  • 模型发布/更新:蚂蚁百灵发布Ling-3.0-flash开源权重

详细解读

模型发布/更新

  • NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。来源:NVIDIA Blog(RSS)
  • 商汤 SenseNova U1 开源统一推理与图像生成:商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。来源:X:商汤 SenseTime (@SenseTime_AI)
  • OpenRouter 上线 FLUX 3 Video 统一多模态模型@bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。来源:X:OpenRouter (@OpenRouter)
  • 蚂蚁百灵发布Ling-3.0-flash开源权重今天,我们发布了 Ling-3.0-flash 的开源权重。🎉 官方 BF16 和 FP8 量化版本现已可用,您可以根据自己的硬件、性能要求和部署需求选择最合适的版本。来源:X:蚂蚁百灵 (@AntLingAGI)
  • 腾讯混元发布 Hy ASR 3.0 preview真正懂上下文的语音识别:腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。其在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 API,元宝 App 首发并免费开放。来源:公众号:腾讯混元

产品发布/更新

  • Swiftlet在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版:Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。来源:Hacker News 热门(buzzing.cc 中文翻译)
  • Reflex 开源 XY基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅:Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。来源:MarkTechPost(RSS)
  • 面壁智能开源 ForgeStencil一周自动优化 100+ 工业与科学软件,全程零人工介入:面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。来源:公众号:面壁智能(MiniCPM)
  • Soup v0.72.4在4 GB显存笔记本GPU上微调8B模型:Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。来源:Hacker News 热门(buzzing.cc 中文翻译)
  • OpenRouter 推出 ori CLI为 Claude Code 等 Harness 提供开箱即用的优化配置:OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenCode、Hermes 等 harness 的优化配置,省去手动设置大量环境变量的麻烦。来源:OpenRouter:Announcements(RSS)

行业动态

  • Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 Nvidia 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。来源:X:Rohan Paul (@rohanpaul_ai)
  • 工信部发布首部L3/L4自动驾驶系统安全要求强制性国标,2027年7月实施工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721—2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标GB/T 44721—2024升级而来,为自动驾驶产品明确了统一的安全准入基线。来源:IT之家(RSS)
  • GPT-5.6 Luna降价80%永久生效有些人显然误解了,但 GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久的。效率提升不会消失。幸运的是。来源:X:Tibo (@thsottiaux)
  • Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 出任首席全球事务官Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 为首任首席全球事务官,负责全球政策、国际战略参与及政府关系事务。Cuéllar 曾任卡内基国际和平基金会主席、加州最高法院法官,并自 2026 年 1 月起担任 Anthropic 长期利益信托受托人,现已卸任该职务加入公司。来源:Anthropic:Newsroom(网页)
  • OpenAI 说明第三方网络安全评估事件并公布新保障措施OpenAI 就近期第三方网络安全评估事件作出说明,并公布新的保障措施以强化 AI 模型测试与评估流程。相关措施旨在提升模型评估的安全性与可靠性,确保第三方测试在受控环境下进行。来源:OpenAI:官网动态(RSS · 排除企业/客户案例)

技巧与观点

  • 在单颗 AMD MI300X 上运行 DeepSeek V4 Flash一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。来源:Hacker News 热门(buzzing.cc 中文翻译)
  • MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。来源:Simon Willison 博客
  • 用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 检查流水线扫描每个技能。来源:MarkTechPost(RSS)
  • Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零Cloudflare 在 Astro 仓库上运行自动化 triage 流水线,通过隔离的 AI 子代理复现、诊断并修复 bug,将开放 issue 从 200 多个降至约 30 个,预计下月归零。该流水线由 issue 标签驱动,修复后自动发布预览版本供用户验证。其底层引擎已发展为 Flue,一个开源的平台无关框架,用于构建持久化智能体与工作流。来源:Cloudflare Blog
  • GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。来源:GitHub Blog来源:AIHOT 日报参考

信息差价值

这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 aihot.virxact.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。

如果把《AIHOT 日报参考 2026-08-05》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。

参考来源

上一篇 【必读】每日AI日报 2026-08-05 下一篇 英国AISI发布Anthropic和OpenAI最新模型的网络安全评估报告