Knowledge File / 全球热点解读
AIHOT 日报参考 2026-08-15
AIHOT日报汇总了2026年8月15日AI领域重要动态,涵盖多款模型发布与更新、产品功能迭代、行业并购与价格战,以及关于Token成本、开源生态和模型选型的深度观察。
SOURCE / 全球热点解读
MIN / 3
ACCESS / 公开
POST / 2026-08-15 08:01:14
原贴
查看原文中文翻译
模型发布/更新
- dots3-note preview 开源280b 参数轻量模型,主打长程智能体与多模态推理:小红书技术开源 dots3-note preview,这是 dots3 系列最轻量模型,总参数 280b、激活参数 16b,支持 512k 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 agent 任务优化。来源:公众号:小红书技术(dots.llm)
- glm-5.3 发布编程能力开源第一,并涌现网络安全能力:智谱发布glm-5.3,基于与glm-5.2相同的基座,通过极致的后训练scaling提升智能上界,编程能力较前代提升50%,在terminal bench 3.0等公开基准中取得开源第一,并接近claude fable 5。模型在白盒代码审查等安全任务中表现持平mythos 5,在cybergym测试中得分84.5%。模型权重将在两周后开源,即日起上线zcode、autoclaw等工具。来源:公众号:智谱(glm)
- gemini 3.7 flash 全面上线 pro 与 ultra 用户gemini 3.7 flash 现已向 gemini 聊天中的 pro 和 ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,gemini spark 也已运行于 3.7 flash,通过改进对 google workspace 应用的工具调用,让个人 ai 智能体更精准。来源:x:gemini (@geminiapp)
- deepseek v4 pro 登陆硅基流动,1m 上下文deepseek-v4-pro-0813 正式上线硅基流动 siliconflow,提供 day-0 支持,具备 1m 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 mit 开源协议。定价为输入 $1.32/m、输出 $3.96/m、缓存命中 $0.44/m。同系列 deepseek-v4-flash-0731 则面向追求速度与成本效益的日常生产场景。来源:x:硅基流动 siliconflow (@siliconflowai)
产品发布/更新
- claude code v2.1.233 发布新增 gitlab mr 支持与内存 cgroup 限制:claude code v2.1.233 发布,为 --worktree 标志和 agents 视图新增 gitlab 合并请求 url 支持,并添加可选的 forward_user_identity 网关设置以按用户归因支出。来源:claude code:github releases(rss)
行业动态
- openai and anthropic in price war as chinese ai rivals gain ground价格战让模型api的成本弹性成为现实,原先因账单压力转向中国厂商的用户,可能在openai和anthropic降价后重新比较能力与价格。来源:ars technica:ai(rss)
- cursor 正式被 spacex 收购cursor 已被 spacex 正式收购,完成自 4 月启动的收购流程。合并后 cursor 将获得全球最大 gpu 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 grok 4.6 是双方合作成果的早期体现。来源:cursor blog
- claude 文本水印机制如何运作未来 claude 模型生成的文本将包含水印,用于判断文本由 claude 撰写的可能性,这是 anthropic 为遵守欧盟《ai 法案》而实施的变更。该方法基于 google deepmind 的 synthid-text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。来源:anthropic:newsroom(网页)
- 印尼首个大学ai中心落成ugm、indosat与nvidia合作培养本地ai人才:印尼通信与数字事务部、indosat、nvidia与加查马达大学(ugm)在日惹共同启动ugm indosat nvidia ai技术中心(nvaitc),这是该国首个大学ai技术中心。来源:nvidia blog(rss)
技巧与观点
- 2026年夏季开源模型生态观察中国前沿模型规模领先,amd与nvidia主导发布量:2026年1至8月,hugging face公开模型仓库从243万增至296万,但85.6%的模型下载量不足200次,1.5%的仓库占据99.2%下载量。中国实验室月度最大开源模型参数规模在754b至2.78万亿之间,美国实验室七个月中五个月低于130b。amd与nvidia各发布超200个新模型仓库,成为发布开源模型最多的机构。来源:hugging face:blog(rss)
- claude code 会话如何最大化 token 价值claude code 的 token 成本由模型、输入/输出 token 和提示缓存三因素决定,输出 token 价格约为输入的 5 倍。任务间运行 /clear 可减少无关上下文回传,降低 token 用量;会话中途切换模型或 effort 级别会破坏提示缓存,增加成本。来源:claude:blog(网页)
- 蚂蚁百灵与 asystem 团队打通单机 agentic rl 后训练闭环蚂蚁百灵与 asystem 团队合作,用 ling-3.0-tiny 和 areno 在 dgx spark 上跑通单机 agentic rl 后训练闭环。以井字棋为最小验证任务,用 gspo 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定。来源:公众号:蚂蚁百灵(ling)
- openrouter 视觉指南如何通过 api 向多模态模型发送图像:openrouter 发布视觉指南,详解通过 chat completions api 向多模态模型发送图像的方法。请求体采用 messages 数组,用户消息的 content 包含 text 和 image_url 两部分,支持公开 url 或 base64 数据 url 两种格式,兼容 png、jpeg、webp 和 gif。来源:openrouter:announcements(rss)
- 谁真的需要sota模型?openrouter数据显示84%token来自非前沿模型openrouter数据显示,84%的模型token并非来自sota模型,用户最常用的六款模型性能约为前沿模型的77%,成本仅为claude fable 5的2.5%。8月10日当周,六款模型承载了80%流量,混合价格约$0.50/百万token,而fable 5为$20。最佳开源模型性能已从一年前的48%提升至前沿模型的80%,企业正转向更小、微调或开源模型以优化性价比。来源:tomer tunguz 博客(vc 分析)。
核心信息
AIHOT日报汇总了2026年8月15日AI领域重要动态,涵盖多款模型发布与更新、产品功能迭代、行业并购与价格战,以及关于Token成本、开源生态和模型选型的深度观察。
- 模型发布/更新:dots3-note preview 开源
- 模型发布/更新:glm-5.3 发布
- 模型发布/更新:gemini 3.7 flash 全面上线 pro 与 ultra 用户
- 模型发布/更新:deepseek v4 pro 登陆硅基流动,1m 上下文
详细解读
模型发布/更新
- dots3-note preview 开源280b 参数轻量模型,主打长程智能体与多模态推理:小红书技术开源 dots3-note preview,这是 dots3 系列最轻量模型,总参数 280b、激活参数 16b,支持 512k 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 agent 任务优化。来源:公众号:小红书技术(dots.llm)
- glm-5.3 发布编程能力开源第一,并涌现网络安全能力:智谱发布glm-5.3,基于与glm-5.2相同的基座,通过极致的后训练scaling提升智能上界,编程能力较前代提升50%,在terminal bench 3.0等公开基准中取得开源第一,并接近claude fable 5。模型在白盒代码审查等安全任务中表现持平mythos 5,在cybergym测试中得分84.5%。模型权重将在两周后开源,即日起上线zcode、autoclaw等工具。来源:公众号:智谱(glm)
- gemini 3.7 flash 全面上线 pro 与 ultra 用户gemini 3.7 flash 现已向 gemini 聊天中的 pro 和 ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,gemini spark 也已运行于 3.7 flash,通过改进对 google workspace 应用的工具调用,让个人 ai 智能体更精准。来源:x:gemini (@geminiapp)
- deepseek v4 pro 登陆硅基流动,1m 上下文deepseek-v4-pro-0813 正式上线硅基流动 siliconflow,提供 day-0 支持,具备 1m 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 mit 开源协议。定价为输入 $1.32/m、输出 $3.96/m、缓存命中 $0.44/m。同系列 deepseek-v4-flash-0731 则面向追求速度与成本效益的日常生产场景。来源:x:硅基流动 siliconflow (@siliconflowai)
产品发布/更新
- claude code v2.1.233 发布新增 gitlab mr 支持与内存 cgroup 限制:claude code v2.1.233 发布,为 --worktree 标志和 agents 视图新增 gitlab 合并请求 url 支持,并添加可选的 forward_user_identity 网关设置以按用户归因支出。来源:claude code:github releases(rss)
行业动态
- openai and anthropic in price war as chinese ai rivals gain ground价格战让模型api的成本弹性成为现实,原先因账单压力转向中国厂商的用户,可能在openai和anthropic降价后重新比较能力与价格。来源:ars technica:ai(rss)
- cursor 正式被 spacex 收购cursor 已被 spacex 正式收购,完成自 4 月启动的收购流程。合并后 cursor 将获得全球最大 gpu 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 grok 4.6 是双方合作成果的早期体现。来源:cursor blog
- claude 文本水印机制如何运作未来 claude 模型生成的文本将包含水印,用于判断文本由 claude 撰写的可能性,这是 anthropic 为遵守欧盟《ai 法案》而实施的变更。该方法基于 google deepmind 的 synthid-text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本。来源:anthropic:newsroom(网页)
- 印尼首个大学ai中心落成ugm、indosat与nvidia合作培养本地ai人才:印尼通信与数字事务部、indosat、nvidia与加查马达大学(ugm)在日惹共同启动ugm indosat nvidia ai技术中心(nvaitc),这是该国首个大学ai技术中心。来源:nvidia blog(rss)
技巧与观点
- 2026年夏季开源模型生态观察中国前沿模型规模领先,amd与nvidia主导发布量:2026年1至8月,hugging face公开模型仓库从243万增至296万,但85.6%的模型下载量不足200次,1.5%的仓库占据99.2%下载量。中国实验室月度最大开源模型参数规模在754b至2.78万亿之间,美国实验室七个月中五个月低于130b。amd与nvidia各发布超200个新模型仓库,成为发布开源模型最多的机构。来源:hugging face:blog(rss)
- claude code 会话如何最大化 token 价值claude code 的 token 成本由模型、输入/输出 token 和提示缓存三因素决定,输出 token 价格约为输入的 5 倍。任务间运行 /clear 可减少无关上下文回传,降低 token 用量;会话中途切换模型或 effort 级别会破坏提示缓存,增加成本。来源:claude:blog(网页)
- 蚂蚁百灵与 asystem 团队打通单机 agentic rl 后训练闭环蚂蚁百灵与 asystem 团队合作,用 ling-3.0-tiny 和 areno 在 dgx spark 上跑通单机 agentic rl 后训练闭环。以井字棋为最小验证任务,用 gspo 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定。来源:公众号:蚂蚁百灵(ling)
- openrouter 视觉指南如何通过 api 向多模态模型发送图像:openrouter 发布视觉指南,详解通过 chat completions api 向多模态模型发送图像的方法。请求体采用 messages 数组,用户消息的 content 包含 text 和 image_url 两部分,支持公开 url 或 base64 数据 url 两种格式,兼容 png、jpeg、webp 和 gif。来源:openrouter:announcements(rss)
- 谁真的需要sota模型?openrouter数据显示84%token来自非前沿模型openrouter数据显示,84%的模型token并非来自sota模型,用户最常用的六款模型性能约为前沿模型的77%,成本仅为claude fable 5的2.5%。8月10日当周,六款模型承载了80%流量,混合价格约$0.50/百万token,而fable 5为$20。最佳开源模型性能已从一年前的48%提升至前沿模型的80%,企业正转向更小、微调或开源模型以优化性价比。来源:tomer tunguz 博客(vc 分析)。
信息差价值
这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 aihot.virxact.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。
如果把《AIHOT 日报参考 2026-08-15》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。