AI觉醒星球
Awakening is here
Knowledge File / 全球热点解读
2026-08-13 3 浏览 公开

AIHOT 日报参考 2026-08-13

本日报汇总了 2026-08-13 的重要 AI 资讯,包括 Grok 4.6、Qwen3.8 等模型发布,OpenRouter 搜索基准、WhatsApp 防诈骗功能等产品更新,以及关于 AI 真实性、工作流和写作局限的行业洞察。

SOURCE / 全球热点解读 MIN / 3 ACCESS / 公开 POST / 2026-08-13 08:00:26

原贴

查看原文
作者:AIHOT 来源站点:aihot.virxact.com 原贴时间:

中文翻译

核心信息

本日报汇总了 2026-08-13 的重要 AI 资讯,包括 Grok 4.6、Qwen3.8 等模型发布,OpenRouter 搜索基准、WhatsApp 防诈骗功能等产品更新,以及关于 AI 真实性、工作流和写作局限的行业洞察。

  • 模型发布/更新:xai 发布 grok 4.6,强化长时运行智能体能力
  • 模型发布/更新:阿里开放 qwen3.8-2.4t-a95b 模型权重
  • 模型发布/更新:ltx-2.5 模型登场
  • 模型发布/更新:微软首发自研推理模型mai-thinking-1

详细解读

模型发布/更新

  • xai 发布 grok 4.6,强化长时运行智能体能力xai 今日发布 grok 4.6,在 grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 artificial analysis intelligence index(九项基准综合分)上追平 gpt-5.6 sol。来源:xai:news(网页)
  • 阿里开放 qwen3.8-2.4t-a95b 模型权重2.4t moe、激活 95b、原生 256k 上下文:阿里 qwen 团队正式开放 qwen3.8-2.4t-a95b 模型权重,这是 qwen-max 级别模型首次开源。模型总参数 2.4t,每个 token 激活 95b,原生支持 262,144 token 上下文并可扩展至 1,010,000 token。来源:it之家(rss)
  • ltx-2.5 模型登场ai 生成 10 秒 720p 视频仅需 6.8 秒,原生集成 comfyui:ltx 推出 ltx-2.5 模型,原生集成 comfyui,在 2 张英伟达 gb200 配置下生成 10 秒 720p 视频仅需 6.8 秒。ltx-2.5 fast 以每秒 0.09 美元生成带音频 720p 视频,10 秒片段成本 0.90 美元;年度经常性收入低于 1,000 万美元的组织可免费使用。来源:it之家(rss)
  • 微软首发自研推理模型mai-thinking-1我们的首个推理模型 mai-thinking-1 从零开始构建,现已在 microsoft foundry 上线。为团队点赞!更多详情如下。来源:x:mustafa suleyman(microsoft ai ceo) (@mustafasuleyman)

产品发布/更新

  • openrouter 推出实时网页搜索基准测试如何为智能体选择引擎、深度与模型:openrouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 browsecomp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本。来源:openrouter:announcements(rss)
  • claude in chrome 侧边栏升级为 claude cowork 会话claude in chrome 浏览器扩展的侧边栏现已升级为 claude cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换。来源:claude:blog(网页)
  • sglang 与 miles 为 qwen3.8-2.4t-a95b 提供 day-0 支持sglang 与 miles 在发布首日即支持 qwen3.8-2.4t-a95b,这是 qwen 最大的开源模型,总参数 2.4t,每 token 激活 95b,采用混合注意力架构。来源:lmsys:blog(chatbot arena 团队)
  • whatsapp 如何用端到端加密与可验证性构建 scam alert 诈骗提醒功能whatsapp 推出可选功能 scam alert,通过端到端加密保护下在设备端运行机器学习模型,识别潜在诈骗消息,且消息内容不会离开设备或自动上报。该功能遵循仅设备端处理、无自动上报、用户控制三大原则,模型权重公开供独立验证,遥测数据经差分隐私聚合处理。目前已在 beta 版有限推出,并邀请安全研究社区参与测试。来源:meta engineering blog(rss)
  • claude code v2.1.229 发布新增远程会话恢复、插件市场命令源及多项修复:claude code v2.1.229 发布,新增远程控制会话恢复、自托管 runner 的服务器端 hook 支持,以及插件市场命令源。修复了长响应流式输出丢失、窄终端渲染崩溃、Windows 扩展路径崩溃等问题。改进工作流扇出以复用缓存提示前缀,并调整 /commit-push-pr 对危险 git/gh 命令不再自动批准。来源:claude code:github releases(rss)

行业动态

  • research gold 号称“100%人类撰写、绝不使用ai”,实则全程由ai驱动面向医学研究者的网站 research gold 宣称其服务“100%由人类撰写、绝不使用ai”,并列出多名博士审稿人。但调查发现,这些审稿人系ai生成、并不存在;部分真实方法学家的身份和照片未经许可被挪用。致电该公司时,自称“sarah”的ai助手坚称自己是真人,邮件与聊天回复也均为ai生成。来源:hacker news 热门(buzzing.cc 中文翻译)
  • ringcentral 如何用 chatgpt work 和 codex 构建 ai 原生工作流ringcentral 通过全员发放 chatgpt work 和 codex,推动从工程到运营的 ai 原生开发,其 ai-native challenge 让数千名员工(含非技术人员)交付了可运行项目。来源:openai:官网动态(rss · 排除企业/客户案例)

论文研究

  • 空货架还是丢钥匙?google 研究recall 是参数化事实性的瓶颈:google research 提出知识画像框架,发现前沿 llm(如 gemini3、gpt-5)的事实编码接近饱和,但回忆(recall)能力不足,多数事实错误源于“丢钥匙”而非“空货架”。该框架将事实分为编码失败、回忆失败等五类画像,并配套推出 wikiprofile 基准,含 2,150 条维基百科事实,每条配 10 个问题,用于分别探测编码、回忆与识别能力。来源:google research:blog(网页)
  • anthropic 联合独立研究者发布工人再培训项目证据综述anthropic 与独立研究者 david roodman 合作发布报告,基于 56 项美国随机研究和欧洲实验证据,评估工人再培训项目应对 ai 劳动力市场冲击的效果。来源:anthropic:research(发表成果 · 网页)

技巧与观点

  • 零基础用户半天上手ai的12步实操流程文章给出一套零基础用户半天上手ai的12步实操流程:准备内存不低于16g的电脑,订阅chatgpt并安装codex或使用workbuddy,用语音输入法以【背景、痛点、需求】框架向ai交代任务,经苏格拉底提问澄清需求后投喂文件让ai直接完成,最后沉淀为可复用skill。文中建议codex选gpt-5.6 sol最高模型,workbuddy选kimi k3。来源:公众号:数字生命卡兹克
  • deepseek v4 pro与grok 4.6同日发布,双双逼近claude fable 5体验deepseek v4 pro正式版与grok 4.6在2小时内先后发布,均为1.6t/1.5t参数模型,逼近claude fable 5体验。来源:公众号:数字生命卡兹克
  • autogpt 如何用 agents.md 和技能门控管理 ai 生成的拉取请求autogpt 维护者发现,ai 智能体不会主动阅读文档,因此将指令放在 agents.md 和技能文件中,并置于代码目录旁。他们通过强制 pr 模板、测试计划、ci 覆盖率门槛和 cla 签名等门控机制,将智能体提交的 pr 从“不可用”转变为“可用但不符合路线图”。其中 cla 签名因需浏览器和 oauth 流程,被用作区分人类与智能体的“人类探测器”。来源:github blog
  • 我写了一本 ai 教科书——ai 还要多久才能写得更好?作者在完成一本 rlhf 教科书后反思,llm 在长文非虚构写作上进展停滞,gpt 4.5 和 kimi k2 等写作强模型已显老旧,而编码、数学等任务已接近超人水平。模型能改错字、做编辑,但组织整章内容时仍混乱且易出错,作者认为这阻碍了模型自主解决开放科学问题。来源:nathan lambert:interconnects(rss)
  • openrouter 工具调用指南一次编写循环,切换模型字符串即可跨模型运行:openrouter 发布工具调用指南,展示如何用同一套代码在 claude、gpt 和开源权重模型间切换,仅需更改模型字符串。指南涵盖定义工具、发送请求、读取 tool_calls 响应、执行函数并返回结果的完整循环,支持 openai 兼容的 json schema,并提供 curl、python 和 javascript/typescript 示例。来源:openrouter:announcements(rss)。

信息差价值

这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 aihot.virxact.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。

如果把《AIHOT 日报参考 2026-08-13》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。

参考来源

上一篇 【必读】每日AI日报 2026-08-13 下一篇 GitHub 可用性报告:2026 年 7 月