AI觉醒星球
Awakening is here
Knowledge File / 全球热点解读
2026-07-11 7 浏览 公开

AIHOT 日报参考 2026-07-11

今日AI日报涵盖百度搭子更新、Claude Code浏览器、Perplexity分析功能、Apple起诉OpenAI、扎克伯格回应算力、Cognition信任Claude Fable、宇树手术机器人等热点。

SOURCE / 全球热点解读 MIN / 3 ACCESS / 公开 POST / 2026-07-11 08:00:01

原贴

查看原文
作者:AIHOT 来源站点:aihot.virxact.com 原贴时间:

中文翻译

核心信息

今日AI日报涵盖百度搭子更新、Claude Code浏览器、Perplexity分析功能、Apple起诉OpenAI、扎克伯格回应算力、Cognition信任Claude Fable、宇树手术机器人等热点。

  • 产品发布/更新:百度搭子在成都ai day发布四项更新
  • 产品发布/更新:claude code桌面版新增应用内浏览器
  • 产品发布/更新:perplexity 推出跨模型信用额度分析功能
  • 产品发布/更新:claude code v2.1.206 发布

详细解读

产品发布/更新

  • 百度搭子在成都ai day发布四项更新个人版升级、自媒体套件、企业版及搭子联盟:百度搭子在成都百度ai day上发布四项更新。个人版新增浏览器调用、智能路由(平均任务耗时降20%,token利用率提升25%)、多端共享记忆及强化ppt生成,并上架“一镜”数字人制作、“灵医”报告解读等skill。行业首个自媒体专业套件支持选题到复盘全链路。企业版支持团队协作与权限管理。搭子联盟启动,中国联通等已加入。上线三个月,日均提问量增长20倍。来源:公众号:百度智能云(文心)
  • claude code桌面版新增应用内浏览器claude code 桌面版现在有了应用内浏览器。 claude 可以调出文档、设计稿或任何其他网站。它可以像操作本地开发服务器一样,进行阅读、点击浏览和交互。 该浏览器采用沙盒机制且可配置:你可以自行选择会话是否持久保留。来源:x:claude devs (@claudedevs)
  • perplexity 推出跨模型信用额度分析功能推出 computer analytics:你现在可以跨模型跟踪信用额度支出。 该功能现已面向个人和企业用户开放,可在账户设置的 analytics 下使用。来源:x:perplexity (@perplexity_ai)
  • claude code v2.1.206 发布claude code v2.1.206 发布,主要更新包括:为 `/cd` 命令添加目录路径建议;新增 `/doctor` 检查以建议修剪 claude.md 文件中模型可从代码库推导的内容;`/commit-push-pr` 现在自动允许 git push 到仓库配置的推送远程仓库;`/login` 支持 anthropic 运营的公共网关端点;后台智能体在更新后自动升级。修复了过期登录导致所有模型报错、`claude --resume` 和 `--continue` 在启动时无键盘响应、mcp 服务器忽略 `request_timeout_ms` 配置、oauth mcp 服务器需手动重新认证、`/model` 选择器价格显示…来源:claude code:github releases(rss)
  • 蚂蚁集团开源高性能大模型推理框架 sglang蚂蚁集团通过 github 新仓库 inclusionai/sglang 开源了 sglang,这是一个面向大语言模型和多模态模型的高性能推理服务框架。来源:蚂蚁 inclusionai:github 新仓库

行业动态

  • apple 起诉 openai 窃取商业机密apple 于周五向美国加州北区联邦法院提起诉讼,指控 openai 窃取商业机密并违反合同。诉状称,openai 高级领导层(包括首席硬件官 tang tan)指使前 apple 员工在招聘过程中窃取机密,包括使用未发布产品的项目代号、要求应聘者携带硬件组件参加面试。apple 还指控前高级系统电气工程师 chang liu 在 2026 年离职加入 openai 后未归还公司笔记本电脑,并用其下载机密技术文档。apple 称其机密信息已被 openai 用于开发自有硬件产品,例如一项专有金属精加工技术。apple 要求法院禁止 openai 使用或披露其商业机密,并归还相关材料。来源:techcrunch:ai(rss)
  • 扎克伯格首度回应 meta“算力过剩”没人会嫌算力太多,但租出去更赚钱:meta ceo 扎克伯格首次正面回应公司筹划云基础设施业务一事,否认“算力过剩”猜测,称内部算力需求依然旺盛、满负荷运转。但他同时表示,当前市场对算力出价极高,将部分 ai 基础设施对外出租在财务上更划算。meta 正制定代号“meta compute”的云计算计划,包括开放模型访问权限和直接出租裸算力两条路线。扎克伯格还提及 spacex 以每月 12.5 亿美元将数据中心租给 anthropic 的模式。meta 2026 年资本支出指引达 1250 亿至 1450 亿美元,计划 2026 年 9 月量产自研 ai 芯片,目标 2027 年部署算力提升至 14 吉瓦。来源:it之家(rss)
  • cognition 如何信任 claude fable 5 通宵工作cognition 研究高级副总裁 silas alberti 表示,其 ai 软件工程师 devin 测试了几乎所有 claude 模型,claude fable 5 是首个能信任其通宵运行的模型。在 cognition 自建的 frontier code 基准测试最难子集上,此前 opus 模型得分约 10%,claude fable 5 得分约 30%。alberti 称最大变化在于任务执行时长:模型可连续工作 8 小时并取得实际进展,能正确使用内部调试工具,在混乱上下文中保持清晰思路,并主动说明未知信息以重建信任。来源:claude:blog(网页)

论文研究

  • 宇树g1人形机器人完成首例活体微创手术一篇新的《自然》论文展示了宇树g1人形机器人执行研究人员所称的首例由人形机器人完成的活体标准微创手术。加州大学圣地亚哥团队使用g1,以常规手术器械完成了对两只活猪的腹腔镜胆囊切除术;第二次手术耗时32分钟。该机器人仍需反复校正,且尚无法满足手术无菌标准,但其成本可能仅为达芬奇系统的约5%。来源:x:x.pin (@thexpin)
  • 博科圣地如何利用前沿ai技术2025至2026年间对尼日利亚东北部27名前“博科圣地”成员的半结构化访谈揭示了该组织在2024年系统性地利用前沿ai技术。两大派系均使用chatgpt、claude、gemini、grok、meta ai和deepseek辅助作战与日常运作,ai应用已通过专门小组和内部培训实现制度化。成员成功绕过部分安全限制,将ai用于袭击策划、武器故障排查及爆炸装置设计。相关技术通过跨国圣战网络传播,伊斯兰国特工提供了面对面培训。受访者对ai表现出强烈热情,部分人对大规模杀伤性武器持开放态度,但记录在案的使用仍限于常规手段。来源:hacker news 热门(buzzing.cc 中文翻译)
  • 小红书发布大模型新架构 pipo小红书提出 pipo 架构,通过输入侧压缩器将两个 token 折叠为一个 latent,输出侧 mtp head 将隐藏状态展开为额外 token,实现输入长度减半、每步输出翻倍。基于 qwen3.5-4b/9b backbone,在 aime 2025 等基准上最高带来 +7.15 pass@4 提升。部署测评中,ttft 加速约 1.23×,tpot 加速约 1.86×。训练采用 sft 和 on-policy distillation 两阶段,将 verifier 校验能力蒸馏进轻量 confidence head。来源:公众号:小红书技术(dots.llm)
  • deepseek-v4 flash 强化学习训练登陆 amd instinct mi355x gpu,由 miles 框架支持deepseek-v4 flash 的强化学习训练现已在 amd instinct mi355x gpu 上通过 miles 框架获得支持,基于 rocm 软件栈运行。该 2840 亿参数 moe 模型(每 token 激活 130 亿参数)需 sglang 进行 rollout 生成、megatron 进行策略更新,miles 负责异步循环与权重同步。团队解决了 sglang 与 megatron 间模型对齐、量化状态在线更新及多节点并行稳定性三大挑战,最终在四个八 gpu 节点上完成端到端验证:超过 100 个优化器步骤中训练-rollout 对数概率差可控,在线奖励持续提升,离线 aime-2024 基准分数同步上涨。来源:lmsys:blog(chatbot arena 团队)

技巧与观点

  • 马斯克承认anthropic是当前ai领导者马斯克在x上发文承认自己此前对anthropic的判断有误,称其“显然是当前ai领域的领导者”。他表示,没有公司发布过像mythos/fable这样优秀的模型,并相信anthropic很快会推出mythos 2。他还强调,即使作为竞争对手,也不会以伤害对方的方式切断合作,并列举了特斯拉开源专利、开放超级充电网络等先例。该推文被rohan paul转发,称这是anthropic“最强有力的炫耀”。来源:x:rohan paul (@rohanpaul_ai)
  • elon musk 转发用户称赞 grok build 的反馈elon musk 转发用户 @0x0funky 对 grok build 的称赞。该用户称 grok build 是目前唯一集大成的 coding agentic workflow,内建图像生成和图片生视频功能,生图速度快且品质不输 codex。agent 可直接完成图像与视频生成,无需额外串接 mcp 或外部服务。用户结合 agent sprite forge 工具,利用 grok build 的视频生成能力,先产出 6 秒角色动作视频再反编译为 game sprite,大幅减少对齐问题,制作 2d 横版游戏耗时不到 30 分钟,而此前用 codex 需 1-2 小时且品质更优。来源:x:elon musk (@elonmusk, xai)
  • thinking machines lab构建延伸人类意志与判断的 ai:thinking machines lab 在官方博客中阐述其使命:构建能够延伸人类意志与判断的 ai。文章指出,当前多数 ai 在少数地方训练后便冻结,无法被使用者塑造。该实验室正致力于训练具备多模态交互和可定制化能力的强模型,开发允许用户训练模型权重的工具,并构建拓宽人机沟通渠道的界面。其核心理念是让 ai 服务于分布式的人类知识,使每个组织都能利用自身独特知识微调模型,并持续适应知识演变。来源:thinking machines lab:官方博客(rss)
  • github copilot 代码审查改用共享工具后性能下降,通过重写指令实现 20% 成本降低github 在 copilot 代码审查中尝试用 copilot cli 的共享代码探索工具(grep、glob、view)替换原有专用工具,结果导致审查成本上升、有效评论数量下降。分析 trace 发现,问题不在工具本身,而在于指令让智能体像通用编程助手一样大范围浏览仓库,而非像审查者一样从 diff 出发进行定向搜索。重写指令后,审查平均成本降低约 20%,同时保持相同审查质量。来源:github blog
  • theory ventures 三周年ai 如何重塑软件栈与风投定义:theory ventures 合伙人 tomer tunguz 发文总结 ai 带来的市场巨变。新模型每 41 天发布一次,公司达 1 亿美元收入速度创纪录。ai 压缩时间导致风投阶段定义失效,种子轮规模从 100 万到 5 亿美元不等。推理正取代模型成为 ai 主导市场,基础设施按视频、批处理、本地、智能体等负载类型专业化细分。推理的高成本催生了 ai 广告补贴模式,koah 的 ai 对话原生广告点击率是展示广告基线的 4-5 倍。闭源与开源、云端与本地模型差距缩小,许多模型已“足够好”。安全攻击面因 mcp 服务器、技能、插件和编码智能体而急剧扩大。来源:tomer tunguz 博客(vc 分析)。

信息差价值

这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 aihot.virxact.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。

如果把《AIHOT 日报参考 2026-07-11》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。

参考来源

上一篇 【必读】每日AI日报 2026-07-11 下一篇 博科圣地如何利用前沿AI技术