AI觉醒星球
Awakening is here
Knowledge File / 全球热点解读
2026-07-09 4 浏览 公开

SpaceXAI 发布 Grok 4.5,与Cursor联合训练的编程与智能体模型

Grok 4.5 是 SpaceXAI 与 Cursor 联合训练的混合专家模型,在数万亿 tokens 的用户交互数据上训练,通过强化学习解决软件工程、数据科学、金融、法律等难题。定价 $2-18/M tokens,即日起在 Cursor 全平台可用。

SOURCE / 全球热点解读 MIN / 3 ACCESS / 公开 POST / 2026-07-09 08:00:01

原贴

查看原文
作者:AIHOT 来源站点:aihot.virxact.com 原贴时间:

中文翻译

核心信息

Grok 4.5 是 SpaceXAI 与 Cursor 联合训练的混合专家模型,在数万亿 tokens 的用户交互数据上训练,通过强化学习解决软件工程、数据科学、金融、法律等难题。定价 $2-18/M tokens,即日起在 Cursor 全平台可用。

  • 模型发布/更新:推出 Grok 4.5
  • 模型发布/更新:OpenAI 发布 GPT‑Live 新一代全双工语音模型
  • 模型发布/更新:Pulpie
  • 模型发布/更新:SpaceXAI 发布 Grok 4.5,与 Cursor 联合训练的编程与智能体模型

详细解读

模型发布/更新

  • 推出 Grok 4.5Cursor 与 SpaceXAI 联合训练了混合专家模型 Grok 4.5,在数万亿 tokens 的 Cursor 用户交互数据上训练,并通过强化学习解决软件工程、数据科学、金融、法律等领域的困难问题。基础版定价 $2/M 输入 tokens、$6/M 输出 tokens,快速版 $4/M 输入 tokens、$18/M 输出 tokens。即日起在 Cursor 桌面、网页、iOS、CLI 及 SDK 中可用,个人和团队计划首周使用量翻倍。Grok 4.5 与 Composer 2.5 为不同权重类别,两者将继续支持。
  • OpenAI 发布 GPT‑Live 新一代全双工语音模型OpenAI 今日推出 GPT‑Live,基于全双工架构实现同时听与说,支持自然打断与实时回馈。该模型每秒多次判断是否说话、倾听、打断或调用工具,并将搜索、推理等复杂任务委托给后台 GPT‑5.5,保持对话流畅。即日起向全球 ChatGPT 用户提供 GPT‑Live‑1 和 GPT‑Live‑1 mini 两个版本。人类评估显示,在 5‑10 分钟对话中,GPT‑Live‑1 系列在自然度、轮流、打断等方面显著优于 Advanced Voice Mode;在 GPQA、BrowseComp 和 τ³‑Voice Telecom 基准测试中也表现更强。未来将开放 API。
  • Pulpie用于清理网络的Pareto最优模型:Pulpie是一族Pareto最优模型,用于从HTML页面提取主要内容。其最小模型pulpie-orange-small(210M参数)在WebMainBench上取得0.862的ROUGE-5 F1分数,接近600M参数的Dripper(0.864),但成本仅1/20。在NVIDIA L4 GPU上,Pulpie处理速度13.7页/秒,Dripper仅0.68页/秒。清理10亿页HTML,Pulpie成本约$7,900,Dripper需$159,000。模型采用编码器架构,单次前向传播即可标记每个HTML块为内容或模板,已在HuggingFace开源。
  • SpaceXAI 发布 Grok 4.5,与 Cursor 联合训练的编程与智能体模型SpaceXAI 推出 Grok 4.5,称其迄今最聪明,聚焦编程、智能体任务和知识工作。该模型与 AI 编程编辑器 Cursor 联合训练,在数万块 NVIDIA GB300 GPU 上完成训练和强化学习。基准测试中,Grok 4.5 在 Harvey's Legal Agent Benchmark 排名第一;SWE Bench Pro 解决率 64.7%,平均输出 token 仅 15,954,约为 Opus 4.8 (max) 的 1/4.2。推理速度 80 TPS,输入价格 $2/百万 token,输出 $6/百万 token。模型 ID 为 grok-4.5,已上线 Grok Build 和 Cursor(所有套餐),并通…
  • 蚂蚁集团旗下Robbyant开源LingBot-Vision1B参数边界中心视觉基础模型,用于密集空间感知:蚂蚁集团旗下具身智能公司Robbyant开源LingBot-Vision,一套自监督视觉Transformer家族,专为密集空间感知设计。旗舰ViT-g/16参数约1.1B,采用掩膜边界建模训练,将边界作为原生预训练信号。在密集空间任务中,该1B模型匹配或超越参数规模高达7倍的大模型(如7B DINOv3)。模型以Apache-2.0许可证在Hugging Face开源,提供ViT-g、ViT-L(300M)、ViT-B(86M)、ViT-S四个规模。

产品发布/更新

  • Seedream 5.0 Pro 登陆 Runway,支持14种语言Seedream 5.0 Pro 现已登陆 Runway。可通过提示词或参考图生成高细节图像,图像内文字清晰可读,支持多达14种语言。
  • Replit 推出社区档案与力量排名本周新功能 🚀 Replit 社区档案——vibe coders 的工作证明。 你的档案,你的展示。获取你的智能体使用和检查点的活跃度图表,外加面向专业用户的 Replit 力量排名。
  • 原生速度的 vLLM transformers 建模后端Hugging Face 宣布 transformers vLLM 后端现与手写原生 vLLM 实现速度相当甚至更快。模型作者无需移植代码,即可自动利用 transformers 获得超快推理。
  • OpenRouter聊天室推出一键零数据保留新功能:聊天室一键ZDR(零数据保留)。
  • Runway Dev 发布Runway 官网以 Cookie 设置页面代替了产品介绍,未提供具体信息。

行业动态

  • GitLostNoma Labs 发现 GitHub AI 代理提示词注入漏洞:Noma Labs 在 GitHub Agentic Workflows 中发现严重提示词注入漏洞 GitLost。
  • 美国商务部批准OpenAI大规模发布GPT-5.6,Sol明日亮相。
  • 工信部发布Claude Code后门安全风险提示。
  • 加拿大不列颠哥伦比亚省拟起诉OpenAI未上报ChatGPT暴力对话致校园枪击惨案。
  • 利润超10亿美元、ARR剑指千亿,Anthropic抢先OpenAI冲击IPO。

论文研究

  • 黑客可利用9款最流行的AI工具组装大规模僵尸网络。
  • OpenAI 审计 SWE-Bench Pro 发现约 30% 的评测任务存在缺陷。
  • 面向AI模型双重用途知识的“开关”Anthropic与AE Studio提出GRAM方法。

技巧与观点

  • Claude开发者分享两种多智能体模式Advisor和Orchestrator。
  • 在校研究生Kunkun开源管理相互调用Skill的方法。
  • 《人生设计课》Prompt实测用Claude设计人生的四个阶段。
  • AI 审计代理在 Cloudflare CIRCL 中发现 7 个漏洞。

信息差价值

这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 aihot.virxact.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。

如果把《SpaceXAI 发布 Grok 4.5,与Cursor联合训练的编程与智能体模型》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。

参考来源

上一篇 【必读】每日AI日报 2026-07-09 下一篇 面向AI模型双重用途知识的"开关":Anthropic与AE Studio提出GRAM方法