觉
AI觉醒星球
Awakening is here
Knowledge File / AI小生意项目库
2026-07-01 3 浏览 免费阅读

OpenAI据称将Guest ChatGPT用户的响应成本削减一半以上

OpenAI工程师将推理成本降低一半以上,用于无账户访客用户,所需GPU降至几百个;DeepSeek也发布新方法加速推理。这些优化可能释放资源,但数据中心建设缓慢,芯片需求不会立即下降。

SOURCE / AI小生意项目库 MIN / 9 ACCESS / 免费阅读 POST / 2026-07-01 01:43:27

原贴

查看原文
作者:Matthias Bastian 来源站点:the-decoder.com 原贴时间:

原文

OpenAI engineers told colleagues earlier this month that they'd managed to cut inference costs—the expense of running existing AI models—by more than half. That's according to a person familiar with the discussions, as reported by The Information . OpenAI applied the new optimizations to ChatGPT, specifically for visitors who don't have an account. The number of Nvidia GPUs needed to serve those users dropped to just a few hundred. It's not clear how many were required before or what techniques OpenAI used to pull it off. Guest users can only access a very limited set of ChatGPT features, so whether these gains would carry over to the full product is an open question. Deepseek also just dropped a new open-source method that can speed up inference requests by 60 to 85 percent. The freed-up resources could go toward scaling services, better models, faster responses, or bigger margins. But since data center buildouts are moving slowly, gains like these will probably give labs more breathing room rather than cut into chip demand. Ad DEC_D_Incontent-1 Ad Subscribe to THE DECODER for ad-free reading, a weekly AI newsletter, our exclusive "AI Radar" frontier report six times a year, full archive access, and access to our comment section.

中文翻译

OpenAI工程师本月早些时候告诉同事,他们已将推理成本——即运行现有AI模型的费用——削减了一半以上。这是据一位知情人士透露,The Information报道。OpenAI将这些新优化应用于ChatGPT,特别是针对没有账户的访客。服务这些用户所需的Nvidia GPU数量降至仅几百个。目前尚不清楚之前需要多少,也不清楚OpenAI使用了什么技术来实现这一点。访客用户只能访问ChatGPT非常有限的功能,因此这些成果能否转移到完整产品上仍是一个悬而未决的问题。DeepSeek也刚刚发布了一种新的开源方法,可以将推理请求速度提高60%到85%。释放出来的资源可以用于扩展服务、更好的模型、更快的响应或更大的利润。但由于数据中心建设进展缓慢,这类成果可能更多地是给实验室提供更大的回旋余地,而不是削减芯片需求。

核心信息

OpenAI工程师将推理成本降低一半以上,用于无账户访客用户,所需GPU降至几百个;DeepSeek也发布新方法加速推理。这些优化可能释放资源,但数据中心建设缓慢,芯片需求不会立即下降。

  • OpenAI工程师将推理成本降低一半以上,用于无账户访客用户,所需GPU降至几百个;DeepSeek也发布新方法加速推理。这些优化可能释放资源,但数据中心建设缓慢,芯片需求不会立即下降。
  • 原贴提到:OpenAI engineers told colleagues earlier this month that they'd managed
  • 来源:the-decoder.com

详细解读

这是什么信号?OpenAI将访客用户的推理成本降低一半以上,并将所需GPU压缩至几百个,表明AI推理效率正迎来突破性进展。DeepSeek也开源了可加速60-85%的方法,说明行业正从“堆算力”转向“优化算力”阶段。这一信号指向AI运营成本结构可能发生根本性变化。

为什么重要?推理成本是AI服务规模化最大的瓶颈之一。成本减半意味着相同算力下可支持更多用户,或释放资源用于研发更强大模型。对OpenAI而言,这能改善免费服务的经济性,吸引更多用户;对竞争对手而言,需要跟进效率优化以保持竞争力;对投资者而言,芯片需求的预期可能需重新评估——但数据中心建设慢,短期芯片需求不会大幅下降。

对谁有价值?AI公司(可借鉴优化策略降低成本)、云服务商(可提供更廉价API)、芯片厂商(需关注效率提升对需求的影响)、投资者(需调整对算力增长的线性预期)。

可以怎么行动?企业可评估自身推理成本,引入类似优化技术;投资者可关注开源优化方法的落地效果,并警惕芯片需求增速放缓;研究人员可深入研究OpenAI和DeepSeek的技术细节,推动效率进一步提升。

风险或限制:访客功能有限,优化可能存在特异性,能否迁移至完整产品未经验证;DeepSeek方法开源但效果取决于具体场景;数据中心建设瓶颈仍是长期约束,效率提升可能只是暂时缓解压力,而非彻底解决算力短缺。

信息差价值

这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 the-decoder.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。

如果把《OpenAI据称将Guest ChatGPT用户的响应成本削减一半以上》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。

参考来源

AI SUMMARY

这篇文章回答了什么

OpenAI据称将Guest ChatGPT用户的响应成本削减一半以上主要讲什么?

OpenAI工程师将推理成本降低一半以上,用于无账户访客用户,所需GPU降至几百个;DeepSeek也发布新方法加速推理。这些优化可能释放资源,但数据中心建设缓慢,芯片需求不会立即下降。

这篇文章最值得关注的要点是什么?

OpenAI工程师将推理成本降低一半以上,用于无账户访客用户,所需GPU降至几百个;DeepSeek也发布新方法加速推理。这些优化可能释放资源,但数据中心建设缓慢,芯片需求不会立即下降。;原贴提到:OpenAI engineers told colleagues earlier this month that they'd managed;来源:the-decoder.com

这篇文章和哪些AI专题相关?

它适合放在AI副业、AI工具、AI超级个体专题里阅读。 关联原因:这篇内容命中「项目、小生意、变现」等主题信号。;这篇内容命中「模型」等主题信号。;这篇内容命中「效率」等主题信号。

阅读这篇文章建议先理解哪些关键词?

建议先理解AI工具、工具、自动化、模型、Cursor这些关键词,再结合正文判断工具、机会或风险是否值得进入自己的工作流。

上一篇 Acti 将 AI 智能体直接放入手机键盘 下一篇 Claude Science 科研工作台正式上线
北竹游乐场 免费玩小游戏 免费玩