AI觉醒星球
Awakening is here
Knowledge File / AI小生意项目库
2026-06-28 0 浏览 会员

新浪开源VibeThinker-3B:推理可压缩,事实知识不能

新浪发布仅3B参数的VibeThinker-3B,在数学编程任务上媲美大模型,但知识密集型任务落后,揭示推理与知识分离的范式。

SOURCE / AI小生意项目库 MIN / 4 ACCESS / 会员 POST / 2026-06-28 15:44:41

原贴

查看原文
作者:The Decoder:AI News(RSS) 来源站点:the-decoder.com 原贴时间:

原文

新浪发布仅3B参数的VibeThinker-3B,在AIME26等数学编程基准上持平DeepSeek V3.2等大200-333倍的模型,LiveCodeBench超越所有20B以下模型,LeetCode竞赛解决123/128题超过GPT-5.2、Kimi K2.5等。但知识密集型GPQA-Diamond大幅落后。模型基于阿里Qwen2.5-Coder-3B,经SFT、强化学习、自蒸馏等多阶段后训练。研究提出"参数压缩-覆盖假说":逻辑推理依赖少数可压缩模式,而广泛世界知识仍需大参数。模型已开源。 AIHOT 分类:ai-models

中文翻译

新浪发布仅3B参数的VibeThinker-3B,在AIME26等数学编程基准上持平DeepSeek V3.2等大200-333倍的模型,LiveCodeBench超越所有20B以下模型,LeetCode竞赛解决123/128题超过GPT-5.2、Kimi K2.5等。但知识密集型GPQA-Diamond大幅落后。模型基于阿里Qwen2.5-Coder-3B,经SFT、强化学习、自蒸馏等多阶段后训练。研究提出"参数压缩-覆盖假说":逻辑推理依赖少数可压缩模式,而广泛世界知识仍需大参数。模型已开源。

核心信息

新浪发布仅3B参数的VibeThinker-3B,在数学编程任务上媲美大模型,但知识密集型任务落后,揭示推理与知识分离的范式。

  • 新浪发布仅3B参数的VibeThinker-3B,在数学编程任务上媲美大模型,但知识密集型任务落后,揭示推理与知识分离的范式。
  • 原贴提到:新浪发布仅3B参数的VibeThinker-3B,在AIME26等数学编程基准上持平DeepSeek V3.2等大200-333倍的模型,Liv
  • 来源:the-decoder.com
试看内容

成为会员查看完整内容

你已经看到了这篇内容的前置整理,剩余深度部分仅对会员开放。

详细解读 信息差价值 参考来源
成为会员查看完整内容
上一篇 在500天创业生存测试中,仅有三款AI模型在起始资本之上完成 下一篇 新浪开源模型VibeThinker-3B旨在展示推理可良好压缩但事实知识不行