Knowledge File / AI小生意项目库
新浪开源VibeThinker-3B:推理可压缩,事实知识不能
新浪发布仅3B参数的VibeThinker-3B,在数学编程任务上媲美大模型,但知识密集型任务落后,揭示推理与知识分离的范式。
SOURCE / AI小生意项目库
MIN / 4
ACCESS / 会员
POST / 2026-06-28 15:44:41
原贴
查看原文原文
新浪发布仅3B参数的VibeThinker-3B,在AIME26等数学编程基准上持平DeepSeek V3.2等大200-333倍的模型,LiveCodeBench超越所有20B以下模型,LeetCode竞赛解决123/128题超过GPT-5.2、Kimi K2.5等。但知识密集型GPQA-Diamond大幅落后。模型基于阿里Qwen2.5-Coder-3B,经SFT、强化学习、自蒸馏等多阶段后训练。研究提出"参数压缩-覆盖假说":逻辑推理依赖少数可压缩模式,而广泛世界知识仍需大参数。模型已开源。 AIHOT 分类:ai-models
中文翻译
新浪发布仅3B参数的VibeThinker-3B,在AIME26等数学编程基准上持平DeepSeek V3.2等大200-333倍的模型,LiveCodeBench超越所有20B以下模型,LeetCode竞赛解决123/128题超过GPT-5.2、Kimi K2.5等。但知识密集型GPQA-Diamond大幅落后。模型基于阿里Qwen2.5-Coder-3B,经SFT、强化学习、自蒸馏等多阶段后训练。研究提出"参数压缩-覆盖假说":逻辑推理依赖少数可压缩模式,而广泛世界知识仍需大参数。模型已开源。
核心信息
新浪发布仅3B参数的VibeThinker-3B,在数学编程任务上媲美大模型,但知识密集型任务落后,揭示推理与知识分离的范式。
- 新浪发布仅3B参数的VibeThinker-3B,在数学编程任务上媲美大模型,但知识密集型任务落后,揭示推理与知识分离的范式。
- 原贴提到:新浪发布仅3B参数的VibeThinker-3B,在AIME26等数学编程基准上持平DeepSeek V3.2等大200-333倍的模型,Liv
- 来源:the-decoder.com
试看内容
成为会员查看完整内容
你已经看到了这篇内容的前置整理,剩余深度部分仅对会员开放。
详细解读
信息差价值
参考来源
成为会员查看完整内容