网界
网络资讯 网界财经 科技人物 数据洞察 行业动态 智能出行 智能手机 数码极客 商业资讯

快手Kwaipilot开源“AutoThink”大模型,深度思考不再“过度”

2025-06-04来源:ITBEAR编辑:瑞雪

近日,快手Kwaipilot团队宣布了一项技术突破,他们开源了一款名为KwaiCoder-AutoThink-preview的自动思考大模型。这款模型是团队针对当前深度思考大模型普遍存在的“过度思考”问题,进行深入研究后取得的成果。

为了解决这一问题,Kwaipilot团队提出了一种创新的自动思考模型训练范式,并基于传统的强化学习算法GRPO,进一步研发了带有过程监督的强化学习方法Step-SRPO。这一新方法旨在提升模型在复杂任务中的表现,使其能够更加智能地应对各种挑战。

KwaiCoder-AutoThink-preview模型的最大特点在于,它融合了“思考”与“非思考”两种能力,被形象地称为“DeepSeek-V3 & R1 合体”。这款模型能够根据问题的难易程度,自动切换思考形态,从而在不同类型的任务中展现出卓越的性能。在多个评测榜单上,这款模型在“思考”和“非思考”模式下均取得了显著的性能提升,特别是在代码和数学类任务上,自动思考模式下的模型得分提高了近20分。

值得注意的是,即使在未开启思考模式的情况下,这款模型也展现出了不俗的性能。这得益于其更优的推理形态,使得模型在部分榜单中的性能有了小幅度的提升。这一发现无疑为深度学习领域带来了新的启示,也展示了Kwaipilot团队在技术研发方面的深厚实力。

据快手技术团队介绍,他们将继续基于preview版本模型进行研发,进一步增强其推理能力和支持更完善的思考中工具使用能力。同时,他们也承诺将全部技术细节和训练方法开源,为深度学习领域的研究者提供更多的参考和借鉴。这一举措无疑将推动深度学习技术的进一步发展,为人工智能领域的创新注入新的活力。

阿里巴巴“通义”App升级更名“千问”,AI战略转向消费级市场新布局
根据官方消息,“千问”定位为阿里旗下最重要的大模型应用入口,其核心能力基于阿里自研的大模型体系Qwen(千问)。 分析人士指出,阿里此前在To B市场和模型研发侧拥有技术基础,但在消费端应用分发层面还未形成…

2025-11-15

Dexmal原力灵机获近10亿融资 阿里蔚来资本助力具身智能研发落地
IT之家 11 月 14 日消息,具身智能公司 Dexmal 原力灵机今日宣布完成数亿元 A+ 轮融资,阿里巴巴为独家投资方。IT之家注意到,该公司 A 轮融资由蔚来资本领投,洪泰基金、联想创投、锡创投和正…

2025-11-14

百度世界大会发布文心大模型5.0 参数量2.4万亿能力达全球领先
文心5.0基础能力全面升级,在多模态理解、指令遵循、创意写作、事实性、智能体规划与工具应用等方面表现突出,拥有强大的理解、逻辑、记忆和说服力。不同于业界多数的多模态模型采用后期融合的方式,文心5.0的技术路…

2025-11-13