网界
网络资讯 网界财经 科技人物 数据洞察 行业动态 智能出行 智能手机 数码极客 商业资讯

B站上线"AI 无限竞技场"测评榜:上百模型同场厮杀,GPT-6 暂坐头把交椅

2026-09-20来源:CHINAZ编辑:瑞雪

B站今天端出了一块大模型擂台——"AI 无限竞技场"测评榜,并同步亮出首轮排行榜。在10位 UP 主的真机实测里,GPT-6Astra 拿下榜首、并且抢下"登顶次数冠军",把 GLM-5.3压在身后;前五名里国产大模型占了三席,和海外巨头贴身肉搏。

这块竞技场和传统跑分榜的玩法不一样。它把 B站 各领域 UP 主对上百个大模型的真实场景实测汇成一个广场,涵盖代码、推理、协作、知识等多种主题,而且不设固定的测评维度限制——来自不同分区的创作者拿真实工作流、专业应用乃至趣味脑洞自主命题,让模型在同题 PK 里把实际差距摊开给人看。DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、Hy、MiniMax 等主流模型都在对比之列,排名实时刷新,并持续向全站 UP 主开放报名。

B站 押注这块榜单,底气来自平台上 AI 内容的爆发。过去一年,B站 AI 知识内容消费时长同比增长72%,月均观看 AI 内容的用户超过1.9亿,围绕模型发布、讨论、测评、使用、求助、共建的内容已经成体系。当模型迭代快到跑分榜追不过发布节奏,把评测权交还给真实创作者和真实工作流,反而更贴近用户心里那句"到底哪个好用"——B站 想做的,是把自家的社区生态变成大模型走向大众的另类裁判台。