B站近日正式推出“AI无限竞技场”大模型测评榜单,并同步公开首期排名结果。在首批参与测评的10位UP主测试中,GPT-6 Astra以综合表现登顶榜首,其击败GLM-5.3的次数位列第一。值得注意的是,前五名中有三个席位被国产大模型占据,展现出本土技术的竞争力。榜单实时更新机制与开放报名入口,标志着该平台正构建AI模型评测的动态生态系统。
与传统实验室评测不同,该榜单采用“真实场景实测”模式。来自科技、教育、娱乐等不同领域的UP主,根据自身专业需求设计测试方案,涵盖代码生成、逻辑推理、多模态协作等十余个维度。例如,编程类UP主会通过实际项目开发检验模型效率,科普创作者则侧重知识检索的准确性。这种“自主命题+同题竞技”的方式,使测评结果更具实践参考价值。
目前榜单已收录DeepSeek、Kimi、ChatGPT、Claude等20余个主流模型,测评数据来自超过百位创作者的深度测试。平台特别开发了可视化对比工具,用户可直观查看不同模型在相同任务中的响应速度、结果质量等差异。这种开放透明的评测机制,正在吸引更多专业创作者加入测评队伍。
数据表明,B站已成为国内最大的AI内容消费社区之一。过去一年中,用户观看AI相关内容的总时长增长72%,每月有超过1.9亿人主动搜索AI技术资讯。从模型评测到应用教程,从技术讨论到行业分析,平台已形成完整的内容生态链。这种用户自发形成的评测文化,正在推动AI技术从实验室走向实际应用场景。








