科技·商业·财经

B站“AI无限竞技场”开榜:GPT-6 Astra领跑,国产大模型强势占据前三半壁江山

   时间:2026-09-20 16:09 作者:陆辰风

近日,哔哩哔哩(B站)正式推出“AI无限竞技场”大模型测评平台,同步发布首期榜单数据。在首轮测评中,GPT-6 Astra以绝对优势登顶榜首,在十位UP主参与的测评中全部获得第一,力压GLM-5.3摘得“榜首次数冠军”。值得关注的是,国产大模型在榜单前五名中占据三席,展现出强劲竞争力。

该平台突破传统测评框架,采用“去中心化”运作模式。来自科技、教育、娱乐等不同领域的UP主可自主设计测评场景,涵盖代码编写、逻辑推理、跨语言协作、专业知识检索等实用维度。这种以真实工作流为核心的测评方式,通过趣味脑洞与专业场景的结合,直观呈现各模型在不同任务中的性能差异。

首期榜单覆盖DeepSeek、Kimi、ChatGPT、Claude、Gemini等国内外主流模型,测评结果实时更新并接受全站UP主报名挑战。平台数据显示,过去一年B站AI相关内容消费时长激增72%,月均观看用户突破1.9亿,形成涵盖技术解析、场景测评、使用教程的完整内容生态链。

与传统量化评测不同,“AI无限竞技场”更注重实际应用场景的还原度。测评者既会设计“用AI生成完整游戏脚本”这类复杂任务,也会设置“用方言描述需求并获取解决方案”等趣味挑战。这种多元化测评体系,既为开发者提供优化方向,也为普通用户提供直观的选型参考。

随着榜单持续更新,平台已吸引数百位专业UP主参与测评。从编程助手到创意生成工具,从学术研究辅助到日常办公提效,不同领域的需求碰撞出丰富的测评维度。这种由用户驱动的开放式测评模式,正在重塑AI大模型的评价标准体系。

 
 
更多>同类内容
全站最新
热门内容