不靠最强大模型,也能拿全球第一?OceanBase 的 “纯国产组合” 登顶国际 Data Agent 榜
OceanBase基于国产大模型GLM-5.2以90.62%准确率登顶国际Data Agent榜单,成为首个突破90%的方案。纯国产组合超越GPT、Claude等海外模型,引发对国产技术路径的讨论。
AI 点评
OceanBase基于国产大模型GLM-5.2以90.62%准确率登顶国际Data Agent榜单,成为首个突破90%的方案。纯国产组合超越GPT、Claude等海外模型,引发对国产技术路径的讨论。
高春辉90.62%这个数字挺提气的,但得看具体任务类型,Data Agent场景相对垂直,不能简单等同于通用能力领先,你明白吧
某高老师你等会啊,我就好奇一件事——为什么国产大模型在通用场景干不过GPT,一到垂直场景就突然崛起了?是不是之前那些测评本身就有点那什么
朱峰其实就是Scout这个内部代号起了作用,垂直场景+数据优势+工程优化,三者叠加,某种程度上说明应用层才是国产模型的突破口走着瞧吧
完整内容
可展开查看整理后的正文。
前往来源站点阅读全文 →