设为首页 加入收藏
  • 首页
  • 知识
  • 百科
  • 综合
  • 焦点
  • 热点
  • 休闲
  • 当前位置:首页 > 探索 > 全球权威评测榜单BIRD:蚂蚁数科超越谷歌等公司位居第一

    全球权威评测榜单BIRD:蚂蚁数科超越谷歌等公司位居第一

    发布时间:2026-10-04 04:28:30 来源:软香温玉网 作者:热点

    9月26日,全球权威据全球权威评测基准BIRD-Bech官网,评测蚂蚁数科的榜单数据分析智能体Agentar-SQL超越AT&T(美国电话电报公司)、谷歌云、蚂蚁腾讯云、数科司位阿里云等诸多国内外厂商,谷歌位居全球第一。居第这也是全球权威中国公司在该榜单上取得的最高成绩。

    全球权威评测榜单BIRD:蚂蚁数科超越谷歌等公司位居第一

     

    BIRD-Bench是公认的全球最具权威性的自然语言转SQL评测基准,要求AI大模型将自然语言查询转换为结构化查询语言(SQL),榜单并且在真实复杂的蚂蚁大规模生产级数据库中稳定执行。BIRD--Bench数据集覆盖金融、数科司位电力、谷歌医疗等37个行业场景,居第总量33GB,全球权威包含超过1万条高复杂度查询任务,是全球顶级AI团队展示技术实力的权威平台。

    值得一提的是,蚂蚁数科Agentar-SQL在BIRD榜单的执行准确率排行榜(81.67分)以及执行效率榜上(77分)上均取得第一的成绩。这意味着蚂蚁数科在智能问数领域的技术创新实现全球领先。

    据介绍,Agentar-SQL智能体基于蚂蚁数科的SQL大模型Agentar-Scale-SQL构建,旨在让用户可以通过自然语言轻松完成复杂的数据查询任务。它通过GSPO(组序列策略优化)强化学习训练方法,能够增强SQL内在推理,让大模型在推理阶段,深度思考SQL框架,避免潜在的逻辑错误,提升SQL逻辑准确性;此外,Agentar-SQL具备多轮反思修正的能力,让模型对生成的SQL进行多轮次的审视和修正,提升SQL语言的精准性;Agentar-SQL还通过独创的两阶段生成法,让大模型生成多个SQL候选,再对SQL进行两两PK的“锦标赛”,筛选出最优的SQL。

    蚂蚁数科持续深耕AI大模型技术与应用,此前其自研的金融推理大模型Agentar-Fin-R1,在多项主流金融基准测试实现领先。专为新能源行业定制的能源电力垂类时序大模型在行业评测集上的发电量预测准确率超越谷歌(TimesFM-V2.0)、亚马逊(Chronos-Large)等行业主流的通用时序模型。


    • 上一篇:这都有漏捡! 《废土:复刻版》意外可在Xbox商店免费领取
    • 下一篇:昼夜温差大!福建下周天气总体较好,偶有阵雨客串

      相关文章

      • 百万身价是意外保险,百万身价意外保险好吗?
      • 瑞达货物:玻璃减仓缩量,期价小幅收涨,行业资讯
      • 廖昌永:商演真唱是对观众的尊重
      • 产销总体尚可,价格存在压力!,产业数据
      • 我市6月份居民消费价格指数同比上涨1.0%_
      • 斥資58億!CNN收購科技部落格Mashable|天下雜誌
      • 2026年Q1全球腕戴市场微增 手表走强手环遇冷
      • 天玑9500超能版 vivo X Fold6配定制版芯片
      • 45岁可以买的重疾险,2022年45岁可以买的重疾险
      • 今日立秋 下周稍凉快些 河南局部有大暴雨

        随便看看

      • 家庭意外险包括哪些?家庭意外险包括哪些范围
      • 速讀今日國際財經日誌(03/21)|天下雜誌
      • 施琅留存厦门唯一宅邸“焕新生”
      • 瑞达货物:玻璃减仓缩量,期价小幅收涨,行业资讯
      • 2020最好的重疾险是什么?2022最好的重疾险是什么?
      • 《控制》社区经理发表暴论:我要把所有角色变成同
      • 阿里云创始人王坚:AI对科研的影响,与对程序员的冲击逻辑一致
      • 黄剑雄: 全面加强和改进人才工作 为潜江发展筑牢人才之基
      • 把课堂搬到床头 用爱心叩开心门_
      • 2026大家佑享养老年金保险怎么样?能领多少钱?利益演示+条款详解
      • Copyright © 2026 Powered by 全球权威评测榜单BIRD:蚂蚁数科超越谷歌等公司位居第一,软香温玉网   sitemap