首页资讯

国家数据局:我国日均Token消耗量突破30万亿,一年半增长300多倍

时间:2025-08-14 22:14 作者:纵小我

国家数据局:我国日均Token消耗量突破30万亿,一年半增长300多倍

IT之家 8 月 14 日消息,据中国新闻网今天报道,国务院新闻办公室今天举行了“高质量完成‘十四五’规划”系列主题新闻发布会,其中国家数据局局长刘烈宏作出了相关报告、解读。


刘烈宏介绍道,2024 年初中国日均 Token 的消耗量为 1000 亿,截至今年 6 月底,日均 Token 消耗量已突破 30 万亿,1 年半的时间增长了 300 多倍,反映了我国人工智能应用规模快速增长。

刘烈宏还指出,中国一直在持续推进高质量数据集建设工作,截至今年 6 月底,中国已建设高质量数据集超过 3.5 万个,总体量超 400PB(409600TB)

同时,AI 模型训练也推动了数据交易需求,今年 6 月底前中国各地高质量数据集累计交易额近 40 亿元人民币,数据交易机构挂牌的高质量数据集总规模达 246PB(251904TB)。北京数交所的高质量数据集占交易总量的比例从去年的 10% 跃升到目前的近 80%。


中文数据也在国内大模型的训练性能提升方面发挥重要作用,目前中国多数模型训练使用的中文数据占比已超过 60%,有的模型已达 80%。

IT之家注:Token(常被称为词元)是计算机科学与自然语言处理领域中的一个基础且重要的概念,通常指文本数据经过分词或标记化处理后的最小单位,其中单位可以是单词、标点符号、数字或其他任何有意义的符号。

Top

1、A股沪指突破3700点,2021年12月以来首次,a股大反攻:沪指暴涨百点 两市成交超4000亿创新高

2、60万份快递发货单背后:一场关乎直销企业清白的拉锯战,快递发货单价

3、男子柬埔寨失联近2月,家属被威胁“这里弄死一个人像捏死蚂蚁”

小编推荐

当前文章:http://www.share.tuanjian7.cn/EKB/detail/zjqsiz.html

相关阅读

网友评论

我要评论

发表

取消

纵小我