四川省发布首批8个人工智能高质量数据集
2024年9月24日,在2024年“数据要素×”大赛四川分赛总决赛活动上,四川省正式发布了首批8个人工智能高质量数据集。此举旨在贯彻落实省委、省政府关于推进人工智能1号创新工程的决策部署,有效满足人工智能模型训练和优化的数据需求,并以此加快培育本土人工智能龙头企业和大模型集群。
此前,省发展改革委(省数据局)和省大数据中心组织开展了为期数月的四川省人工智能高质量数据集征集工作。通过严格的现场调研和综合评估,最终遴选出这8个数据集。这些数据集经过了清洗、标注等严格的数据处理,在格式、质量等方面均符合国家相关标准和要求,并以文本、图像、音频、视频等多模态形式呈现,可以直接用于人工智能模型的开发和训练,涵盖了行业通识和行业专识数据集。
这批数据集充分利用了四川省丰富的海量数据资源,数据规模巨大,包含文本75.69TB、图像20.35PB、音频22.83TB、视频1.2PB、3D模型62TB。其应用场景广泛,涵盖医药研发、商贸流通、公共安全、能源调度等多个领域。此举对推动四川省人工智能产业发展,构建完整的产业链条,并加快进入全国人工智能第一方阵具有重要意义。其海量数据和多模态特征,将为四川人工智能产业的创新和发展提供强有力的支撑。
未来,省发展改革委(省数据局)将持续支持和鼓励行业企业、数据服务商和社会资本,积极整合公共数据、企业数据等各类数据资源,建设更多具有四川地方特色的高质量数据集,并按照国家标准要求,分批次予以发布,为四川人工智能产业的蓬勃发展提供源源不断的动力。
免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,可联系本站进行审核删除。