中国正向数十个发展中国家出口低成本的人工智能模块,这些模块包含大量带有中国特色的数据,并随着AI技术发展不断扩展,这引发对官方宣传和北京叙事渗透全球知识系统的担忧 [1, 2, 3]

纽约时报2026年8月17日报道称,中国国家数据局于年初公布了一项大数据发展蓝图,计划到2028年成为全球大数据强国。蓝图涵盖研究制造、汽车等20多个领域,致力于向全球发布高质量数据模块,并向数十个发展中国家提供数据支持 [1, 2, 3]。同时,中国承诺在上海举办的世界人工智能大会上提供来自官方实验室和国家媒体的信息供全球下载 [1, 2, 3]

北京视AI为与美国竞争的关键战略技术,强调需要更复杂和高质量的数据支持AI实验室研发,但国内数据因分散在政府机构和企业间,尚难以充分整合用于训练。相比之下,美国公司在数据获取和注释成熟度上优势明显,拥有专门团队和数据供应商如Mercor和Scale AI支持 [1, 2, 3]

此外,中国国家数据局正推动从廉价人工注释向专家注释转型,鼓励高校开设注释课程并吸纳毕业生加入注释岗位,提升数据质量 [1, 2, 3]

科学杂志《自然》近期发表研究称,中国官方叙事迅速进入美国主要AI平台如ChatGPT和Claude的训练模块。研究发现,中文答案更贴近北京立场,英文版本则较少出现这种倾向 [1, 2, 3]

此前,2023年北京理工大学的研究指出,ChatGPT在处理中文时存在偏见,敢于回答中国政治相关问题,却会在描述中国文化名人和经典如姚明和《红楼梦》等方面出现错误和混淆 [1, 2, 3]

澳大利亚战略政策研究所研究员Alex Colville指出,“问题在于极权国度将掌控AI聊天室内的价值观” [1]。大西洋理事会高级研究员Kenton Thibaut表示,北京致力打造低成本“具有中国特色的AI”模块,功能接近美国巨资开发的平台,对发展中国家用户极具吸引力,且中国AI模块在这些国家已有重大进展 [1]

中国庞大的数字用户基础超过数亿人与本土平台互动,但如何整合和利用散落的数据资源,提升训练数据质量,仍是其面临的挑战之一 [1, 2, 3]。未来,中国围绕高质量大数据的国际发布和出口,将继续影响全球AI知识体系的内容和视角。