往事陈列馆

两会提案背后的生意

两会期间,各种提案纷纷亮相。朋友转来一则报道:《张勤委员:推动人工智能赋能中华优秀传统文化传播》。

Image

只看这个标题,大家可能会有这种感觉:提案内容是有点另类,但这位代表似乎对保护传统文化还挺上心啊?

但是,别急,你看完整个提案,就知道这位代表的“用心”了,我截两段原话:

“作为音视频语料库最丰富的机构,中央广播电视总台已与高校、科研机构、国内企业联合在人工智能领域开展了卓有成效的探索,并与多家机构共同发起成立“中国大模型语料数据库联盟”,联合发布“央视听媒体大模型”……

“建议集聚资源打造中央广播电视总台牵头重大原创平台……第一、国家发展改革委和财政部以重点项目和专项资金,支持中央广播电视总台牵头推进中华优秀传统文化与人工智能等现代技术结合的工作。”

Image

你看明白了吧,张勤委员作为中央广播电视总台新闻中心副召集人,这是明着替自己的单位在向国家要钱要项目呢!

在一般人看来,两会是很庄重的,代表的提案应该是聚焦公共利益、推动社会进步的。比如,要求出台新的政策法规是很常见的。

当然,作为社会改革的措施,两会必然会涉及到权利、资源、责任的重新划分和分配。提案不是不能谈“生意”,比如,有些提案能促进本行业发展,把本行业做大做强,从而间接有利于国家和公共利益,这种提案也是好提案。

人工智能确实是当下的风口,很多代表委员的提案都涉及人工智能领域。但是,大家的关注点一般在于创新环境、算力、生态建设等方面,因为这才是核心竞争力,这是关系到大国竞争中谁能胜出的问题。

至于传统文化,就算是这方面的语料再丰富,输入再多,跟AI大数据模型的优劣关系不大,对于中美谁能在人工智能竞争中胜出一筹没有影响。

张勤委员认为,“当前全球通用(国内也在使用)的大模型数据训练集里,中文语料仅占1.3%,中国企业使用的语料中,由美西方主导的英文语料占绝大多数,如果我们训练的大模型持续用西方价值观数据、西方应用场景来训练中国大模型,中国式的认知将被湮没。”

Image

这个观点表面看有点道理,实际上是本末倒置。中文语料占比少,根本原因在于现代科学技术起源于西方,也兴盛于西方,而现代科技彻底改变了人类生活,中国在此方面贡献不多,这是事实,没什么不敢承认的。

中国要发展自己的人工智能,训练自己的大模型——如果这种大模型是想和国际水平一争高低的,那么必然是要大部分使用英文语料,这是绕不开的问题。如果还纠结于什么“西方认知“,那么这种大模型一定是”出师未捷身先死“。

所以,张勤委员所发明的“西方价值观数据”,完全是不知所云。

传统文化不是说没有可取之处,但如果它对于大数据模型很重要、用户很需要、应用场景很多,恐怕国外的AI公司自己都会连夜投入重金去利用起来。

即使是我们中国人觉得传播传统文化很重要,也未必要通过输入AI大模式再输出的方式来传播。在做这件事时,必须考虑到:训练大数据模型非常烧钱,投入很大,钱是否花在了优先事项上?“中国式认知”这种东西是否适合AI输入和输出?

我们甚至可以这么想一想:如果传统文化在现实中都很难保护,你能期待借AI逆风翻盘吗?

当然,如果是某个AI公司自己觉得需要通过大量输入传统文化来训练AI,那是他自己的钱,他爱怎么折腾都行,但是,张勤委员是想向国家要钱,这就很可疑了。

她的提案,对于中国人工智能行业的发展没啥用处,对于保护传统文化,投入产出比也很低。如果真的落实了,最后只是花了大量的国家资源,最后只肥了他们单位以及少数关系户。

这种提案,甚至都不叫生意,生意总还是要利它的,这叫以公谋私。

对于这种提案,大家一定要擦亮眼睛。