阿里巴巴 CEO 张勇发布致股东的信,其中提及:阿里巴巴将始终坚持长期主义,坚持创造价值,坚持消费、云计算、全球化的三大战略。过去 20 年,我们把握住了面向消费互联网的中国电子商务以及面向产业互联网的中国云计算市场这两个历史性的机遇。面向未来,我们也会继续基于消费互联网和产业互联网的双轮驱动,一方面服务好千家万户,一方面支撑好千行百业。同时,张勇也强调了对人工智能的重视:在从数字化时代走向智能化时代的历史新起点上,我们更要把握技术对商业变革的颠覆性机遇,抓住人工智能技术日新月异的历史契机,开拓未来更大发展空间。我们相信,人工智能发展带来的绝对不仅仅是效率提升,最终一定是全新价值的创造。除此以外,阿里巴巴年报还显示,菜鸟集团 CEO 万霖和国际数字商业集团 CEO 蒋凡已成为阿里合伙人。目前,菜鸟正筹备 IPO,国际数字商业则在启动外部融资。澎湃援引阿里人士称,两人成为合伙人说明成绩得到了充分认可。
Google 创始人回归,新大模型或今年可用
《华尔街日报》援引 Google 内部工作人员消息称,原本已经「退隐」的 Google 创始人 Sergey Brin,最近每周都会有三到四天造访 Google 的办公室,和研究人员合作开发 Google 的 AI 大模型「Gemini」。知情人士称,Brin 去年就曾回归参与 Google 内部 AI 会议,而现在参与的频率和强度都有增加。据悉,负责 Gemini 项目的高管 Demis Hassabis 还在最近的一次全公司会议上告诉员工,全新大模型 Gemini 最快今年可用。今年,Google 母公司 Alphabet 旗下的重要 AI 团队 DeepMind 和 Brain 合并,原 DeepMind 创始人 Demis Hassabis 出任 CEO。至于大模型 Gemini,此前有消息称,它将会把 AlphaGo 与 GPT-4 等大模型的语言功能合并,其系统解决问题和规划的能力将大大增强。
华为云公有云业务部总裁高江海在发布会上宣布,华为云自动驾驶开发平台正式发布。该平台基于盘古大模型和 ModelArts AI 开发生产线,提供了数据生成、自动标注、模型训练、云端仿真、虚实结合仿真、数据闭环等一系列能力,帮助车企和商用车企业加速自动驾驶算法的开发验证和优化迭代,降低成本和风险,提升效率和安全性。
据《金融时报》,微软、OpenAI 和 AI 创业公司 Cohere 已经开始为训练 AI 专门生成数据了。此前,无论是 GPT 还是 Bard,这些大模型基本上都是用互联网上的数据来训练。但随着大模型日益变得成熟,这些数据已经显得不足够。大模型需要更成熟的数据以应对科学、医学或商业上的需求。理想情况下,这些数据当然最好是由各个领域的专家来撰写,或者是购买企业的专利信息。然而,这也太昂贵了。因此,用合成数据(synthetic data)成了一种新趋势。这些公司会用 AI 去生成关于医学、金融等专业领域更复杂的文本或代码,然后拿这些数据去训练比较成熟的大模型。(合成数据)已经很流行了…… 虽然它没有被很广泛地传播。譬如,AI 公司可以用两个 AI 模型对话聊高数,其中一个是老师,另一个是学生。这些模型对话就会产生很多高数相关的细分信息。微软在最近的两份研究论文里,也曾表示公司使用了合成数据来训练较小规模的模型。评论指出,用合成数据训练大模型的危害在于,这些数据不一定能准确地反映真实世界的数据。鉴于现在网上都有不少数据是 AI 生成的,一不小心 AI 也会抓取到由更初代 AI 生成的原始数据,然后再一次被处理并拿去训练新 AI。