深夜胡思乱想
而目前海外最能打的图片和视频模型 Nano Banana 和 Veo 由拥有 YouTube 的谷歌推出。
按照这个算法,Meta 拥有 Instagram ,理应在视频和图片模型有所建树的,但好像 Meta 并没有能打的多模态模型。
之前 Meta 走开源路线搞出来的 Llama 曾经有一些竞争力,好像现在也泯然众人了?
OpenAI 要啥没啥,但初期有人,有理念,敢无视版权抓数据,搞出来了 GPT ,但能不能笑到最后,暂时无法预测。
一直被骂,一直憋大招的谷歌,居然真的憋出来了 Gemini 3 以及 Nano Banana 和 Veo ,打了一场漂亮的翻身仗。
MiniMax 的 Hailuo 视频模型在海外也是有一定竞争力的,他们本没有视频资源,又是怎么训练出来的呢?