GenAI新世界

7月17日 AI 头条|前OpenAI 科学家宣布创业,成立 AI 教育公司

Image

划重点:
  • 前OpenAI 科学家宣布创业,成立 AI 教育公司
  • Mistral AI 发布首款MathΣtral模型,专为数学推理研发
  • Mistral AI 发布开源代码新模型 Codestral Mamba
  • 字节跳动或在本周公布 AI 模型技术进展
  • 多家 AI 科技公司被曝光使用未经授权的内容训练大模型
  • 魅族联手中国移动推出魅蓝 20 AI 手机
  • 英国监管机构正调查微软 Inflection AI 相关交易
  • 商汤联手中国国家篮球队,AI大模型助力征战巴黎
  • 小冰AI数字员工升级:发布全新“零样本”技术、超千亿大模型基座
  • Cohere宣布与富士通合作推出日语大语言模型Takane
资讯详情:
前OpenAI 科学家宣布创业,成立 AI 教育公司
OpenAI 前科学家Andrej Karpathy今天在X上宣布,他创办了一家名为Eureka Labs 的 AI+教育公司。
Karpathy 表示,Eureka Labs的愿景是让任何人都可以轻松学习任何东西,扩大教育的范围(大量人学习某些东西)和范围(任何一个人学习大量科目,超出了今天在没有帮助的情况下可能达到的范围)。
Eureka Labs的第一个产品是 AI 课程 LLM101n,这是一门本科课程,指导学生训练自己的人工智能,与人工智能教学助理本身的缩小版非常相似。课程材料将在线提供,Eureka Labs也计划组织线上和线下团队一起学习。
Image
Mistral AI 发布首款MathΣtral模型,专为数学推理研发
据 Mistral AI 官方消息,Mistral AI 推出专为数学推理和科学发现而设计的 7B 模型MathΣtral ,向阿基米德致敬。
MathΣtral专攻 STEM 学科。在各种行业标准基准测试中,它的推理能力在同类产品中处于领先水平。MathΣtral 可以通过更多的推理时间计算获得更好的结果:Mathstral 7B 在 MATH 中的多数投票得分率为 68.37%,在 64 个候选者中的强奖励模型得分率为 74.59%。
用户现在就可以使用 mistral-inference 尝试 Mathstral,并使用 mistral-finetune 对其进行调整。
Image
Mistral AI 发布开源代码新模型 Codestral Mamba
据 Mistral AI 官方消息,Mistral AI 推出了一个名为 Codestral Mamba 的新模型,这是对埃及女王克娄巴特拉的致敬。
与 Transformer 模型不同,Mamba 模型具有线性时间推理的优势,能够处理无限长度的序列。该模型适用于代码生产力的高效模型,提供快速响应。Codestral Mamba共有 7285403648 参数,上下文检索能力达 256k tokens。
该模型是 Mamba2 系列的一部分,专注于代码生成,并以 Apache 2.0 许可证发布。
Image
字节跳动或在本周公布 AI 模型技术进展
据钛媒体报道,字节跳动团队将在 7 月 19 日本周五首次大范围公布文生图、类 Sora 新视频等全新人工智能模型技术进展,特别会在长视频、高动态方向上提出创新技术,或将直接对标 Sora 文生视频模型。
有消息人士透露,字节跳动内部将 AI 大模型设为集团 P0 最高级别的方向,还有消息称抖音、剪映等内部多个团队也在研发 AI 视频模型应用,预计也将于近期公布。
作为对比,另一家短视频巨头快手在 AI 视频大模型领域进展迅速,旗下有可灵视频大模型应用、可图文生图大模型等产品。快手透露,视频生成大模型可灵平台申请用户数超过 50 万,开通用户数超过 30 万,生成视频数达 700 万以上。
Image
多家 AI 科技公司被曝光使用未经授权的内容训练大模型
据 Wired 报道,包括苹果、英伟达等多家设计 AI 大模型业务的科技巨头正在使用未经授权的视频素材来训练大模型。
据报道,这些公司正在利用 YouTube上的视频素材来训练大模型,而这些行为并没有获得创作者的授权。而这违反了 YouTube 禁止从平台上未经许可抓取内容的规定。据悉,超过 17.3 万个来自 4.8 万个频道的 YouTube 视频字幕文件被用来训练人工智能模型,其中就包括苹果、英伟达、Salesforce 等硅谷巨头。
据报道,下载这些字幕文件的是一个名为 EleutherAI 的非营利组织,他们声称其目的是帮助开发者训练 AI 模型。虽然 EleutherAI 的初衷可能是为小型开发者和学术研究者提供训练材料,但该数据集也被苹果等科技巨头使用。
Image
魅族联手中国移动推出魅蓝 20 AI 手机
据魅族官方消息,魅族联手中国移动即将发布全新魅蓝20 AI 手机,将在7月22日发售。
魅蓝 20 AI 手机机身设计为 2.5D 水滴直屏,处理器方面搭载紫光展锐 T765 5G 处理器,支持亿级像素高清拍照和 4K 高清视频录制播放,最高支持 12GB+2TB 配置。屏幕为 6.52 英寸 90Hz 屏幕,续航方面搭载 5010mAh 电池,主摄为 5000 万像素,前置为 800 万像素。
魅蓝20 AI 手机的价格目前尚未公布。
Image
英国监管机构正调查微软 Inflection AI 相关交易
据 The Verge 报道,英国竞争和市场管理局正在兼并规则正式调查微软聘用 Inflection AI 员工一事。
据报道,英国竞争和市场管理局(CMA)目前正在对这一合作展开第一阶段的合并调查,调查是否会进入第二阶段的截止日期是9月11日。如果案件进入第二阶段,那么它将成为微软人工智能雄心的绊脚石。CMA 上一次表示要对微软在 2022 年以 687 亿美元收购动视暴雪的交易进行更深入的审查,最终迫使该公司重组交易,放弃了在英国和全球许多其他市场的关键云游戏权利。
Image
商汤联手中国国家篮球队,AI大模型助力征战巴黎
据商汤科技官方消息,商汤科技与中国国家篮球队达成战略合作,将基于商汤“日日新SenseNova5.5”大模型技术共同打造AI大模型篮球产品。
根据协议,商汤科技将作为中国国家篮球队人工智能战略合作伙伴,共同开发中国国家篮球队运动表现分析平台,助力运动员提升训练效率和竞技水平。同时,将AI大模型技术应用于数据统计和比赛视频处理,为训练和竞技策略提供决策依据,赋能智慧体育的创新发展。
此次战略合作的达成,标志着商汤AI大模型与中国篮球全面深度合作,期待智能技术的融入将成为提升运动员表现的强劲引擎。商汤AI大模型篮球产品不仅运用于竞技体育,在青训体育与大众体育方面也有广泛落地场景应用。未来,商汤科技将持续探索AI大模型技术在篮球及体育产业中的创新应用,为推进体育强国建设贡献力量。
Image
小冰AI数字员工升级:发布全新“零样本”技术、超千亿大模型基座
据小冰公司官方消息,小冰开启数字人自由新时代,实现“零样本”学习、极速定制。
新版小冰数字人加入了零样本数字人技术(Zero-shot Xiaoice Neural Rendering,Zero-XNR)、超千亿大模型基座及透影音画传输系统。其中全新Z-XNR技术通过与TTS语音大模型的融合框架,实现了秒级数据高质量形象声音复刻,同时保持了数字人复刻的高质量和视觉个性化表达。
小冰公司强调其技术创新的力量,并致力于推动数字人的普及和产业发展。
Image
Cohere宣布与富士通合作推出日语大语言模型Takane
据 VentureBeat 报道,Cohere与日本信息技术巨头富士通近日宣布达成战略合作,计划共同推出名为Takane的日语大型语言模型。
该合作旨在为企业提供强大的日语语言模型解决方案,提升客户与员工的使用体验。Cohere将利用其AI模型的优势,富士通则运用其在日语训练与调优技术方面的专业知识。富士通在信息技术服务领域的成功,使其能够有效地将Cohere的技术与本地市场需求相结合,推动企业的数字化转型。
据悉,Takane将基于Cohere的Command R+模型,这是一种专为实际商业应用设计的高端可扩展大型语言模型。该模型将为企业提供多语种支持、最佳引用生成(RAG)以及强大的API工具,帮助企业在复杂的工作流中实现自动化。
Image
今日重点论文:
加州大学
《Beyond Euclid:An Illustrated Guide to Modern Machine Learning with Geometric, Topological, and Algebraic Structures》
论文旨在解决在机器学习中遇到的非欧几里得数据的处理问题,这种数据具有复杂的几何、拓扑和代数结构。该论文试图通过提出一种新的数学视角来解决这个问题。这是否是一个新问题?该论文提出了一种新的数学框架,将非欧几里得结构纳入到机器学习中。这种框架可以推广到各种类型的非欧几里得数据,包括具有曲率的时空数据、神经元之间的拓扑复杂相互作用以及描述物理系统对称性的代数变换。相比当前领域的研究,该论文的思路具有新意。
论文地址:
https://arxiv.org/abs/2407.09468v1
ARC:
《Reactor Mk.1 performances: MMLU, HumanEval and BBH test results》
这篇论文通过基准测试分析,介绍了ARC旗舰大语言模型Reactor Mk.1的性能结果。该模型采用了荔枝AI引擎,参数少于1000亿,具有高效和强大的组合特点。Reactor Mk.1在MMLU数据集上获得了92%的分数,在HumanEval数据集上获得了91%的分数,在BBH数据集上获得了88%的分数,超越了GPT-4o、Claude Opus和Llama 3等模型。它在处理困难任务和推理方面表现出色,成为当今尖端人工智能技术中杰出的解决方案。
论文地址:
https://arxiv.org/abs/2406.10515v1
都柏林圣三一大学:
《Large Models of What? Mistaking Engineering Achievements for Human Linguistic Agency》
该论文试图解决对大型语言模型(LLMs)的语言能力的夸大和误导性的声明,这些声明基于至少两个无根据的假设。论文从行动主义的角度出发,认为语言不是一个完整的事物,而是一种行动方式,具有体现、参与和不稳定性等特征,这些特征在当前的LLMs中是缺失的,因此LLMs不能像人类一样成为语言代理。
论文地址:
https://arxiv.org/abs/2407.08790v1
奥本大学:
《Vision language models are blind》
评估现有的大型语言模型在解决简单的视觉任务上的表现,探讨它们在需要精确空间信息和计数时的表现情况。提出了BlindTest套件,包含7个对人类来说非常简单的视觉任务,通过测试四种最先进的VLM,发现它们在BlindTest上的平均准确率只有56.20%,其中 ewsonnet表现最好(73.77%准确率)。
论文地址:
https://arxiv.org/abs/2407.06581v3
Image