GenAI新世界

8月9日 AI 头条|分析师:苹果或对部分Apple Intelligence功能收取高至20美元的费用

Image
划重点:
  • 分析师:苹果或对部分Apple Intelligence功能收取高至20美元的费用
  • 通义千问开源数学模型Qwen2-Math,数学能力超越GPT-4o
  • OpenAI 宣布 DALL-E 3 模型向 ChatGPT 免费用户开放
  • 字节跳动旗下豆包上线音乐生成功能
  • 字节豆包大模型已支持实时语音通话
  • OpenAI 据悉将参与硬件开发商 Opal 的新一轮融资
  • OpenAI 任命卡内基梅隆大学教授 Zico Kolter 为新董事
  • 秘塔科技完成超1亿元融资,蚂蚁集团领投
  • 小米旗舰设备国际版将接入谷歌 Gemini 大模型
资讯详情:
分析师:苹果或对部分Apple Intelligence功能收取高至20美元的费用
据财联社报道,Counterpoint Research合伙人Neil Shah表示,由于对人工智能投资成本高昂,苹果可能会对Apple Intelligence收取10至20美元的费用,以提供更多高级AI功能。
Shah指出,人工智能让苹果有机会进一步锁定其忠实客户群,因为Apple Intelligence将从用户行为中学习从而变得更加个性化。
Apple Intelligence功能预计将会在明年春季上线。
Image
通义千问开源数学模型Qwen2-Math,数学能力超越GPT-4o
阿里通义团队开源新一代数学模型Qwen2-Math,包含1.5B、7B、72B三个参数的基础模型和指令微调模型。
Qwen2-Math基于通义千问开源大语言模型Qwen2研发,旗舰模型 Qwen2-Math-72B-Instruct在权威测评集MATH上的得分超越GPT-4o、Claude-3.5-Sonnet、Gemini-1.5-Pro、Llama-3.1-405B等,以84%的准确率处理了代数、几何、计数与概率、数论等多种数学问题,成为最先进的数学专项模型。
Image
OpenAI 宣布 DALL-E 3 模型向 ChatGPT 免费用户开放
OpenAI 今天宣布,ChatGPT 免费用户可以每天使用其 DALL-E 3 模型生成图片。
DALL-E 3 模型是OpenAI 推出的图片生成模型,在2023年9月份正式上线。用户可以直接在 ChatGPT 的输入框中键入生成图片相关指令。
需要注意的是,免费用户每天仅能生成2张图片。
Image
字节跳动旗下豆包上线音乐生成功能
据字节跳动官方消息,字节跳动旗下智能 AI 助手豆包现已上线音乐生成功能。
用户在豆包的音乐生成中输入主题或自己写的歌词,设定音乐风格、情绪及音色,便能快速生成一首约 1 分钟的歌曲。
目前,豆包音乐生成功能提供民谣、嘻哈、R&B 等 11 种音乐风格,其中还涵盖了爵士、雷鬼、电音等相对小众的曲风,用户可选择男声或女声演唱。生成的声音,在吐字清晰度和流畅性上表现很好。同时,为让 AI 音乐更好贴合普通用户的情感表达,豆包预设了快乐、伤感等多种情绪状态。
Image
字节豆包大模型已支持实时语音通话
字节跳动旗下火山引擎今日宣布推出对话式 AI 实时交互解决方案,搭载火山方舟大模型服务平台。
该方案通过火山引擎 RTC 实现语音数据的采集、处理和传输,并深度整合豆包・语音识别模型和豆包・语音合成模型,简化语音到文本和文本到语音的转换过程,提供智能对话和自然语言处理能力,帮助应用实现用户和云端大模型的实时语音通话。
字节跳动介绍称,对话式 AI 实时交互解决方案支持开箱即用快速搭建,只需调用标准的 OpenAPI 接口即可配置所需的语音识别(ASR)、大语音模型(LLM)、语音合成(TTS)类型和参数。而火山引擎 AIGC RTC-Server 负责边缘用户接入、云端资源调度、文本与语音转换处理以及数据订阅传输等环节。
Image
OpenAI 据悉将参与硬件开发商 Opal 的新一轮融资
据 The Information 消息,据两名知情人士透露,OpenAI 将参与硬件开发商 Opal 的新一轮融资。
知情人士称,Founders Fund 和 Kindred Ventures 等现有投资者预计也将参与这轮融资。本轮融资,Opal 的目标是获得约6000万美元的资金
Opal 计划在继续销售网络摄像头的同时,开发由 OpenAI 模型驱动的其他类型的设备,而 OpenAI 高管对 Opal 的投资特别兴奋,因为有机会在其设备中使用其语音 AI 模型。
Image
OpenAI 任命卡内基梅隆大学教授 Zico Kolter 为新董事
今天凌晨,OpenAI 官方宣布卡内基梅隆大学机器学习系教授 Zico Kolter加入 OpenAI 董事会。
Zico Kolter于 2010 年在斯坦福大学获得计算机科学博士学位,随后于 2010 年至 2012 年在麻省理工学院从事博士后研究。之后他加入卡内基梅隆大学,在该校担任要职已有 12 年之久。
OpenAI 认为他的研究和专业知识涵盖新的深度网络架构、理解数据对模型影响的创新方法以及评估人工智能模型鲁棒性的自动化方法,这使他成为公司治理工作中不可多得的技术总监。
Image
秘塔科技完成超1亿元融资,蚂蚁集团领投
据晚点latepost 报道,秘塔科技近期完成了超 1 亿元人民币的新一轮融资,由蚂蚁集团领投、光速光合跟投。本轮投后估值达 1.5 亿美元。
据了解,百度、腾讯等大型科技公司也曾在这轮融资期间与秘塔接触,最终蚂蚁与秘塔达成交易。去年以来,蚂蚁集团在 AI 领域已至少投资 6 家公司,包括大模型公司智谱 AI、月之暗面,视频生成公司爱诗科技、生数科技 ,AI 芯片公司墨芯和最新的秘塔。
除投资外,蚂蚁去年发布了自研的 “百灵” 多模态大模型,今年初成立 AI 新部门 “NextEvo”,4 月在支付宝上线 “智能助理” 功能。蚂蚁集团董事长兼 CEO 井贤栋今年在世界人工智能大会上说,蚂蚁的 AI 战略是发展 “专业智能体”,即拥有金融、医疗等专业知识的 AI。
Image
小米旗舰设备国际版将接入谷歌 Gemini 大模型
据小米创办人雷军表示,小米旗舰设备国际版将接入谷歌 AI 大模型 Google Gemini。
小米目前已在国行机型中推出了自家的 AI 功能,7 月 30 日,小米小爱同学「大模型小爱」宣布全量升级,支持自然问答、图片编辑、车外唤醒防御等,覆盖核心品类设备。
此前OPPO 已选择了谷歌的 Gemini 模型,并与谷歌一起在海外市场推出了一系列生成式 AI 功能。首先是音频和会议摘要功能,Gemini 1.5 Pro 提供了 Al 录音摘要功能。此外,OPPO 团队基于 Gemini 1.5 Flash 开发了 AI 工具箱中的一些功能,集成在 ColorOS 智能侧边栏中,方便用户调用。
Image
今日重点论文:
谷歌:
《Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters》
论文研究如何在LLMs中使用更多的测试时间计算来提高性能,特别是针对具有挑战性的提示问题。研究试图回答一个问题:如果一个LLM被允许使用固定但非微不足道的推理时间计算量,它在挑战性提示问题上的性能会有多大提高?
论文地址:
https://arxiv.org/abs/2408.03314v1
清华大学:
《An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models》
本论文旨在探讨如何在推理过程中优化大型语言模型的配置,以实现更好的性能和计算效率。通过研究多种推理策略和树搜索算法,论文提出了在性能和计算效率之间进行Pareto最优权衡的方法,即通过使用更小的语言模型和更复杂的解码算法来提高问题解决的准确性。
论文地址:
https://arxiv.org/abs/2408.00724v1
谷歌:
《TCoverBench: A Challenging Benchmark for Complex Claim Verification》
CoverBench是一个针对语言模型输出正确性验证的挑战性基准测试。该基准测试专注于验证复杂推理设置中的语言模型输出,目的是解决当前缺乏多样化、质量高、难度大的语言模型输出验证数据集的问题。CoverBench提供了多样化的数据集,包括不同领域、不同类型的推理、相对较长的输入等,同时还进行了数据质量的人工审核。该基准测试的关键思路是提供一个更加全面、多样化、高质量的语言模型输出验证数据集。
论文地址:
https://arxiv.org/abs/2408.03325v1
Xinfin:
《Assessing the XDC Network: A Comprehensive Evaluation of its qualitative and technical aspects》
评估XDC网络在技术、安全和业务维度上的优劣,以确定其在贸易金融、资产代币化和企业区块链解决方案等领域的适用性。通过评估XDC网络的分散化、可扩展性和安全特性,包括其Nakamoto系数、验证器参与度和客户端分布,来确定其优劣。此外,还考察了开发者生态系统、业务方面的交易成本和可预测性。
论文地址:
https://arxiv.org/abs/2408.02115v1
Image