老黄不止卖铲子了:英伟达配合Llama3.1推出定制模型、推理服务
梦晨 发自 凹非寺
量子位 | 公众号 QbitAI
芯片巨头
英伟达
,在AI时代一直被类比为在淘金热中
“卖铲子”
的背后赢家。
配合最强开源大模型Llama3.1,推出NVIDIA AI Foundry和NVIDIA NIM推理微服务两大新业务。
Foundry在芯片行业指“铸造厂”,比如台积电制造其他公司设计的芯片。
NVIDIA AI Foundry ,代表英伟达可以定制化制造大模型了:NVIDIA AI Foundry 提供从数据策管、合成数据生成、微调、检索、防护到评估的全方位生成式AI模型服务。
为什么在这个时间点出手?
黄仁勋表示 :“Meta的Llama 3.1开源模型标志着全球企业采用生成式 AI 的关键时刻已经到来” 。企业可以将Llama 3.1 NIM 微服务与与全新NVIDIA NeMo Retriever NIM微服务组合使用,为AI copilot、助手和数字人虚拟形象搭建先进的检索工作流。
NVIDIA和Meta还一起为Llama 3.1提供了一种提炼方法,供开发者为生成式AI应用创建更小的自定义Llama 3.1模型。这使企业能够在更多加速基础设施(如 AI 工作站和笔记本电脑)上运行由Llama驱动的AI应用。
之前老黄与小扎见面,交换皮衣穿,原来是商量这些合作去了(手动狗头)。
自定义模型+加速部署全流程服务
Llama 3.1系列模型发布还没几天,手快的企业已经用在生产中了。
Aramco、AT&T和优步,成为首批使用面向Llama 3.1全新NVIDIA NIM微服务的公司。
咨询巨头埃森哲更进一步,借助NVIDIA AI Foundry为自己以及咨询客户创建自定义Llama 3.1 模型,
从自定义模型到加速部署,被英伟达打造进了同一套流程。
-
主题护栏防止应用偏离进非目标领域,例如防止客服助理回答关于天气的问题。
-
功能安全护栏确保应用能够以准确、恰当的信息作出回复。它们能过滤掉不希望使用的语言,并强制要求模型只引用可靠的来源。
-
信息安全护栏限制应用只与已确认安全的外部第三方应用建立连接。
合成数据趋势爆发
像Llama 3.1 405B和和英伟达Nemotron-4 340B这样超过千亿参数的大模型,用在绝大多数场景在成本和速度上都不会令人满意。
英伟达和Meta都意识到, 用于生产合成数据,将是他们发挥作用的最大场景。英伟达Nemotron-4 340B系列包括基础、指导和奖励模型,这些模型形成一个管道,用于生成用于训练和优化LLMs的合成数据,并且使用了独特宽松的开放模型许可证,为开发人员提供了一种免费、可扩展的方式来生成合成数据
Llama 3.1更新的开源协议这次也特别声明:允许使用Llama生产的数据去改进其他模型,只不过用了之后模型名称开头必须加上Llama字样。
[1] https://nvidianews.nvidia.com/news/nvidia-ai-foundry-custom-llama-generative-models
[2] https://blogs.nvidia.com/blog/nemotron-4-synthetic-data-generation-llm-training/ — 完 — 量子位年度AI主题策划 正在征集中! 欢迎投稿专题 一千零一个AI应 用 , 365行AI落地方案 或与我们分享你在 寻找的AI产品 ,或发现的 AI新动向
点这里 👇 关注我,记得标星哦~ 一键三连「分享」、「点赞」和「在看」 科技前沿进展日日相见 ~