火遍全球的DeepSeek:科学家是怎么用它的?
DeepSeek的模型能在一个对话机器人app上使用。来源:Mladen Antonov/AFP via Getty
来源 | 自然系列
撰文 | Elizabeth Gibney
两周前,一家中国公司推出的DeepSeek-R1让美国股市大幅震荡——DeepSeek-R1是一款平价但强大的人工智能(AI)“推理”模型。
经过反复测试,DeepSeek-R1回答数学和科学问题的能力与o1模型不相上下——o1是由加州旧金山OpenAI公司去年9月推出的一款模型,OpenAI的推理模型一直被视为行业顶尖水准。
虽然R1在科研人员想尝试的各种任务上仍力有不逮,但它让全球科学家有机会根据其学科内的问题,量身训练定制款的推理模型。
“基于它的绝佳表现和低成本,我们相信Deepseek-R1能鼓励更多科学家在日常科研工作中使用大语言模型(LLM),同时不同担心成本问题,”俄亥俄州立大学的AI研究员Huan Sun说,“几乎所有从事AI的同事和合作者都在谈论它。”
开放季
对于科研人员来说,R1的平价和开源可能会改变传统:使用它的应用编程接口(API),就能以其专利竞品收取的一小部分费用对这个模型提问;其在线对话机器人DeepThink(深度思考)的使用更是免费。科研人员还能在自己的服务器上下载这个模型,免费运行和拓展模型——这些都是闭源竞品模型o1办不到的。
R1从1月20日推出以来,“大量研究人员”基于R1或以R1为灵感,尝试训练自己的推理模型,加拿大不列颠哥伦比亚大学的AI研究员Cong Lu说道。这从开放科学AI资源库Hugging Face的数据中便可看出——DeepSeek-R1的代码就储存在Hugging Face上。在模型发布后的一周内,Hugging Face上各版本的R1下载量就超过300万次,包括独立用户已经扩展过的模型。
科研任务
推理跨越
原文以Scientists flock to DeepSeek: how they’re using the blockbuster AI model标题发表在2025年1月29日《自然》的新闻版块上
© nature
Doi:10.1038/d41586-025-00275-0
版权声明:
本文由施普林格·自然上海办公室负责翻译。中文内容仅供参考,一切内容以英文原版为准。欢迎转发至朋友圈,如需转载,请邮件[email protected]。未经授权的翻译是侵权行为,版权方将保留追究法律责任的权利。
© 2025 Springer Nature Limited. All Rights Reserved
本文转载自公众号“自然系列”