1 月 27 日,据 Information 网站,脸书母公司 Meta 成立了四个专门研究小组来研究量化巨头幻方量化旗下的国产大模型 DeepSeek 的工作原理,并基于此来改进旗下大模型 Llama。
中国AI公司的创造力正技惊四座最近几天,一家名为深度求索(DeepSeek)的中国公司在欧美AI圈引起了不小的震动,甚至被认为是大模型行业的最大“黑马”。DeepSeek被不少外国人称为“神秘的东方力量”。
过去一周,DeepSeek R1、字节跳动的豆包1.5 Pro,以及月之暗面的Kimi k1.5模型相继推出,引发了全球投资者的高度关注。DeepSeek的优异表现以及不及OpenAI近1/20的算力成本令英伟达(Nasdaq:NVDA)股价一夜暴跌17%。