DeepSeek似乎在憋大招! 进入5月份之后,业内一直在期盼DeepSeek推出R2模型。但时至今日,其神秘面纱依然未被揭开。不过,周三晚上,突然有消息传来:DeepSeek-R1模型已完成小版本试升级,可前往官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。 不过,DeepSeek官方此次并没有公布版本更新的具体内容。今年3月,DeepSeek曾对V3模型进行小版本升级,同样是通过官方交流群率先宣布,随后公布了具体更新内容。此前,也有许多关于R2大模型的传闻出现,比如“参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍等”。但截至目前,并未获得官方证实。 与此同时,当下已经进入到DeepSeek的扩散阶段,不断有公司和行业接入该公司的模型。那么,沉寂已久的科技股是否会因此再起风云? DeepSeek-R1升级 R2没有来,但R1升级了。深度求索公司代表周三在官方微信群中发布的帖子称,DeepSeek完成了“小规模试用升级”,欢迎前往官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。 这家总部位于杭州的初创公司今年1月发布了DeepSeek-R1 这是自3月底以来,DeepSeek的一次最新动作。3月25日晚,DeepSeek公司在官方账号上正式宣布V3模型完成小版本升级的消息,并介绍了新版本DeepSeek-V3-0324模型的提升细节,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。彼时,据海外专业AI模型评测机构最新排名,新版V3模型是得分最高的非推理模型,超过xAI的Grok3和OpenAI的GPT-4.5(preview)。 然而,自那之后,DeepSeek的热度就开始下降,使用率也有所回落,并且引发了一些质疑。当前,市场最关注的依然是其R2模型的发布。4月底,有传闻称,其R2大模型的参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍。这一数字接近国际顶尖模型如GPT-4Turbo和谷歌Gemini2.0Pro的水平。R2的动态激活参数为780亿,实际消耗的计算量仅为总参数的6.5%。这种设计让模型在保持高性能的同时,显著降低了运行成本。然而,种种迹象表明,这些似乎只是市场人士的臆测,截至目前也未获得官方证实,R2模型亦未推出。反观OpenAI的动作却相对较多, 科技股能否被激发? 不可否认的是,DeepSeek热度下降其实并未影响其在各个行业和公司的扩散。 近日,西藏大学推出“藏大智言”DeepSeek平台,人工智能教学服务将延伸至雪域高原。目前西藏自治区昌都市政务云已完成DeepSeek大模型部署。拉萨高新区通过搭建DeepSeek政务大模型应用,成为拉萨市打造高原特色“ 5月26日,瑞幸咖啡在官方APP和微信小程序正式上线首个 5月27日, 近期,中国社会科学院金融研究所执行研究员陈经伟、 (文章来源:券商中国) |
半小时前
1 小时前
1 小时前
1 小时前