首页 资讯 正文

深夜重磅!DeepSeek最新发布,首批“试用体验”出炉→

体育正文 187 0

深夜重磅!DeepSeek最新发布,首批“试用体验”出炉→

深夜重磅!DeepSeek最新发布,首批“试用体验”出炉→

5月28日晚,DeepSeek再次(zàicì)传来大消息。

当天,DeepSeek官方宣布DeepSeek R1模型(móxíng)已(yǐ)完成小版本试升级,欢迎(huānyíng)前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变。

不过,DeepSeek官方(guānfāng)此次并没有公布版本更新的具体内容。今年3月,DeepSeek曾对V3模型进行小版本升级(bǎnběnshēngjí),同样是通过官方交流群率先宣布,随后公布了具体更新内容。此前,也有许多关于(guānyú)R2大模型的传闻出现,比如“参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎(jīhū)翻倍等(děng)”。但截至目前,并未(bìngwèi)获得官方证实。

DeepSeek的本次升级是在(zài)英伟达发布最新财报前数(qiánshù)小时宣布的。作为全球领先的AI芯片制造商,英伟达的股价在1月因(yīn)R1的发布而遭遇重挫。

据中国基金报报道,据用户(yònghù)反馈,DeepSeek升级后的模型,思维链 (CoT) 的行为似乎发生了显著变化(biànhuà)。

也有用户总结(zǒngjié)了(le)更新后的几个亮点,其中(qízhōng)包括:现在像Google模型一样进行深度推理;改进写作任务——更自然、格式更好;独特的推理风格——不仅快速(kuàisù),而且深思熟虑;长时间思考——每个任务最多30~60分钟。

另外,据财联社援引AIGC开放社区的信息,已经有网友迫不及待的对(duì)新版R1进行(jìnxíng)测试,在著名(zhùmíng)代码(dàimǎ)测试平台Live CodeBench中显示,其性能可以媲美OpenAI最新的o3模型(móxíng)高版本。也有网友对新版R1的风格进行了测试,几乎和OpenAI的o3差不多。

据券商中国报道,这是自3月底以来,DeepSeek的一次最新动作(dòngzuò)。3月25日晚,DeepSeek公司在官方账号上正式宣布V3模型(móxíng)完成小版本(bǎnběn)升级的消息(xiāoxī),并介绍了新版本DeepSeek-V3-0324模型的提升(tíshēng)细节,包括推理、前端开发、中文(zhōngwén)写作、中文搜索几个方面的能力优化。彼时,据海外专业AI模型评测机构最新排名,新版V3模型是得分(défēn)最高的非推理模型,超过xAI的Grok3和OpenAI的GPT-4.5(preview)。

然而,自那之后,DeepSeek的热度就开始下降,使用率也有所回落,并且引发了一些质疑。当前,市场最关注的依然是其R2模型的发布。4月底(yuèdǐ),有传闻称,其R2大模型的参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍。这一数字接近国际顶尖模型如GPT-4Turbo和谷歌Gemini2.0Pro的水平。R2的动态激活(jīhuó)参数为780亿,实际消耗(xiāohào)的计算量仅为总参数的6.5%。这种设计让模型在保持高性能的同时,显著降低了运行(yùnxíng)成本(chéngběn)。然而,种种迹象表明(biǎomíng),这些似乎(sìhū)只是市场人士(rénshì)的臆测,截至目前也未获得官方(guānfāng)证实,R2模型亦未推出。反观Open AI的动作却相对(xiāngduì)较多,人工智能大模型的竞争依然在持续。

来源 每日经济新闻综合中国基金报(bào)、券商中国、财联社

深夜重磅!DeepSeek最新发布,首批“试用体验”出炉→

欢迎 发表评论:

评论列表

暂时没有评论

暂无评论,快抢沙发吧~