DeepSeek,新消息!
DeepSeek,新消息!
DeepSeek,新消息!5月28日,DeepSeek官方宣布DeepSeek R1模型已(yǐ)完成小版本试升级,欢迎前往(qiánwǎng)官方网页、APP、小程序测试(打开深度(shēndù)思考),API 接口和使用方式保持不变。
据了解,根据DeepSeek内部(nèibù)优化方向和(hé)自身的感知,这次升级主要集中在以下几个方面:
响应质量(zhìliàng)优化:复杂推理、多步骤计算更准确(zhǔnquè);长文理解与生成更连贯、逻辑更清晰;数学、编程等专业性输出更可靠。
响应速度小幅提升(tíshēng):在(zài)网页端、App、API 接口中响应更敏捷;尤其在处理(chǔlǐ)超长文本输入时,延迟有所降低(约提升 10%~20%)。
对话稳定性增强(zēngqiáng):上下文(shàngxiàwén)记忆更稳定,尤其在超长对话中(支持最多128K上下文);减少偶尔“遗忘设定”或“跑偏”的情况。
API 和接口兼容性保持稳定:如(rú)公告所说:API 调用方式、参数、返回结构完全不变;用户无需(wúxū)调整(tiáozhěng)现有集成,即可无缝使用新版本。
R2没有来,但R1升级了。这是自3月底(yuèdǐ)以来,DeepSeek的(de)一次最新(zuìxīn)动作。今年3月,DeepSeek曾对V3模型进行小版本升级(bǎnběnshēngjí),同样是通过官方交流群率先宣布,随后公布了具体(jùtǐ)更新内容。此前,也有许多关于(guānyú)R2大模型的传闻出现,比如“参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍等”。但截至目前,并未获得官方证实。
这家总部(zǒngbù)位于杭州的初创公司今年1月发布了DeepSeek-R1人工智能模型,震惊了全球(quánqiú)科技界。R1模型在多项标准化指标(zhǐbiāo)上的表现(biǎoxiàn)均优于西方竞争对手,而其成本据称(jùchēng)仅为数百万美元。此举引发了全球科技股的暴跌,投资者开始质疑,领先的公司是否仍需要投入巨资来构建人工智能服务。
据用户反馈,DeepSeek升级(shēngjí)后的(de)模型,思维链 (CoT) 的行为似乎发生了显著变化。
也有用户总结了更新后的几个(jǐgè)亮点,其中包括:现在像Google模型一样进行深度推理;改进写作任务(rènwù)——更自然、格式更好;独特的推理风格——不仅快速,而且(érqiě)深思熟虑;长时间思考——每个任务最多30-60分钟(fēnzhōng)。
来源:中国经济网微信综合中国基金报、每日(měirì)经济新闻等
5月28日,DeepSeek官方宣布DeepSeek R1模型已(yǐ)完成小版本试升级,欢迎前往(qiánwǎng)官方网页、APP、小程序测试(打开深度(shēndù)思考),API 接口和使用方式保持不变。
据了解,根据DeepSeek内部(nèibù)优化方向和(hé)自身的感知,这次升级主要集中在以下几个方面:
响应质量(zhìliàng)优化:复杂推理、多步骤计算更准确(zhǔnquè);长文理解与生成更连贯、逻辑更清晰;数学、编程等专业性输出更可靠。
响应速度小幅提升(tíshēng):在(zài)网页端、App、API 接口中响应更敏捷;尤其在处理(chǔlǐ)超长文本输入时,延迟有所降低(约提升 10%~20%)。
对话稳定性增强(zēngqiáng):上下文(shàngxiàwén)记忆更稳定,尤其在超长对话中(支持最多128K上下文);减少偶尔“遗忘设定”或“跑偏”的情况。
API 和接口兼容性保持稳定:如(rú)公告所说:API 调用方式、参数、返回结构完全不变;用户无需(wúxū)调整(tiáozhěng)现有集成,即可无缝使用新版本。
R2没有来,但R1升级了。这是自3月底(yuèdǐ)以来,DeepSeek的(de)一次最新(zuìxīn)动作。今年3月,DeepSeek曾对V3模型进行小版本升级(bǎnběnshēngjí),同样是通过官方交流群率先宣布,随后公布了具体(jùtǐ)更新内容。此前,也有许多关于(guānyú)R2大模型的传闻出现,比如“参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍等”。但截至目前,并未获得官方证实。
这家总部(zǒngbù)位于杭州的初创公司今年1月发布了DeepSeek-R1人工智能模型,震惊了全球(quánqiú)科技界。R1模型在多项标准化指标(zhǐbiāo)上的表现(biǎoxiàn)均优于西方竞争对手,而其成本据称(jùchēng)仅为数百万美元。此举引发了全球科技股的暴跌,投资者开始质疑,领先的公司是否仍需要投入巨资来构建人工智能服务。
据用户反馈,DeepSeek升级(shēngjí)后的(de)模型,思维链 (CoT) 的行为似乎发生了显著变化。
也有用户总结了更新后的几个(jǐgè)亮点,其中包括:现在像Google模型一样进行深度推理;改进写作任务(rènwù)——更自然、格式更好;独特的推理风格——不仅快速,而且(érqiě)深思熟虑;长时间思考——每个任务最多30-60分钟(fēnzhōng)。
来源:中国经济网微信综合中国基金报、每日(měirì)经济新闻等



相关推荐
评论列表
暂无评论,快抢沙发吧~
你 发表评论:
欢迎