中国政策档案 Governance Archive HOLDINGS 234,771 · FONDS 122
Record · qbitai ACC. 900074998

DeepSeek's Latest Move Exposed: Next Step Towards AI Agents

DeepSeek新大招曝光:下一步智能体

Issuer
Date
2025-09-05
Instrument
other
Cited by
0
A news report reveals that DeepSeek is developing a new model with stronger AI agent capabilities, expected to launch by the end of 2025. The article discusses the context of DeepSeek's recent updates and the industry trend towards AI agents.
Full text · 原文 1,214 字
鱼羊 发自 凹非寺<br> 量子位 | 公众号 QbitAI<br> DeepSeek下一步,被曝剑指智能体。<br> 知情人士透露,DeepSeek正在开发具有更强大AI Agent能力的新模型,预计在今年年底就会推出。<br> △图片由AI生成<br> 官方尚无回应,但这一爆料并非无迹可寻。<br> 在DeepSeek 8月的最近一次更新中,DeepSeek-V3.1上线。官方发布的升级公告中就提到:<br> DeepSeek-V3.1具备更强的Agent能力,通过Post-Training优化,新模型在工具使用与智能体任务中的表现有较大提升。<br> 迈向Agent时代的第一步<br> “R2”将造更强智能体?<br> 彭博社援引知情人士消息,爆料DeepSeek的下一个模型,仅需少量提示,就能帮用户执行复杂操作,并且还能根据历史操作自我进化和学习。<br> 这一模型将在今年最后一个季度面世。<br> 此前,业内普遍推测,按照DeepSeek V3和DeepSeek R1的发布节奏,在被期待已久的“R2”之前,DeepSeek应该会先一步推出新一代V系列的基础模型。<br> 而从去年12月到今年8月的近9个月时间里,DeepSeek V系列的版本号只从V3来到了V3.1。<br> 看上去仅仅是小版本的改进,但从DeepSeek官方后来公布的测试结果来看,似乎又暗藏玄机。<br> DeepSeek-V3.1的主要升级包括3点:<br> 混合推理架构,就是把思考模式和非思考模式都集成到了一个模型里。<br> 更高的思考效率,比DeepSeek-R1想得更快。<br> 更强的Agent能力,新模型在工具使用与智能体任务中的表现有较大提升。<br> 具体来看提升效果。<br> 编程智能体方面,在代码修复测评SWE和命令行终端环境下的复杂任务(Terminal-Bench)测试中,DeepSeek-V3.1相较V3和R1有明显提高。<br> 而在搜索智能体测评中,相较于DeepSeek-R1-0528,DeepSeek-V3.1也展现出了全面的性能提升。<br> 下一个DeepSeek时刻<br> DeepSeek R1将推理模型推向发展新高潮,成了搅动全球大模型行业格局的一尾鲶鱼。<br> Manus让智能体的概念火爆出圈,被称为“第二个DeepSeek时刻”——<br> 来到2025年的下半年,几乎没有大模型产品不谈智能体。吴恩达也在最新Andrew’s Letters中提到:并行智能体正在成为提升AI能力的新方向。<br> 早早预定2025年年度热词的DeepSeek和智能体一叠加,立刻又触动了人们兴奋的神经。<br> 已经有人开始期待:如果是DeepSeek来做这件事,那智能体的价格门槛,真的要被打下来了。<br> 但也有人保持怀疑:这个时候入局智能体,还算好时机吗?<br> 不管怎么说,可以确定的是,在2025年余下的最后1/3时间里,大模型领域的热闹依然将每天持续。<br> 最后的最后,小小One More Thing一下,信源来自官方,妥妥靠谱:<br> Qwen 3 max也要来了吗?<br> 欢迎一起,见证下一个历史时刻。