当前位置: 首页 » 资讯 » 科技头条 » 正文

DeepSeek V4正式版来了!Agent能力大幅升级,Harness能力首次亮相

IP属地 中国·北京 澎湃新闻 时间:2026-07-31 22:16:44

国产大模型混战进入深水区,在Kimi、MiniMax接连用新模型“炸场”后,7月31日,“国产大模型风向标”DeepSeek宣布,DeepSeek-V4-Flash正式版API上线公测。

这也是外界期待已久的DeepSeek正式版官宣上线,据了解,DeepSeek-V4-Flash-0731的模型结构、尺寸和DeepSeek-V4-Flash-preview保持一致,仅重新进行后训练。


DeepSeek-V4-Flash 正式版 API 上线公测(网站截图)

不过,据DeepSeek特别说明,目前公测仅限API(接口端),大家常用的App和网页端暂无法体验最新能力,DeepSeek-V4-Pro正式版将会尽快发布。

据官方更新日志显示,V4-Flash正式版在Agent能力上大幅增强,基准测试远超Preview版本。

多项评测数据显示,V4-Flash正式版成绩突出:TerminalBench2.1(终端操作测试)得分82.7;Cybergym(网络安全攻防模拟)得分76.7;ToolathlonVerified(工具调用综合测试)得分70.3;内部全栈开发测试DSBench-FullStack达到68.7,而高难度编码专项测试DSBench-Hard也拿下59.6。

值得注意的是,DeepSeek Harness能力也在此次更新中首次亮相,据DeepSeek披露,本次公开基准测试中的CodeAgent任务,使用了DeepSeek Harness极简模式作为框架进行测试,这也是DeepSeek在Harness团队公开招聘后,首次在官方公告中披露Harness相关能力。

公开资料显示,DeepSeek的Agent Harness团队组建于今年3月,负责人崔添翼是90后,浙大计算机出身,拥有6枚ACM亚洲区域赛金牌,曾在顶级量化机构JaneStreet任职九年,今年3月加入DeepSeek,此后其在5月大力招兵买马。

DeepSeek成立于2023年,由量化私募幻方量化孵化,凭借V3、R1等模型以极低成本达到国际第一梯队性能,被硅谷称为“来自东方的神秘力量”。今年以来,DeepSeek完成首轮外部融资。

此前6月16日,据披露,DeepSeek完成首轮融资,募资总额超过74亿美元(约合人民币500亿元),采用特殊交易架构,估值超过500亿美元。这也是中国AI行业至今为止规模最大的单轮融资,也是中国估值最高的未上市AI初创企业。

据媒体报道,DeepSeek创始人梁文锋是最大出资方,个人出资约30亿美元(人民币200亿元);腾讯出资100亿元;宁德时代出资50亿元;京东、网易、风投机构IDG资本各出资30亿元。

此后DeepSeek发布“英雄帖”广泛招募人才,据DeepSeek官方招聘信息表示,当今人类正处于AGI的前夜,随着技术演进,正努力将所有部门的规模扩大至少一倍。

根据DeepSeek发布的揽才计划,招聘范围囊括全栈开发、算法、AI 底层系统、算力运维、产品、数据策略、深度学习研究等技术岗位,同时招收 AGI 管培生、HR、法务、财务、采购、行政职能人员,办公地点分布杭州、北京与内蒙古乌兰察布市,同时,所有岗位均面向实习生开放。

责任编辑:戴丽丽_NN4994

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。

全站最新