行业资讯

刚刚,新版DeepSeek-R1-0528正式开源!直逼o3编程强到离谱,一手实测来了

发布时间:2026/8/27 14:43:33
刚刚,新版DeepSeek-R1-0528正式开源!直逼o3编程强到离谱,一手实测来了 前言临近端午假期DeepSeek果然又开始搞事。就在今天凌晨新版DeepSeek-R1正式开源了DeepSeek-R1-0528模型权重已上传到HuggingFace不过模型卡暂未更新。项目地址https://huggingface.co/deepseek-ai/DeepSeek-R1-0528/tree/main时隔4个月DeepSeek-R1完成了超进化编码能力强到离谱而且思考时间更长了。据称新模型基于DeepSeek-V3-0324训练参数为660B。经典物理模拟测试中DeepSeek-R1新旧版本的对比在LiveCodeBench基准上DeepSeek-R1-0528性能几乎与o3-miniHigh和o4-miniMedium)实力相当一举超越了Gemini 2.5 Flash。有网友称赞DeepSeek-R1能够像o3一样纠正思维链并且像Claude一样创造性进行世界构建。可以说这是属于开源模型的巨大胜利不用R2直接对标SOTA此次DeepSeek-R1-0528更新核心亮点网友做了一个浓缩版的总结能像谷歌模型一样深度推理文本生成优化更自然格式更佳独特的推理风格不仅快而且更缜密支持长时思考单任务处理时长可达30-60分钟思考时间更长成为了全网讨论最多的一点。有网友实测后R1思考时长超过了25分钟。另外这似乎是唯一一个能持续正确做对「9.9 - 9.11是多少」的模型。编程能力强到爆网友实测显示新版DeepSeek-R1在编程方面简直不可思议AI圈大佬「karminski-牙医」用同一个prompt测试了DeepSeek-R1-0528和Claude 4 Sonnet后发现。不管是光线照射在墙上形成的漫反射还是球在撞击后的运动方向亦或是控制面板的美观程度这一把R1稳赢。网友Alex的测试也显示出DeepSeek-R1在前端编码的能力上超越了Claude 4 Sonnet。网友Haider.则是让模型构建一个单词评分系统。R1简要思考后就立刻出了关于代码和工作测试的两个文件第一次运行就完美无瑕。此前o3是唯一能完成这个任务的模型。而如今R1堪称是完成这个任务的最佳模型。注意R1的表现之所以如此惊人是因为它返回的两个文件在第一次都能运行良好不用编辑不用重试这极其少见。因为此前的大多数模型要么会在边缘情况下终端要么会做得太复杂要么缺少适当的测试覆盖率。和Gemini高能PK还有人将DeepSeek-R1与Gemini 2.5 Pro进行了对标。同一个提示下它们各自的表现如何首先是深度研究的能力给出「研究微剂量服用裸盖菇素对长期认知的影响需引用学术来源」提示。这一把Gemini的响应更快引用了可靠的研究文献并且答案结构清晰。再来看看它们搜索对比能力如何提示模型用实时来源列出全民基本收入UBI的五大优点和缺点。这时Gemini 2.5 Pro和DeepSeek R1表现都不错打成平手。Prompt: List top 5 pros/cons of Universal Basic Income using live sources.再让模型为AI SaaS工具制定TikTok增长策略两款模型再次打成平局。在智能体任务规划方面让Gemini和DeepSeek一同设计一个完整的市场调研智能体包含工具链、用户角色和流程交接结果是Gemini生成一张信息图而DeepSeek稍逊一筹。由此大家对DeepSeek-R2的期待值也是拉满了。新版DeepSeek-R1的能力经过我们实测虽然是一次「小版本」更新但是性能得到了「史诗级」的加强。尤其是编程能力感觉已经超过或者足以媲美Claude 4和Gemini 2.5 Pro可以说所有提示都是「一把过」不需要任何修改并且可以在网页端直接运行展示效果。首先是制作一个「新智元」字体在宇宙中旋转的3D动画完成度相当之高。对于简单任务DeepSeek-R1的思考时间明显缩短不再像以前对简单任务也疯狂思考。设计一个新智元的官方网站对于这种相对容易的任务DeepSeek-R1-0528只需要10s的思考时间。能够明显感觉到这次DeepSeek-R1新版本的思考过程更加稳定。以模拟一个太阳系运行为例还要求行星比例大小与实际相同能看到DeepSeek-R1-0528的思考过程已经趋近于「完美」。最后再给DeepSeek-R1-0528上点强度要求演示篮球落地后的弹跳过程并且要完美遵循现实中物理规律。最终DeepSeek的成果还贴心的设计了参数控制面板以及速度方向指示是真的很强以上所有代码都是提示之后一遍过没有任何的Debug过程。对于类似「华容道」的多步骤思考问题DeepSeek-R1-0528的表现也非常完美比如「一位农夫要带一只狐狸、一只鹅和一袋豆子过河。船每次只能载他和一样物品。如果农夫不在场狐狸会吃掉鹅鹅会吃掉豆子。请问农夫该如何安排过河才能确保所有物品安全」这种复杂推理问题DeepSeek-R1还可以给出核心问题所在。最令我感到震惊的是这次的「思考」能力似乎进行了秘密加强。我给他了一个非常无厘头的族谱问题「我的妈妈的爸爸的儿子的侄女的孙子的爷爷的舅舅的外孙女的姑姑是我的谁你能画出关系族谱图吗?」以下过程经过3倍加速可以看到DeepSeek-R1真的在通过数学的符号化方式在进行思考。并且最后还真让他分析出了结果简直震惊这么长的思考链条都没有断。另外值得一提的是这次的思考过程并没有遇到服务算力不够的情况看来DeepSeek有针对性的提高了算力毕竟现在是模型刚发布后的高峰「测评」期。最后为什么要学AI大模型当下⼈⼯智能市场迎来了爆发期并逐渐进⼊以⼈⼯通⽤智能AGI为主导的新时代。企业纷纷官宣“ AI ”战略为新兴技术⼈才创造丰富的就业机会⼈才缺⼝将达 400 万DeepSeek问世以来生成式AI和大模型技术爆发式增长让很多岗位重新成了炙手可热的新星岗位薪资远超很多后端岗位在程序员中稳居前列。与此同时AI与各行各业深度融合飞速发展成为炙手可热的新风口企业非常需要了解AI、懂AI、会用AI的员工纷纷开出高薪招聘AI大模型相关岗位。最近很多程序员朋友都已经学习或者准备学习 AI 大模型后台也经常会有小伙伴咨询学习路线和学习资料我特别拜托北京清华大学学士和美国加州理工学院博士学位的鲁为民老师给大家这里给大家准备了一份涵盖了AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频全系列的学习资料这些学习资料不仅深入浅出而且非常实用让大家系统而高效地掌握AI大模型的各个知识点。这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】AI大模型系统学习路线在面对AI大模型开发领域的复杂与深入精准学习显得尤为重要。一份系统的技术路线图不仅能够帮助开发者清晰地了解从入门到精通所需掌握的知识点还能提供一条高效、有序的学习路径。但知道是一回事做又是另一回事初学者最常遇到的问题主要是理论知识缺乏、资源和工具的限制、模型理解和调试的复杂性在这基础上找到高质量的学习资源不浪费时间、不走弯路又是重中之重。AI大模型入门到实战的视频教程项目包看视频学习是一种高效、直观、灵活且富有吸引力的学习方式可以更直观地展示过程能有效提升学习兴趣和理解力是现在获取知识的重要途径光学理论是没用的要学会跟着一起敲要动手实操才能将自己的所学运用到实际当中去这时候可以搞点实战案例来学习。海量AI大模型必读的经典书籍PDF阅读AI大模型经典书籍可以帮助读者提高技术水平开拓视野掌握核心技术提高解决问题的能力同时也可以借鉴他人的经验。对于想要深入学习AI大模型开发的读者来说阅读经典书籍是非常有必要的。600AI大模型报告实时更新这套包含640份报告的合集涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师还是对AI大模型感兴趣的爱好者这套报告合集都将为您提供宝贵的信息和启示。AI大模型面试真题答案解析我们学习AI大模型必然是想找到高薪的工作下面这些面试题都是总结当前最新、最热、最高频的面试题并且每道题都有详细的答案面试前刷完这套面试题资料小小offer不在话下这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】