切换到宽版
开启辅助访问
登录
立即注册
搜索
搜索
搜索
首页
Portal
论坛
同城
人才网
工具
菲龙网工具
个人中心
关于我们
每日签到
本地新闻
时事评论
华人世界
中国新闻
新闻视频
国际新闻
娱乐新闻
科技新闻
菲龙广场
房产网
菲龙速聘
二手交易
便民电话
美食餐厅
旅游签证
物流速运
商品买卖
二手车市场
严选
话费充值
便民电话
贺词页面
瀑布流页
汇率查询
APP下载
每日签到
我的任务
道具商店
每日签到
我的任务
道具商店
更改用户名
关于菲龙网
About US
联系菲龙网
活动回顾
加入我们
本版
用户
菲龙网
»
论坛
›
新闻频道
›
科技新闻
›
DeepSeek R1悄悄更新!用「小版本」干翻大模型 ...
菲龙网编辑部7
有 744 人收听 TA
153108
主题
153125
回复
179467
积分
收听TA
发消息
加好友
本文来自
科技新闻
订阅
|
收藏
(
2953
)
菲龙网编辑部7发布过的帖子
0/67
折腰大结局:小乔圆满大乔壮烈,魏梁太意难平!苏娥皇宿命又悲情
0/92
折腰大结局:小乔圆满大乔壮烈,魏梁太意难平!苏娥皇宿命又悲情
0/91
《藏海传》藏海被骗,这才是庄芦隐在牢中喊之行“好儿子”的原因
0/139
李现白客最佳,《人生若如初见》老仆人的话,诠释着另一种结局
0/143
《人生若如初见》结局,最难忘,那些乱世中闪光的女子
0/73
越看梁乡越爱李现,《人生若如初见》,诠释着偶像的另一面
0/85
赵丽颖新剧《在人间》首播3集观后感,网友的评价出奇地一致
0/81
《我叫张思德》5月29日晚9∶30央视电视剧频道开播
0/90
遗憾!直到大结局,《人生若如初见》都没迎来该有的热度
查看TA的全部帖子>>
DeepSeek R1悄悄更新!用「小版本」干翻大模型
时间:2025-5-30 10:08
0
109
|
复制链接
|
互动交流
显示全部楼层
阅读模式
直达楼层
马上注册,结交更多好友
您需要
登录
才可以下载或查看,没有账号?
立即注册
x
虽然DeepSeek-R2并没有像2个月之前盛传的那样,在5月甚至之前准时赴约。但是,DeepSeek正在不断地用小升级追赶其他厂商的大版本。
昨天DeepSeek官方的一则「R1已完成小版本试升级」的消息,在各个AI讨论群里炸开了花。这回的DeepSeek-R1-0528版本在各个社区引发震动的最主要原因是:它真的不是一次小更新!
目前该升级版的DeepSeek-R1-0528已经全量上线官方网页、APP、小程序等等,API也已经可以接入。
关于DeepSeek官方多么有诚意,我们已经在V3版本的升级上看到了——模型性能大幅提升只是开胃小菜,成本价格比更是再度优化。这回的更新也是一样,新版本的DeepSeek-R1主要在编程能力上大幅提升。据一家LLM API接入网站OpenRouter,这回的新版本R1的输入输出价格几乎与先前版本毫无变化!
在智能水平上,新版本DeepSeek-R1-0528在 Extended NYT Connections 基准测试上相比原始 DeepSeek R1有了大幅提升:38.6 → 49.8。
01
它真的很难说是「小升级」
现在,全网都在疯狂拿它跟全面替代AI coding真神的Claude 4对比,发现:这俩模型竟然不相上下?甚至有一张在Livecodebench上DeepSeek-R1-0528与o3-high旗鼓相当的基准测试对比图,在网上疯传。许多网友认为这回更新后的DeepSeek-R1-0528在代码生成等编程领域的实力已经进入第一梯队了。
我们搜集了全网最有趣的实测体验,看看这回的DeepSeek-R1-0528到底将AI coding的能力拓展了多少:
有X网友@karminski3设置了一个「DeepSeek-R1-0528 VS Claude-4-sonnet」挑战赛,用弹球撞击墙面的效果作对比。
实测下来发现:DeepSeek方的弹球看起来甚至还有光泽,撞碎墙面后的粒子效果几乎能与Claude-4-sonnet一较高下,控制面板的美观度也都非常在线。
值得一提的是,在这次的测试中,两个大模型使用了同一个Prompt,DeepSeek-R1-0528 生成了728行,而Claude-4-sonnet生成了542行。
更新后的R1-0528在粒子效果的表现上尤其好。粒子效果通常会涉及复杂的动态动画和物理模拟,像是物体运动、碰撞、光影变化等等。这足以说明R1-0528在生成复杂动态动画能力上有了很大的突破。
X网友MILO,就做了个可交互的粒子动态动画平台,我们也进去体验了下。我们注意到除了画面中央的炫酷粒子爆炸外,右上角的粒子数计算也以一种很匹配的方式同步进行着。
在全栈网页开发上,「小升级」之后的DeepSeek-R1-0528所表现出来的能力也有了很明显的提升。
比如,X上有网友@DomLiu给 DeepSeek-R1-0528 一个全栈网页开发Prompt,就能在几秒钟内从零开始构建了一个完整的应用程序。
这段提示词还非常的简单:构建一个 three.js 应用程序,用于加载具有实时颜色/材质/配件控制的 3D 模型。直观的用户界面。流畅的相机视角。
更为惊艳的是下面这个Case,同样是这位网友,他几乎将DeepSeek-R1玩出了花,这也证明小升级后的DeepSeek-R1-0528到底在编程能力上有多强。
简单来说,他使用升级后的DeepSeek-R1做了一个3D画廊,有这些功能:
程序化几何生成,动态场景生成系统,多彩动态光影效果,相机动画与过渡,虚拟画廊导航体验。
有实际用过Trae、Cursor、Windsurf等一众AI coding的朋友肯定都懂一个具有强大自主编程能力的基座大模型到底意味着什么?——编程效率的指数级提升。
3D艺术画廊非常直观地显示了DeepSeek-R1-0528在面对复杂任务时的自主编程能力。
我们也实际上手测试了下,发现升级后的DeepSeek-R1-0528在面对非常简单的提示词时也能做出很快的反应,并自主地丰富功能。
比如,我只给了它一句:
生成一个苹果官网风格的前端网页。
它只经过14秒的思考,就轻松理清了苹果官网风格设计页面的设计思路:
· 使用苹果标志性的深空灰/银色调
· 大字体标题和简洁文案
· 高清产品图像与渐变背景
· 悬浮动画效果
· 响应式布局
最主要的是,很短时间内它就已经生成了462行代码,做出来的效果也与我所设想的非常相近:
除了纯代码能力之外,DeepSeek-R1-0528在前端审美上也有了很大的提升。
比如下面这个原生iOS风格界面设计,采用了抹茶绿色主题,融合现代美学,看起来搭配很流畅。
除了产品应用UI风格之外,DeepSeek-R1-0528在HTML网页的前端网格上也有了很大的提升。
下面两组新版本的介绍网页中,深色是DeepSeek-R1-0528生成,在美观度上更具科技感和视觉冲击力,也非常符合AI大模型本来的调性;白色则是由Claude4生成:
02
思维链似乎改变了,出现了一些「副作用」
这回DeepSeek-R1-0528的强势开源,甚至让各国网友都重温了下今年年初R1发布时的情景。现在的DeepSeek-R1-0528已经拥有了Claude系列的强自主编程能力,同时网友们在实际测试中也注意到它的思维链模式似乎发生了改变。
很多实测后的网友都发现这回的升级版DeepSeek-R1-0528的思考过程实在是太长了,很容易出现过度思考的现象。
比如,网友们发现了一个有趣的测试题:「估算一下π/7」,发现DeepSeek-R1-0528的思考推理过程有些太漫长了。
我们也实际测试了下,面对这样的一个小问题,DeepSeek-R1-0528的深度思考时间达到了148秒。并且,其推理过程显得冗余性很大。
DeepSeek-R1-0528在面对「估算一下π/7」这个问题时的思维链到底有多长,你可以直观感受下:
虽然各国网友都直观感受到了升级后的DeepSeek-R1-0528在推理能力上消耗的时间变得长了,但推理结果精度的提升也是显而易见的。经过优化的DeepSeek-R1-0528在处理复杂问题时,已经展现出了更强的逻辑分析能力和更细致的推理过程,这使得输出的答案不仅更加准确,还在深度和广度上都有了显著改进。
比如,X网友@baalatejakataru在实际编程过程中发现新的 DeepSeek-R1-0528想得太多,但是出错时能够快速地自我纠正,还能够很好地写新兴系统编程语言——Zig,表现很不错。
DeepSeek官方这回同样延续了之前发布即开源的策略,R1-0528已经正式开源。除了开源动作之外,更新后的R1仍然采用宽松的MIT许可证,意味着它可用于商业用途。
这次DeepSeek-R1-0528的升级,进一步印证了当下大模型行业的趋势:
大版本固然令人期待,但持续稳定的小步迭代同样无法让人装作看不见。
虽然DeepSeek-R2尚未如期而至,也引发了全网对于这一版本的疑惑。但是通过强化编程能力、优化前端审美,DeepSeek团队持续的小步快跑,无疑让业界重新审视小版本升级的巨大价值。尽管思维链的冗长带来了一些「副作用」,但其带来的精度提升和自我纠错能力依然让人无法忽视这次的版本升级。
在未来,DeepSeek-R1-0528的这种不改变大架构,而是通过「小升级、小迭代」就能达成明显效果的方式可能将会成为主流,「大版本号盲目崇拜」已经被破除。
下一次「小升级」,或许就是另一场风暴的开始。
回复
举报
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
点我进行验证
本版积分规则
发表回复
回帖后跳转到最后一页
浏览过的版块
生活通
关闭
站长推荐
/1
【点击免费下载】菲龙网移动APP客户端
【点击免费下载】菲龙网移动APP客户端,新闻/娱乐/生活资讯生活通,带你了解菲律宾多一点!
查看 »
扫码添加微信客服
快速回复
返回列表
返回顶部