数码之家

 找回密码
 立即注册
搜索
查看: 134|回复: 1

[科技] 初探 Deepseek R1-0528 模型:AI 编程能力跃升

[复制链接]
发表于 2025-5-29 20:28:21 | 显示全部楼层 |阅读模式

爱科技、爱创意、爱折腾、爱极致,我们都是技术控

您需要 登录 才可以下载或查看,没有账号?立即注册

x
IT之家 5 月 29 日消息,深度求索(Deepseek)昨日通过官方交流群,邀请用户测试 DeepSeek-R1-0528 模型小版本,初步测试结果表明,R1-0528 在编程能力、审美设计和代码补全等方面表现出色,尤其在复杂指令处理和前端页面生成上展现了高精度和高效能。
DeepSeek-R1-0528 模型在多个方面实现了性能提升,其中最为亮眼的就是编程能力,能根据用户输入的简单提示词,快速生成高质量代码。
代码测试平台 Live CodeBench 中显示,其性能可以媲美 OpenAI 最新的 o3 模型(High)。
在 Extended NYT Connections 跑分中,DeepSeek-R1-0528 模型跑分为 49.8 分,而初代 Deepseek R1 模型为 38.6 分。
IT之家注:Extended NYT Connections 是一个用于评估大型语言模型(LLM)性能的基准测试,基于《纽约时报》的 Connections 谜题游戏。
这个基准测试包含了 651 个 NYT Connections 谜题,并且增加了额外的词汇以提高难度,旨在更全面地测试模型的语言理解和推理能力。
R1-05-28 具有 o3-2.5 专业风格的响应。箭头 / 星号的使用与 o3 风格非常一致,结尾处“why it works”的表述更具说服力。
此外,在审美设计和代码补全(code completion)方面,R1-0528 同样表现卓越。测试中,该模型轻松应对多样化任务,输出结果精准且实用。
在生成复杂前端页面和动态动画方面,R1-0528 也展现了强大的能力,能准确理解复杂指令。更重要的是,相比较 OpenAI 的 o3 和 o4-mini 模型,R1-0528 大幅缩短了推理时长,提供了更加流畅和高效的使用体验。

发表于 2025-5-29 22:56:03 | 显示全部楼层
码农末日又进一步了
回复 支持 0 反对 2

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

APP|手机版|小黑屋|关于我们|联系我们|法律条款|技术知识分享平台

闽公网安备35020502000485号

闽ICP备2021002735号-2

GMT+8, 2025-6-7 16:22 , Processed in 0.296400 second(s), 11 queries , Redis On.

Powered by Discuz!

© 2006-2025 MyDigit.Net

快速回复 返回顶部 返回列表