把复杂题目拆成可检查的步骤
0528 的核心改进是更深入的推理,适合涉及多个条件、分支与中间结论的问题。可要求它先整理已知条件,再给出解法、关键推导和验算。官方 AIME 2025 成绩由原 R1 的 70.0 提升至 87.5,但单题结果仍需检查。
在选型前明确容量、输入输出与调用方式。
原生规格说明模型能力;消息管理、响应格式与会话保存由所选平台入口提供。
了解 deepseek-r1-0528 能为你的工作带来什么。
0528 的核心改进是更深入的推理,适合涉及多个条件、分支与中间结论的问题。可要求它先整理已知条件,再给出解法、关键推导和验算。官方 AIME 2025 成绩由原 R1 的 70.0 提升至 87.5,但单题结果仍需检查。
编程任务可以同时提供需求、现有代码、报错与测试条件,让模型分析原因并提出修改。官方 LiveCodeBench(2408-2505)成绩由 63.5 提升至 73.3。适合用来生成候选实现和测试思路,而不是把生成代码直接视为已验证交付物。
与早期 R1 使用建议不同,0528 已支持系统提示词,也无需手动插入思考前缀。使用 /deepseek/chat/completions 时,可通过 system 消息规定回答语言、术语、交付结构和审查要求;使用托管会话时,可通过 preset 设置任务预设。官方说明该版本增强了函数调用能力;实际工具交互需结合所选入口的支持情况与工具环境配置,不能将生成工具请求视为操作已经完成。
从具体任务出发,找到模型发挥作用的位置。
输入完整题干、自己的解题过程和疑问,要求模型定位出错步骤,给出修正推导与最终验算。对需要反复补充条件的问题,可通过托管会话继续追问,交付适合学习或审阅的解题说明,而不仅是一个答案。
提供输入输出约定、边界条件、代码片段和错误日志,让模型比较算法路径、解释故障并生成修改建议。交付物可包含候选代码、复杂度说明和测试清单;再把实际运行结果带回对话,继续缩小问题范围。
把目标、硬性条件、可选方案和评价标准整理成文本,要求模型逐项比较,并说明结论依赖哪些假设。适合技术方案评审与规则推演,交付比较表、推荐理由和待确认事项;缺少关键条件时先补充,再形成结论。
结合任务复杂度、输入材料与预期结果选择。
如果任务集中在复杂数学、编程和多步逻辑,0528 更值得作为升级候选,它的官方相关评测明显优于原 R1。但不要把推理进步等同于所有问答都更准确。建议使用实际题目比较正确性、答案长度与调用消耗,简单改写未必需要深度推理。
需要明确选用这次 R1 更新时,使用 deepseek-r1-0528。名称相近的 DeepSeek-R1-0528-Qwen3-8B 是基于 Qwen3 8B Base 的蒸馏变体,不是同一个模型。接入时,需自行管理消息历史就选 Chat Completions,希望用会话 ID 续接则选托管会话。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 deepseek-r1-0528 时的常见疑问。
重点是推理深度与复杂任务表现,数学、编程和一般逻辑能力得到增强,同时支持系统提示词并改善函数调用。它不是完全不同的产品系列;是否值得替换原 R1,应结合实际题目,而非只看评测成绩。
不需要。0528 的官方使用建议已取消强制添加思考前缀的要求。更实用的做法是清晰给出题目、条件和交付要求,要求提供关键推导与验算。使用 system 消息时,可以统一规定语言和回答结构。
使用 Chat Completions 时,把相关 user 与 assistant 消息继续放入 messages。使用托管会话时,开启 stateful,并在后续请求携带返回的 id。讨论较长时,建议保留关键条件与阶段结论,避免重要信息被冗余内容淹没。
生成代码和执行代码是两回事。R1-0528 可以分析问题并提出候选实现,普通文本回答并不表示代码已运行。若要接入代码执行工具,需要所选入口支持该型号的工具交互,并配置可用的执行环境与权限;是否成功运行应以工具返回结果为准。建议先在隔离环境运行测试,再把日志和失败样例提交给模型继续排查,不要直接执行未经审查的代码。
不是。DeepSeek-R1-0528-Qwen3-8B 利用 R1-0528 的思维链对 Qwen3 8B Base 进行蒸馏训练,是独立变体。本页的 deepseek-r1-0528 指向 R1 的 0528 版本,不能把两者的评测或部署要求混用。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。