DeepSeekMath 数学推理7B 模型选型与本地部署完整指南【免费下载链接】DeepSeek-MathDeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models项目地址: https://gitcode.com/GitHub_Trending/de/DeepSeek-Math项目是什么DeepSeekMath 是 DeepSeek 发布的 7B 开源数学推理大模型解决开源模型在竞赛级数学推理上偏弱的问题。它不依赖任何外部工具和投票技巧在竞赛级 MATH 基准上取得 51.7% Top1接近 GPT-4 与 Gemini-Ultra 水平。仓库提供 base、instruct、RL 三个版本权重模型开放商用。能力边界能做做不好不支持中英双语逐步数学推理覆盖竞赛级数学基准长文本最大序列长度 4096超长题干和多轮对话会截断多模态输入system prompt官方不建议添加写 Python 代码验证数学结论工具集成推理通用聊天与知识问答继续预训练以数学为主通用能力弱于同尺寸通用模型自动执行输出的代码只产出代码块内置 MATH、GSM8K、CMATH、MGSM-zh 等评测脚本多轮迭代验证工具调用为单轮不会执行-失败-重试循环—最小上手路径前提单卡 16GB 以上显存7B bf16 权重约 14GB8GB 显存需加 8bit 量化加载。依赖只有 torch 和 transformers权重从 HuggingFace 直接拉取无需训练或额外数据。三个版本中 instruct 适合直接对话RL 数学能力最强base 适合做研究基座。from transformers import AutoTokenizer, AutoModelForCausalLM import torch name deepseek-ai/deepseek-math-7b-instruct model AutoModelForCausalLM.from_pretrained(name, torch_dtypetorch.bfloat16, device_mapauto) tokenizer AutoTokenizer.from_pretrained(name)调用时在题干末尾追加固定的 CoT 指令英文Please reason step by step, and put your final answer within \boxed{}.中文请通过逐步推理来解答问题并把最终答案放置于\boxed{}中。。tokenizer 会自动加 bos token不要额外拼接 system prompt。场景拆解丢一道数学题拿回逐步推理输入一道中文或英文题目得到完整推导过程最终答案放在 \boxed{} 中。需要程序验证的题如求函数最值模型会额外给出 Python 代码代码需要你自己执行才能得到最终答案答案校验逻辑可直接复用仓库里的提取脚本。批量评测模型数学能力用 evaluation/ 目录的脚本submit_eval_jobs.py 向多卡并行提交任务run_subset_parallel.py 分批执行summarize_results.py 汇总得分。输入是 evaluation/datasets/ 内置的 jsonl 数据集MATH、GSM8K、CMATH、MGSM-zh、miniF2F 等产出 evaluation_results.json 分数few-shot 提示模板在 evaluation/few_shot_prompts/。嵌入现有业务工作流模型是标准 HuggingFace CausalLM用 transformers 的 generate 调用即可输出纯文本可接入已有 LLM 管线或 Agent 流程。注意两点generation_config 的 pad_token_id 需设为 eos_token_id序列上限 4096长上下文场景要自己截断。横向对比官方 README 给出 MATH Top1 准确率趋势图表中竞品数值为从该图读取的约值。DeepSeekMath-7B 比 WizardMath-70B 高出约 10 个百分点但低于顶级闭源模型RL 版本带工具调用后官方称超过所有现有开源模型。维度DeepSeekMath-7BWizardMath-70BQwen-72BMATH Top1无工具51.7%约 25%约 35%参数量7B70B72BMATH带工具约 60%RL 版——常见卡点与解法Q16GB 显存装不下加载 OOMAfrom_pretrained加load_in_8bitTrue需 bitsandbytes降到约 4GB或用device_mapauto把部分层卸载到 CPU。Q中文数学题答不准、或答案没放进 \boxed{}A题干末尾必须追加对应语言的 CoT 指令模板见最小上手路径且不要加 system prompt该版本模型与其不兼容。Q输出了 Python 代码但最终答案拿不到A模型只产出代码块、不执行。把 evaluation/eval/python_executor.py 的抽取与执行逻辑抄进自己的管线或直接使用不带工具的纯推理输出。延伸阅读与资源README模型下载、快速开始、引用方式批量评测提交脚本答案提取工具模型使用协议代码协议MIT如需克隆仓库到本地git clone https://gitcode.com/GitHub_Trending/de/DeepSeek-Math【免费下载链接】DeepSeek-MathDeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models项目地址: https://gitcode.com/GitHub_Trending/de/DeepSeek-Math创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考