发布时间:2026/8/27 14:36:41
如何在AMD MI350/MI355上部署DeepSeek-R1-0528-MXFP4-v2?完整教程在此 如何在AMD MI350/MI355上部署DeepSeek-R1-0528-MXFP4-v2完整教程在此【免费下载链接】DeepSeek-R1-0528-MXFP4-v2项目地址: https://ai.gitcode.com/hf_mirrors/amd/DeepSeek-R1-0528-MXFP4-v2DeepSeek-R1-0528-MXFP4-v2是一款针对AMD MI350/MI355硬件优化的文本生成模型采用MXFP4量化技术实现高效推理。本教程将详细介绍在AMD MI350/MI355上部署该模型的完整步骤帮助你快速搭建高性能AI推理服务。 系统要求与依赖准备在开始部署前请确保你的系统满足以下要求硬件要求AMD MI350/MI355 GPU操作系统Linux软件依赖ROCm 7.0PyTorch 2.8.0Transformers 4.53.0推理引擎SGLang或vLLM模型优化工具AMD-Quark V0.10 环境配置步骤1. 安装ROCm环境首先需要安装ROCm 7.0驱动和运行时环境具体安装步骤请参考AMD官方文档。2. 创建Python虚拟环境python -m venv deepseek_env source deepseek_env/bin/activate3. 安装依赖包pip install torch2.8.0 transformers4.53.0 sglang vllm 模型获取克隆模型仓库git clone https://gitcode.com/hf_mirrors/amd/DeepSeek-R1-0528-MXFP4-v2 cd DeepSeek-R1-0528-MXFP4-v2 模型部署DeepSeek-R1-0528-MXFP4-v2支持SGLang和vLLM两种推理引擎以下是使用SGLang部署的步骤使用SGLang启动服务创建启动脚本start_server.sh内容如下#!/bin/bash MODEL/path/to/DeepSeek-R1-0528-MXFP4-v2 LOGsglang-serving.log SGLANG_AITER_MLA_PERSIST1 \ python3 -m sglang.launch_server \ --model-path $MODEL \ --tensor-parallel-size 8 \ --trust-remote-code \ --chunked-prefill-size 131072 \ --host 0.0.0.0 \ --port 8321 \ --disable-radix-cache \ --mem-fraction-static 0.8 \ --max-running-requests 64 \ --attention-backend aiter 21 | tee $LOG运行启动脚本chmod x start_server.sh ./start_server.sh✅ 模型验证服务启动后可以通过以下方式验证模型是否正常工作使用lm-evaluation-harness进行评估AIME24评估lm_eval --model local-completions \ --model_args model/path/to/DeepSeek-R1-0528-MXFP4-v2,base_urlhttp://0.0.0.0:8321/v1/completions,num_concurrent999999,timeout999999,tokenized_requestsFalse,max_length32000,temperature0.6,top_p0.95 \ --tasks aime24 \ --num_fewshot 0 \ --gen_kwargs do_sampleTrue,temperature0.6,top_p0.95,max_tokens32000 \ --batch_size auto 21 | tee aime24.logGSM8K评估lm_eval --model local-completions \ --model_args model/path/to/DeepSeek-R1-0528-MXFP4-v2,base_urlhttp://0.0.0.0:8321/v1/completions,num_concurrent256,max_retries10,max_gen_toks2048,tokenized_requestsFalse \ --tasks gsm8k \ --num_fewshot 5 \ --batch_size auto 21 | tee gsm8k.log 模型性能根据官方测试DeepSeek-R1-0528-MXFP4-v2在AMD MI350/MI355上表现出优异的性能基准测试DeepSeek-R1-0528-MXFP4-v2 (non MTP)DeepSeek-R1-0528-MXFP4-v2 (MTP3)AIME2480.0083.33GSM8K95.0095.30 许可证信息Modifications Copyright(c) 2025 Advanced Micro Devices, Inc. All rights reserved.【免费下载链接】DeepSeek-R1-0528-MXFP4-v2项目地址: https://ai.gitcode.com/hf_mirrors/amd/DeepSeek-R1-0528-MXFP4-v2创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/25 20:25:22

如何用麟思数控实现CNC自动编程?10秒出程序,效率提升80%

如何用麟思数控实现CNC自动编程?10秒出程序,效率提升80%编程一个三轴零件要半小时?CNC自动编程工具来了!麟思数控一键操作,10秒出程序,还能企业定制,效率直接拉满~🔥 麟思…

2026/8/26 22:37:33

全面战争MOD开发终极指南:Rusted PackFile Manager深度解析

全面战争MOD开发终极指南:Rusted PackFile Manager深度解析 【免费下载链接】rpfm Rusted PackFile Manager (RPFM) is a... reimplementation in Rust and Qt6 of PackFile Manager (PFM), one of the best modding tools for Total War Games. 项目地址: https:…

2026/8/26 15:34:24

影刀RPA PDF水印添加:批量处理文档的完整方案

title: “影刀RPA PDF水印添加:批量处理文档的完整方案” date: 2026-07-01 author: 林焱 影刀RPA PDF水印添加:批量处理文档的完整方案 给外发的PDF加水印,防止文件被随意传播。报告、合同、资质文件都需要这个操作。一份两份手动加&#x…

2026/8/27 14:33:02

【AI大模型】从MCP到A2A,AI智能体应用的进化之路

前言 AI智能体虽然本质上就是一个控制LLM来解决问题的代理系统。但这并不影响其成为大模型时代应用的最佳方式。特别是在今年DeepSeek和Manus爆火后,AI智能体更是被认为将迎来发展的黄金时期。但AI智能体也存在很多发展的瓶颈。例如:应用程序调用、跨平台…

2026/8/27 14:33:02

深入理解循环神经网络:NLP领域的基石,大模型学习的必经之路!

前言 有了上文的铺垫,本节进入循环神经网络(Recurrent Neural Network)。卷积神经网络主要解决计算机视觉领域的问题,而循环神经网络主要解决自然语言处理(NLP)领域的问题。 自然语言应该是人工智能中最难的,首先输入就是不确定的&#xff0c…

2026/8/26 9:13:28

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/27 10:58:22

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/27 7:46:21

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/27 0:01:16

Go语言构建企业级AI服务网关:统一管理英伟达等AI接口调用

1. 项目概述:从零构建一个企业级的AI服务网关 最近在帮一个做内容审核的团队做技术架构升级,他们原来的业务里,每天有几十万张图片和短视频需要过审,最初是接了几个开源的AI模型自己部署,但效果和性能一直不太稳定。后…

2026/8/27 0:01:16

LeetCode Hot100(51-60)算法精解与面试技巧

1. 题目背景与核心价值"hot100(51-60)"这个标题看起来像是某个编程题库或算法练习集中的一组题目编号。在技术社区中,类似命名通常指向LeetCode、牛客网等平台的热门题目集合。作为刷过300题的算法老手,我理解这类题目的核心价值在于&#xff…

2026/8/27 0:01:16

CRC校验实战:从模2除法到HJ212协议排错

1. 为什么一个“校验码”能扛住工业现场90%的数据 corruption? 你有没有遇到过这样的场景:嵌入式设备通过RS-485上传温湿度数据,上位机偶尔收到一帧乱码——温度显示成-273℃,湿度跳到999%,但串口波形看起来完全正常&a…

2026/8/26 19:34:06

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/26 19:17:08

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/26 19:34:05

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…