返回行业动态

LMSYS 团队在 H20 GPU 上优化 DeepSeek-V4-Pro 推理性能

2026/08/19 18:34
查看原文

OmniTools 8月20日消息,LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上开展多场景服务配置优化。单节点 H20-141GB 实现 271 output tokens/s 的推理吞吐量。

该性能与 B300 GPU 的 383.7 tokens/s 相比,差距缩小至 1.42 倍,显著逼近高端硬件服务水平。

相关工作聚焦于模型服务层面的场景化调优,未涉及模型结构修改或再训练。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部