技术博客 分享技术,记录成长
首页 大模型 智能体 Python 系统架构

两张RTX 2080Ti跑大模型是否能挑战身价6倍的RTX4090?(速度全面对比版)

闲人太忙 大模型 2026-07-24 16:38 16 阅读
2080ti22g nvlink
摘要:两张RTX 2080Ti魔改22g显卡加上nvlink,运行本地大模型是否能达到rtx4090显卡的速度?通过测试实验,decoding生成速度还真可以,但预填充prefill速度只有其30%左右。对比一张rtx2080Ti22g的话,上文处理速度提升150tok/s,生成速度提升60%。

闲人太忙

闲人太忙

← 返回首页

搜索

最新文章

  • 1到8张老登显卡V100怎样玩转本地运行Qwen3.8-27B(速度测试篇)
  • 当年炼丹神卡2080Ti能否驾驭本地大模型之王qwen3.8-27B(1/2卡速度测试及模型能力测试)
  • 部署本地大模型,两张3080的对手是4090还是5090?
  • 两张RTX 2080Ti跑大模型是否能挑战身价6倍的RTX4090?(速度全面对比版)
  • 当年一代炼丹神卡RTX2080ti跑本地大模型(30B参数级别)速度怎样?

热门文章

  • 1 当今最猛的游戏显卡RTX 5090跑本地大模型速度如何?
  • 2 当代卡皇RTX PRO 6000 Blackwell运行本地大模型速度如何?
  • 3 闲人太忙项目汇总
  • 4 当年一代炼丹神卡RTX2080ti跑本地大模型(30B参数级别)速度怎样?
  • 5 两张RTX 2080Ti跑大模型是否能挑战身价6倍的RTX4090?(速度全面对比版)

标签云

2080ti22g Docker RTX3080 RTX4090 V100 gemma4 nvlink pro6000 qwen3.6 qwen3.6-27b rtx5090 微服务

© 2026 技术博客

备案号:皖ICP备14020842号-2

Powered by xianren