技术博客 分享技术,记录成长
首页 大模型 智能体 Python 系统架构

标签: gemma4

部署本地大模型,两张3080的对手是4090还是5090?

大模型 2026-08-10 12 阅读

使用两张RTX3080 20g显卡,走Pcie4.0x16互联来运行四个30B参数级别的本地开源大模型,测试了预填充prefill速度和生成decoding速度,其中上下文速度能到1100+tok/s,生成速度能50+tok/s,生成速度能挑战4090,但不如5090。

qwen3.6 gemma4 RTX3080

当代卡皇RTX PRO 6000 Blackwell运行本地大模型速度如何?

大模型 2026-07-16 25 阅读

今年上半年涨价最猛的显卡当属卡皇RTX PRO 6000了,从年初的6万左右涨到6月的10万左右,纸面性能参数特别强,96GB大显存,1.79 TB/s高显存带宽,跑Qwen3.6-27B生成速度能到60+token/s,预填充速度能到2.5k+,MTP能提速一倍,跑其他30B参数左右大模型也是很强

qwen3.6 gemma4 pro6000 rtx5090

当今最猛的游戏显卡RTX 5090跑本地大模型速度如何?

大模型 2026-06-28 26 阅读

RTX 5090作为现在实力最强的游戏显卡,测试这张卡跑qwen3.6-27b、qwen3.6-35b-a3b、gemma-4-31b、gemma-4-26b-a4b这几款热门本地开源大模型的运行速度,并对比其他主力显卡

qwen3.6 gemma4 rtx5090

搜索

最新文章

  • 1到8张老登显卡V100怎样玩转本地运行Qwen3.8-27B(速度测试篇)
  • 当年炼丹神卡2080Ti能否驾驭本地大模型之王qwen3.8-27B(1/2卡速度测试及模型能力测试)
  • 部署本地大模型,两张3080的对手是4090还是5090?
  • 两张RTX 2080Ti跑大模型是否能挑战身价6倍的RTX4090?(速度全面对比版)
  • 当年一代炼丹神卡RTX2080ti跑本地大模型(30B参数级别)速度怎样?

热门文章

  • 1 当今最猛的游戏显卡RTX 5090跑本地大模型速度如何?
  • 2 当代卡皇RTX PRO 6000 Blackwell运行本地大模型速度如何?
  • 3 闲人太忙项目汇总
  • 4 当年一代炼丹神卡RTX2080ti跑本地大模型(30B参数级别)速度怎样?
  • 5 两张RTX 2080Ti跑大模型是否能挑战身价6倍的RTX4090?(速度全面对比版)

标签云

2080ti22g Docker RTX3080 RTX4090 V100 gemma4 nvlink pro6000 qwen3.6 qwen3.6-27b rtx5090 微服务

© 2026 技术博客

备案号:皖ICP备14020842号-2

Powered by xianren