~/ai-muninn
搜尋
⌘K
blog
模型解剖室
github
EN
~ / blog
/
tag / tensor-parallel
❯
grep -r "#tensor-parallel" ~/blog
4 篇文章
日期
閱讀
標題
2026-09-12
17m
[vLLM] 兩台 DGX Spark 跑 Qwen3.8-Flash-Next TP=2:51.9 tok/s(單機 41.7)
#dgx-spark
#vllm
#tensor-parallel
#qwen3.8-flash-next
2026-08-23
13m
[Benchmark] 我把 2080 Ti 的 NCCL 修好了,然後發現它沒快多少
#nccl
#llama.cpp
#tensor-parallel
#2080-ti
2026-08-23
19m
[Benchmark] 讀者問雙卡 AllReduce 吃多少 PCIe:只佔 8%,因為搬得少、跑得勤
#llama.cpp
#tensor-parallel
#pcie
#nvlink
2026-08-22
17m
[Benchmark] 兩張改裝 2080 Ti 玩 tensor parallel,Qwen3.8-27B 衝到 59.6 tok/s
#llama.cpp
#tensor-parallel
#2080-ti
#qwen3.8
← 回到所有文章