~/ai-muninn
搜尋
⌘K
blog
github
EN
~ / blog
/
tag / moe
❯
grep -r "#moe" ~/blog
11 篇文章
日期
閱讀
標題
2026-08-02
17m
[洋垃圾跑大模型 #4] 把前沿級開源模型搬進自己家:一張 22G 老卡跑 DeepSeek-V4-Flash-0731
#deepseek-v4-flash
#0731
#moe
#洋垃圾
2026-07-29
20m
[洋垃圾跑大模型 #3] 一張 22G 老卡跑 284B:DeepSeek-V4-Flash 比 DGX Spark 快 18%
#deepseek-v4-flash
#moe
#洋垃圾
#2080-ti
2026-07-22
10m
[洋垃圾跑大模型 #2] 一張 22G 老卡跑 118B 的 coding 大模型:Poolside Laguna S 2.1 實戰
#laguna
#poolside
#moe
#洋垃圾
2026-07-21
9m
[洋垃圾跑大模型 #1] 一台洋垃圾三張老卡,怎麼跑得動 119B 的大模型
#llama.cpp
#moe
#expert-offload
#2080-ti
2026-06-01
9m
[Benchmark] NVFP4 W4A4 在 DGX Spark 上超車 FP8:拔掉 enforce-eager,MoE 從 23 衝到 67 tok/s
#nvfp4
#w4a4
#fp8
#dgx-spark
2026-05-01
13m
[vLLM] DGX Spark 跑 Nemotron 3 Nano NVFP4:74.75 tok/s,比公開值快 11.5%
#nemotron-3
#nvfp4
#vllm
#dgx-spark
2026-04-28
14m
[llm-compressor] 自量化 abliterated 35B FP8 on DGX Spark:4 次 OOM、3 個 prefix bug、最終 51 tok/s
#dgx-spark
#gb10
#sm121
#llm-compressor
2026-04-13
6m
[Benchmark] Gemma 4 全家桶 on DGX Spark — 哪個版本適合你?
#gemma-4
#dgx-spark
#gb10
#benchmark
2026-04-08
8m
[LLM 101 #2] Dense、MoE、PLE、SSM — 四種 AI 模型架構,一次搞懂
#dense
#moe
#ple
#ssm
2026-04-05
7m
[vLLM] Gemma 4 26B-A4B NVFP4 跑在 DGX Spark:52 tok/s,模型只佔 16 GB
#gemma-4
#nvfp4
#vllm
#dgx-spark
2026-03-01
8m
[Benchmark] 純 MoE vs SSM Hybrid:Context Decay 與為什麼 Agent 要在乎
#benchmark
#ssm
#moe
#dgx-spark
← 回到所有文章