~/ai-muninn
搜尋
⌘K
blog
github
EN
~ / blog
/
tag / ds4
❯
grep -r "#ds4" ~/blog
11 篇文章
日期
閱讀
標題
2026-07-25
10m
[DeepSeek-V4-Flash] 上次那個白賺的引擎升級,後來 OOM 討債:我為什麼把光羽換回舊版
#deepseek-v4-flash
#dgx-spark
#ds4
#oom
2026-07-21
10m
[DeepSeek-V4-Flash] 一句好奇,單台 DGX Spark 上白賺半代引擎升級——ds4 換 Entrpi
#deepseek-v4-flash
#dgx-spark
#ds4
#speculative-decoding
2026-07-09
12m
[本地 LLM] 我把 FlashMemory 重訓到自己的 Q2 build 上,它還是改善不了 V4-Flash 的 native lightning indexer
#dgx-spark
#gb10
#deepseek-v4-flash
#kv-cache
2026-07-07
10m
[地端 LLM] 284B 塞得進 128GB、長 context 還跑得動:DeepSeek-V4-Flash 打的是 KV cache,不是參數量
#dgx-spark
#gb10
#deepseek-v4-flash
#kv-cache
2026-07-06
10m
[本地 LLM] V4-Flash 的 depth-1 MTP:agent 回合 +9%、散文 −4%——推測解碼要看工作型態決定開不開
#dgx-spark
#gb10
#deepseek-v4-flash
#speculative-decoding
2026-07-05
11m
[本地 LLM] 養了一個月,我的 284B agent 悄悄不再快取——ds4 的 evict 風暴,跟每輪重付的 prefill
#dgx-spark
#gb10
#deepseek-v4-flash
#kv-cache
2026-06-21
8m
在 abliterated DeepSeek-V4 上做 Directional Steering:同一把刀,疊起來會打架
#deepseek-v4
#directional-steering
#activation-steering
#abliteration
2026-06-19
9m
[Agent 進階 #11] 把助理的腦換成你家機器上的:從雲端 ChatGPT 換成本地模型
#ai-助理
#ai-agent
#hermes
#本地模型
2026-06-12
6m
[地端 LLM] 權重就是正義:284B 砍到 2-bit,還是比塞得下的小模型強
#dgx-spark
#gb10
#deepseek-v4-flash
#量化
2026-06-12
13m
[地端 LLM] 把 15 tok/s 的 284B 當每天的 agent 大腦:DeepSeek-V4-Flash 怎麼設才舒服
#dgx-spark
#gb10
#deepseek-v4-flash
#kv-cache
2026-06-12
10m
[地端 LLM] 第一次跑 Q2 就以為模型變笨了 —— 284B DeepSeek-V4-Flash 在 128GB 桌機,真兇是 parser 不認 DSML
#dgx-spark
#gb10
#deepseek-v4-flash
#ds4
← 回到所有文章