~/ai-muninn
搜尋
⌘K
blog
github
EN
~ / blog
/
tag / gtx-970
❯
grep -r "#gtx-970" ~/blog
4 篇文章
日期
閱讀
標題
2026-06-14
13m
[趣味競賽] 用一張 GTX 970 架部落格 RAG 客服:不裝 torch、不用向量資料庫、不碰 LangChain
#gemma-4
#gtx-970
#rag
#llama.cpp
2026-06-14
9m
[趣味競賽] 在 GTX 970 上,Flash Attention 讓長 context 的 decode 接近翻倍(24.3 → 42.5 tok/s)
#gemma-4
#gtx-970
#flash-attention
#kv-cache
2026-06-09
9m
[趣味競賽] 把 GTX 970 變語音助手:Gemma 4 E2B 多模態 + Piper TTS,端到端 2.8 秒
#gemma-4
#gtx-970
#multimodal
#piper-tts
2026-06-09
10m
[趣味競賽] GTX 970 跑 Gemma 4 E2B:最大的量化檔反而最快(47.6 tok/s)
#gemma-4
#quantization
#gtx-970
#llama.cpp
← 回到所有文章