TL;DR: 用 Qwen3.5-9B(Q4_K)在單張 16GB AMD GPU 上跑本地 LLM-as-a-Verifier,每次 code comparison 約 0.5–2 秒,cache hit rate 66%,正確程式碼穩定給 1.0 分,有 bug 的給 0.0–0.14 分。16GB 跑 9B 模型綽綽有餘,還有空間跑其他服務。 這篇是實測續篇,前兩篇分別講了 架構設計 和 Docker 封裝 。前兩篇講的是「做什麼」跟「怎麼做」,這篇來量「到底多快」。 1. 測試環境 在一台 homelab Linux(CachyOS)上跑的: 項目 內容 GPU AMD 16GB(15.9 GiB)via ROCm 模型 Qwen3.5-9B(8.95B 參數,Q4_K ~5.7GB GGUF) 後端 llama.cpp(llama-server,ROCm HIP build) Verifier Docker container(llm-verifier),port 8010 模型 VRAM ~10.2 GB(模型本身 + 動態 KV cache) GPU 使用率 78% 系統 RAM 62 GB;使用 27 GB(swap 用了 9.3 GB) Context window 131,072 tokens MIN_SCORE 0.8 後端跑在另一台機器上,走 local Gigabit 網路連線。 2. Verifier 在幹嘛 docker-llm-as-a-verifier 包裝了 LLM-as-a-Verifier 這個研究套件,讀取 token-level log probability 來算連續分數,不是簡單的 yes/no 判斷。 Container 開了 7 個 HTTP endpoint: Endpoint Method 用途 /health GET 健康檢查 /v1/compare POST 兩組答案比對評分 /v1/select POST Best-of-N 選最佳 /v1/track POST Agent 軌跡分數追蹤 /v1/directed POST 導...
(圖片與消息來源:http://www.callbusy.biz/wordpress/?p=3042)
雖然一切都是 Rumor,不過在持續對 Samsung NX 系統的關注之下,出現這篇 Ricoh 的 Rumor,相當振奮人心!
還真是希望三方的合作有譜啊!Ricoh 在 SLR 時代就是 Pentax 的忠實夥伴,出了不少便宜又耐用的機子,我自己就有一台 Ricoh KR-5,三方的合作各有優勢,Samsung 電子性能是強項、Pentax 則可以專注於光學方面、而 Ricoh 的 GR、GX 系列正是隨身機中的經典!
如果能用 Fuji 的 Super CCD EXR,那就無敵了吧?!
詳細內容請參考:GB LIFE STYLE - RICOH NEW GZ-1 Rumor
雖然不是真的
回覆刪除還是嚇了好大一跳!
@Jarvis:這個 Rumors 很殺!我心目中最好的組合,是 Ricoh 機身品牌 + Fuji 的 Super CCD EXR + Pentax (Micro) K 接環-> 可透過轉接環接 DA (還能自動對焦?)!
回覆刪除會不會想太多,如果是真的,還來不及存錢咧~
哈哈哈哈!這篇又浮起來了啊!XD
回覆刪除Re: callbusy <8250536822414749693>
回覆刪除原來忙線大兩年前就暗示了雙方合作的契機呀!