【検証】Tesla V100 32GBでローカルLLMはどこまで動く?Qwen 3.6実測ベンチマーク — 中古13万円でMoE 98.8 tok/s
中古13万円のTesla V100 32GBでQwen 3.6を実測ベンチマーク。MoE 35Bは98.8 tok/sでM1 Maxの約1.6倍速。VRAM・電力・生成品質からllama.cppのVolta切り捨ての罠、コスパまで実測データで徹底検証します。

中古13万円のTesla V100 32GBでQwen 3.6を実測ベンチマーク。MoE 35Bは98.8 tok/sでM1 Maxの約1.6倍速。VRAM・電力・生成品質からllama.cppのVolta切り捨ての罠、コスパまで実測データで徹底検証します。

余ってるMacをDarkbloomのAI推論ノードとして貸し出すと本当に稼げるのか、MacBook Pro / M1 Max / 64GBで丸1日検証。公式試算は月75ドルですが、実測の24時間収益は0.60ドルで中身はほぼ基本報酬だけ。GPU使用率ログと実測電気代(0.36kWh/日)から損益まで正直に出しました。


SUUMO・LIFULL HOME'S・at homeなど不動産24サイトの物件ページに、洪水・津波・土砂・標高・地盤・液状化(推定)などのハザード情報を自動でバッジ表示するChrome拡張「物件ハザードチェッカー」を公開しました。基本無料・登録不要。機能と使い方を紹介します。



AIエージェントのトークン消費を最大95%削減すると謳うOSS「Headroom」を実際にMacへ導入し、ログ・JSON・コード・RAGの4種データで実測。コード79.8%・JSON59.2%・ログ31.0%削減、多段デバッグセッション全体では47.5%削減を確認しました。導入手順から仕組み、コスト試算、向き不向きまで正直にレビューします。


Apple M1 Pro(32GB)とM1 Max(64GB)で最新ローカルLLM「Qwen 2.5/3/3.5」をベンチマーク。MLX-LMとOllamaの速度比較、4bit/8bit量子化の違い、GTX 1080Tiとの三つ巴比較まで徹底検証。M1 Max + MLX 4bitでQwen 3.5 9Bが56.9 tok/sを記録しました。

GTX 1080Tiで最新の生成AI「Qwen 3.5 9B」がどこまで動くか検証しました。Q4_K_MとQ8_0の2つの量子化で速度・品質を比較。11GB VRAMの古いGPUでもローカルLLMは実用的に使えるのか、ベンチマーク結果を徹底解説します。


